Hang Zhang
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GroundingPI:視覚プリミティブで物理知能に挑むグラウンディング基盤モデルVLA2026/9/30
点やボックスを量子化座標として生成する4Bのグラウンディング基盤モデルを提案し、ロボット操作や自動運転の視覚バックボーンとして性能を向上させた。
- Behavior-Skill: 長期的タスクにおける視覚-言語-行動ポリシー評価のための細粒度ベンチマークVLA/ベンチマーク2026/8/31
長期的なモバイル操作タスクを構成するスキル単位で学習・評価するベンチマークを提案し、VLAポリシーの失敗箇所を詳細に分析できるようにした。
- ABot-Earth 0.5: 生成型3D地球モデル3D生成2026/6/8
衛星画像から広大な3D環境を生成する生成モデルを提案し、3Dガウススプラッティングを用いてリアルな都市景観を高速に合成する。
- TrackRef3D: 3Dガウススプラッティングにおけるオープンワールド参照セグメンテーションのための多視点一貫トラック・アンド・ラベル手法3Dセグメンテーション2026/5/26
3Dガウススプラッティングにおいて、手動アノテーションなしで自然言語によるオブジェクトセグメンテーションを実現する自動パイプラインを提案。物体発見と意味的接地を分離し、軌跡認識型セマンティックコンセンサスモジュールで多視点一貫性を確保する。
- DeepSight: 潜在状態予測による長期的世界モデリングを用いたエンドツーエンド自動運転自動運転2026/5/1
自動運転のための世界モデルを提案し、BEV空間で将来フレームの潜在意味特徴を並列予測することで長期的な状態予測を行い、さらに適応的なテキスト推論で長尾シナリオの性能を向上させ、閉ループベンチマークでSOTAを達成した。
- DailyArt: 潜在ダイナミクスによる単一静止画像からの関節構造の発見関節推定2026/4/9
単一の閉じた状態の画像から、物体の関節パラメータを推定する新しい手法を提案。まず開いた状態の画像を合成して関節の手がかりを露出させ、観測画像との差分から全関節を同時に推定する。
- 交通規則を持続的に自己回帰マッピングする自動運転フレームワーク自動運転/HDマップ2025/9/1
視覚情報から車線ベクトルと交通規則を自己回帰的に同時構築し、規則の持続的な有効性を保つPAMRを提案した論文。
- UAV向け周波数ポイントゲーム環境:専門知識と大規模言語モデルの活用通信/ゲーム理論2025/8/1
UAVの通信妨害と対抗戦略を模擬するゲーム理論環境UAV-FPGを提案し、専門知識ベースと大規模言語モデルを組み合わせて周波数選択と経路計画を最適化した。
- フィードバック制御された光機械式ソフトロボットアクチュエータソフトロボティクス2024/12/1
光応答材料にバッフルとアクチュエータの機構を組み込み、正負のフィードバックをプログラムすることで、多安定形状変化や自己調節型の移動・遊泳ロボットを実現した。