Chenguang Huang
収録論文 9本 ・ フィジカルAI/ロボット学習
シーン理解関節物体推定拡散ポリシー/世界モデル/オフラインRLVLA動的シーン理解ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OGScene3D: シーン理解のための漸進的オープンボキャブラリ3Dガウシアンシーングラフマッピングシーン理解2026/3/1
ロボットが環境を漸進的に探索しながら、オープンボキャブラリの3Dセマンティックマップとシーングラフを構築するシステムを提案した。
- 実環境における関節物体の推定関節物体推定2025/9/1
動的なカメラ移動と部分観測の下で、RGB-D動画から関節物体のパーツ軌跡と関節軸を推定するフレームワークArtiPointを提案し、新データセットArti4Dで評価した。
- DiWA: 世界モデルによる拡散ポリシーの適応拡散ポリシー/世界モデル/オフラインRL2025/8/1
世界モデルを活用し、拡散ポリシーをオフライン強化学習でファインチューニングするフレームワークDiWAを提案。実環境との相互作用を大幅に削減し、CALVINベンチマークで8タスクの性能を向上させた。
- ロボットナビゲーションと操作のためのマルチモーダル空間言語マップVLA2025/6/1
視覚・言語・音声の特徴を3D環境再構成に融合した空間マップを構築し、LLMと組み合わせて自然言語指示やマルチモーダルな目標を地図上に定位してロボットのナビゲーションと操作を可能にする手法を提案。
- BYE: 探索データ1シーケンスだけで長期動的シーン理解を実現するエンコーダ構築動的シーン理解2024/12/1
1回の探索データ系列のみで学習するクラス非依存の点群エンコーダを提案し、VLMとのアンサンブルで動的環境での物体対応付けを高精度化した研究。
- 言語に基づくロボットナビゲーションのための階層的オープン語彙3Dシーングラフナビゲーション2024/3/1
オープン語彙の視覚基盤モデルを用いて、床・部屋・物体の階層を持つ3Dシーングラフを構築し、多階層建物内での言語指示に基づくロボットナビゲーションを実現した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Audio Visual Language Maps for Robot Navigation2023/3/1
- Visual Language Maps for Robot Navigation2022/10/1