Chuanhao Ma
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TriRelVLA: 汎化可能な身体化操作のための三者関係構造VLA2026/5/1
視覚言語行動モデルの汎化性を高めるため、物体・手・タスクの三者関係を明示的に表現し、関係性に基づいて行動生成を行うフレームワークを提案した。
- ST-π: ロボット操作のための構造化時空間VLAモデルVLA2026/4/1
視覚・言語・行動モデルに時空間の明示的な構造化を導入し、サブタスクと空間・時間の接地を計画するVLMと、それに基づき行動を生成する専門家モジュールを組み合わせたロボット操作モデルを提案した。