Siqiao Huang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA全身制御/動作生成世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GroundingPI:視覚プリミティブで物理知能に挑むグラウンディング基盤モデルVLA2026/9/30
点やボックスを量子化座標として生成する4Bのグラウンディング基盤モデルを提案し、ロボット操作や自動運転の視覚バックボーンとして性能を向上させた。
- WB-WAM:ヒューマノイド移動操作のための異種全身・手事前学習VLA2026/9/28
身体・ルート・巧みな手の動作を統合した行動空間で動画と行動を事前学習し、人間の動作データを活用してヒューマノイドの移動操作をデータ効率的に学習する手法を提案。
- OpenWAM: 体系的な世界行動モデル事前学習に向けたオープンでモジュール型の探求VLA2026/9/7
世界行動モデルの設計空間をモジュール化し、制御実験を通じて設計原則を抽出・検証するオープンな研究基盤を構築した。
- OMG: 汎用人型ロボット制御のための全モーダル動作生成全身制御/動作生成2026/6/1
多様な入力モダリティ(言語、音声、人間の参照動作)に基づいて全身動作を生成する拡散モデルを提案し、データキュレーションと階層的制御構造により汎用的な人型ロボット制御を実現した。
- ナノ・ワールドモデル:未来動画予測のミニマル実装世界モデル2026/5/17
拡散フォーシングを中心とした、将来のビデオ予測のためのコンパクトで再現可能なコードベースを提供し、世界モデルの設計選択を制御された方法で研究できるようにした。