Chenghao Gu
Tsinghua University
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーションワールドモデルVLAデータ生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ChunkTrust: 行動専門家の証拠に基づくロボット政策の実行ホライズン適応マニピュレーション2026/9/30
ロボット基盤政策が予測する行動チャンクの実行長を、固定値ではなく行動専門家の証拠から推論する潜在変数として扱い、訓練不要のセレクタと軽量アダプタで適応的に決定する手法を提案。
- GeniWorld: 視覚的アクションによるロボット操作のための汎化可能なインタラクティブワールドモデルワールドモデル2026/8/1
事前学習済みビデオ生成モデルとURDFベースのレンダリングを組み合わせ、数値アクションを視覚的アクション表現に変換することで、未見環境へのロバストなゼロショット汎化を実現するインタラクティブワールドモデルを提案した。
- MaskWAM: マスクプロンプトと予測を統合したワールドアクションモデルVLA2026/6/11
ロボット制御のためのワールドアクションモデルに、マスクを入力と予測の両方に統合する手法を提案し、言語の曖昧さを低減して汎化性能を向上させた。
- IGen: オープンワールド画像からのロボット学習のためのスケーラブルなデータ生成データ生成2025/12/1
オープンワールド画像から3Dシーン表現とVLM推論を用いてロボットの視覚運動データを生成し、実世界データに匹敵する性能のポリシー学習を可能にするフレームワークを提案。