Mengyu Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
画像編集VLAヒューマノイドナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ChordEdit再考:再現・簡素化・新たな洞察による一段階画像編集の再定義画像編集2026/6/12
一段階画像編集手法ChordEditを再現・解析し、その動作メカニズムを解明して簡素化した論文。
- GEM-4D: ロボット操作のための幾何学強化ビデオワールドモデルVLA2026/5/1
ビデオ生成モデルに4次元対応関係の教師信号を注入し、外観と幾何構造を同時に学習させることで、物理的に一貫した未来予測とロボット操作への直接適用を可能にした。
- 歩行事前知識を用いたヒューマノイド全身運動のワンショット適応ヒューマノイド2025/10/1
歩行運動で学習済みの基盤モデルと単一の非歩行運動サンプルを組み合わせ、最適輸送による補間で新しい全身運動を生成し、強化学習で適応させるデータ効率の高い手法を提案した。
- 身体性行動連鎖推論とマルチモーダル基盤モデルによるヒューマノイドのゼロショット移動操作エージェントVLA2025/4/1
基盤モデルの推論と身体性行動連鎖(CoA)機構を組み合わせ、人間の指示を移動・操作のプリミティブ列に分解することで、ヒューマノイドのゼロショット移動操作を実現したフレームワーク。
- 大規模言語モデルによる双方向自然言語対話で強化された社会的配慮型ロボットナビゲーションナビゲーション2024/9/1
深層強化学習と大規模言語モデルを組み合わせ、歩行者と双方向に自然言語で対話しながら衝突回避や経路決定を行う社会的配慮型ナビゲーション手法を提案した。
- 都市環境におけるLLMナビゲーションの安全性はどれほどか?VLA2024/2/1
都市部の屋外ナビゲーションにLLMを用いたモデルに対し、プロンプトを摂動させる攻撃手法(NPI/NPS)を提案し、ホワイトボックス・ブラックボックス両設定で性能が大きく低下することを示した。