Jiaming Zhou
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Zero-WAM: 人間のビデオからの文脈内世界行動モデリングによるオープンエンドなタスク汎化VLA2026/8/26
人間のビデオを文脈内の指示として用いることで、訓練時に見たことのない操作タスクをゼロショットで実行できるビデオ行動モデルを提案した。
- 汎用ロボット制御のためのネイティブなビデオ・アクション事前学習VLA2026/7/1
ロボット制御に特化したビデオ・アクション基盤モデルLingBot-VA 2.0を提案。意味的視覚・行動トークナイザ、因果事前学習、スパースMoE、非同期推論により、複雑な操作タスクでの数ショット汎化を実現した。
- EgoTraj-Bench: 一人称視点のノイズ観測下での頑健な軌道予測ベンチマーク軌道予測2025/10/1
一人称視点のノイズを含む観測履歴とクリーンな俯瞰視点の未来軌道を対応付けた初の実世界ベンチマークを構築し、観測のノイズ除去と未来予測を同時に行う二流フローマッチングモデルBiFlowを提案した。
- 見て想像する:人間の実演と未来予測による長期的マニピュレーションの誘導マニピュレーション2025/9/1
人間の実演動画から手順意図を推論し、生成モデルで未来の動画ロールアウトを合成して低レベル制御を導く階層的フレームワークSuper-Mimicを提案し、長期的マニピュレーションタスクでゼロショット手法を20%以上上回った。
- 生LiDAR点群から直接制御する人型ロボットの安全で快適な歩行ポリシー歩行2025/8/1
生のLiDAR点群を直接モータ指令に変換するエンドツーエンド歩行ポリシーを提案し、制約付きMDPと制御バリア関数を組み合わせて安全性を保証、快適性報酬で人間に配慮した動きを実現、実機へ転移した。
- 全方位知覚:動的環境における脚式移動のための全方向衝突回避歩行2025/5/1
生のLiDAR点群を直接処理して3D空間認識と全方向衝突回避を実現する脚式ロボットのエンドツーエンド移動ポリシーを提案し、高忠実度LiDARシミュレータで訓練して実環境でも検証した。
- 未見タスクへの汎化に挑む視覚-言語-行動マニピュレーションの限界探索VLA2025/5/1
VLAモデルのクロスタスク汎化を評価する新ベンチマークAGNOSTOSを提案し、文脈内デモンストレーションで未見タスクの行動を予測するX-ICM手法を導入した。
- GLOVER++:人間の行動からアフォーダンス学習を解き放ちロボットマニピュレーションへマニピュレーション2025/5/1
50万枚のアフォーダンス注釈付き大規模データセットHOVA-500Kを構築し、人間のデモからロボット操作へアフォーダンス知識を転移するグローバル・トゥ・ローカル学習フレームワークGLOVER++を提案した。
- GLOVER: タスク指向把持のための汎用オープン語彙アフォーダンス推論マニピュレーション2024/11/1
大規模言語モデルを微調整してRGB画像から把持可能な部位のアフォーダンスを推論し、実世界で高速・高精度にタスク指向把持を実現するフレームワークを提案。
- 言語指示に基づくマルチタスクロボット操作のための対照的模倣学習模倣学習2024/6/1
言語指示と視覚観察から多様な操作タスクを実行するエンドツーエンド模倣学習エージェントSigma-Agentを提案し、対照的学習とマルチビューTransformerで性能を向上させた。
- ロボット操作のための視覚事前学習における人間-ロボットドメインギャップの緩和マニピュレーション2024/6/1
人間とロボットのペア動画を用いたコントラスティブ学習で、人間の活動データで事前学習した視覚モデルをロボット領域に適応させ、操作タスクの成功率を向上させた研究。