Jiwen Zhang
収録論文 9本 ・ フィジカルAI/ロボット学習
視覚言語ナビゲーションVLAマルチエージェント協調VLA/操作ナビゲーション組立/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Talk2Escape: 対話による視覚言語ナビゲーションの閉ループ化視覚言語ナビゲーション2026/9/23
ナビゲーションエージェントの迷走を検知したら対話で修正指示を求める仕組みを提案し、シミュレータと実機で成功率と頑健性を向上させた。
- 領域到達からインスタンスレベルの接地へ:視覚と言語によるナビゲーションの改善VLA2026/7/1
VLNエージェントの最終位置の精度と対象物の可視性を評価する指標を導入し、最終段階のナビゲーションを改善するモジュールREALMを提案した。
- MECoBench: 具現化環境におけるマルチモーダルエージェント協調の体系的研究マルチエージェント協調2026/6/30
マルチモーダル大規模言語モデルを具現化エージェントとして協調させるためのベンチマークMECoBenchを提案し、多様な実世界タスクでの協調効果と限界を実験的に分析した。
- LIBERO-Occ: 視点想像によるシーン起因の遮蔽下での視覚言語行動モデルの評価と改善VLA/操作2026/6/9
遮蔽がある操作環境でVLAモデルの性能が低下する問題を調べ、遮蔽評価ベンチマークLIBERO-Occを導入し、補完視点を想像して行動予測に活用する手法VIMを提案した。
- SpatialAnt: 能動的なシーン再構築と視覚的予測による自律ゼロショットロボットナビゲーションナビゲーション2026/3/1
ロボットが未知環境を事前探索して自己構築した不完全な3D再構築を用いて、ゼロショットで言語指示によるナビゲーションを実現するフレームワークを提案した。物理的接地によるスケール回復と視覚的予測による経路の反実仮想推論で性能を向上させた。
- SpatialNav: 空間シーングラフを活用したゼロショット視覚言語ナビゲーションナビゲーション2026/1/1
環境を事前探索して空間シーングラフを構築し、エージェント中心の地図と方位合わせした視覚表現、遠隔物体位置推定を組み合わせることで、ゼロショット視覚言語ナビゲーションの性能を大幅に向上させた。
- 不確実な嵌合タイプと嵌合量を伴うバッチ精密組立タスクのためのロバストでコンプライアントなロボット組立制御戦略組立/強化学習2025/8/1
嵌合タイプや嵌合量が不確実なバッチ精密組立において、力・視覚融合制御とマルチタスク強化学習、マルチティーチャー方策蒸留を組み合わせ、ロバストなコンプライアンス制御戦略を構築した研究。
- Robotic Assembly Control Reconfiguration Based on Transfer Reinforcement Learning for Objects with Different Geometric Features2022/11/1
- Local Connection Reinforcement Learning Method for Efficient Control of Robotic Peg-in-Hole Assembly2022/10/1