Xueying Jiang
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーションVLAタスクプランニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CodeActionBench:身体性マニピュレーションのためのエージェント型Code-as-Policy評価マニピュレーション2026/9/27
汎用マルチモーダルモデルが実行可能コードを通じて視覚理解と推論を身体性マニピュレーションに変換できるかを評価する25タスクのベンチマークを提案し、9構成・675試行で成功率2.7〜73.3%を報告した。
- 固定カメラから自由カメラへ:キャリブレーション不要の視点ロバストな視覚言語行動モデルVLA2026/7/1
カメラの位置が変わっても、その位置情報を明示的に与えずにロボットが自分で視点を推定して操作できる新しいVLAモデルを提案した。カメラ中心の動作予測と手と目の関係行列の予測を組み合わせ、単眼RGB画像だけで多様な視点で成功率を向上させる。
- 3D推論駆動型プランニング:暗黙の人間意図から経路考慮型活動計画へタスクプランニング2025/3/1
暗黙の指示から意図を推論し、3Dシーンの形状・位置情報を活用して経路計画を含む多段階タスク計画を生成する新タスクとベンチマーク・手法を提案した。