Yiteng Chen
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RecastVLA: 適応的ポリシー状態による過去の相互作用から未来の制御へVLA2026/9/26
フローマッチング型VLAポリシー内に適応的ポリシー状態を保持し、テスト時訓練で過去の行動生成履歴を次の制御に活かす手法を提案。LIBEROやRoboTwin、実機タスクで成功率を向上させた。
- SCULPT-VLA: 段階的行動グラウンディングによる構造化制御の学習VLA2026/9/20
VLAポリシーにおいて、タスク進行・シーン動態・空間グラウンディングの要素を段階的に学習させ、教師なしで連続制御を洗練する手法を提案。LIBEROや実機タスクで成功率を向上させた。
- LIFD: ロボットマニピュレーションのための3D認識シーン記憶を実現するアンカード拡散モデルマニピュレーション2026/9/17
単一RGB視点とリカレントメモリから3D認識のシーントークンを拡散モデルで補完し、マニピュレーションポリシーに接続するシーン記憶フレームワークを提案。LIBEROやMetaWorld、実機UR5eで高い成功率を達成した。
- RoboRouter:ロボットマニピュレーションのための訓練不要なポリシールーティングマニピュレーション2026/3/1
複数の既存ロボット操作ポリシーをプールし、タスクごとに最適なポリシーを経験から学習して選択する訓練不要のルーティング手法を提案。シミュレーションと実世界で成功率を向上させた。
- AntiGrounding:ロボット行動をVLM表現空間に持ち上げて意思決定を行うVLA2025/6/1
ロボットの行動候補をVLMの表現空間に直接持ち上げ、複数視点の軌道を描画してVQAで指示に基づく意思決定を行うことで、ゼロショットで最適な閉ループ軌道を生成するフレームワークを提案。
- FrankenBot: 視覚言語モデルを用いた脳形態モジュール型ロボットマニピュレーションマニピュレーション2025/6/1
視覚言語モデルを活用し、人間の脳の構造を模倣したモジュール型フレームワークで、ロボットマニピュレーションのタスク計画から異常処理までを統合し、効率と汎用性を両立させた。
- T-Rex: 視覚言語モデルを用いたロボット操作のためのタスク適応型空間表現抽出VLA2025/6/1
視覚言語モデルをロボット操作に応用する際、タスクの要求に応じて物体ごとに最適な空間表現抽出手法を動的に選択するフレームワークを提案し、実環境実験で空間理解・効率・安定性の向上を示した。