Bin Qian
収録論文 4本 ・ フィジカルAI/ロボット学習
触覚マニピュレーションVLA操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TacDyn-WAM: 異種視触覚ワールドアクションモデルにおける暗黙的触覚ダイナミクスの学習触覚2026/9/30
触覚の未来画像を再構成する代わりに、触覚ダイナミクスを表現空間で予測する視触覚ワールドアクションモデルを提案し、UniVTACで81.5%の成功率を達成した。
- VLA-Corrector: 段階認識可能な観測状態理解に基づくプロンプト駆動型閉ループ回復フレームワークマニピュレーション2026/9/6
固定されたVLAポリシーをパラメータ更新なしで閉ループ補正するため、観測履歴から操作の進行段階と失敗パターンを推定する検証器を導入し、異常時に段階条件付き回復プロンプトを生成する手法を提案した。
- EMERGE-Policy: ロボットの心は単一ポリシーを超えて出現するVLA2026/8/30
複数の専門エージェントが協調して知覚・推論・検証・記憶を行うグラフ構造のエージェントフレームワークを提案し、追加のファインチューニングなしでベンチマークと実ロボット実験で高い性能を達成した。
- ST-WAM: 視覚分布シフト下でのロバストな操作のための意味的時間的世界行動モデル操作2026/7/1
視覚分布の変化に頑健なロボット操作のため、DINOv3特徴を共有表現として用いる意味的時間的世界行動モデル(ST-WAM)を提案し、将来予測と履歴検索を改善した。