Kechun Xu
収録論文 17本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- APT: 行動エキスパートの事前学習による視覚-言語-行動ポリシーの指示汎化の改善VLA/汎化2026/6/1
視覚-言語-行動モデルにおいて、言語データの不均衡が原因で未見の指示への汎化が悪い問題を、行動エキスパートを事前学習する二段階手法APTで解決した。
- 方向が鍵:力の方向を学習することで接触の多い操作のSim-to-Real転移を実現sim2real2026/2/1
シミュレーションで人間設計の位置・力制御器を教師として使い、接触力の方向を予測する方策を学習。実機では力覚アダミタンス制御器を構成し、電子レンジ開けやペグ挿しなど4タスクで高い成功率と頑健性を示した。
- 見て行動し、プロンプトで指定する:視覚言語行動ポリシーのベイズ分解VLA2025/12/1
VLAモデルのファインチューニングで生じる言語忘却と視覚ショートカットを、ポリシーを視覚行動事前と言語条件付き尤度にベイズ分解することで解決し、未知の指示・物体・環境への汎化性能を向上させた。
- 身体構成に同変な視覚-言語-行動ポリシーに向けてVLA2025/9/1
ロボットの身体構成の変化に対して同変性を持つように視覚-言語-行動ポリシーを設計し、新しい機体構成への汎化と効率的なファインチューニングを実現した研究。
- ExploreVLM:視覚言語モデルによる閉ループロボット探索タスクプランニングVLA2025/8/1
視覚言語モデルを活用し、自己反省型の二段階プランナーと物体中心の空間関係グラフ、実行検証による閉ループ機構で、ロボットの対話的探索とリアルタイム再計画を実現したフレームワーク。
- 言語指示・視覚観察・インタラクションに基づく3D物体アフォーダンスのグラウンディングアフォーダンス2025/4/1
言語指示・視覚観察・インタラクションから3D物体のアフォーダンス領域を推定する新タスクを提案し、そのためのデータセットAGPILとマルチモーダル言語誘導型ネットワークLMAffordance3Dを構築した。
- 雑然環境における言語条件付きピック&プレースのための無条件行動事前分布の効率的アラインメントマニピュレーション2025/3/1
視覚・言語・行動の基盤モデルの事前知識を統合し、1つのアテンション層で無条件行動事前分布を3D視覚言語事前分布にアラインメントすることで、少ないデータで学習しつつゼロショット汎化を保ち、雑然環境での言語条件付きピック&プレースを効率的に実現する手法A²を提案。
- UniMM:マルチエージェントシミュレーションのための統合混合モデルフレームワークマルチエージェントシミュレーション2025/1/1
自動運転シミュレーション向けに、回帰ベース混合モデルと離散NTPモデルを包含する統合混合モデルフレームワークを提案し、閉ループサンプル生成と時間的脱結合・整合機構で分布シフトを緩和、WOSACベンチマークで最先端性能を達成した。
- 把持・認識・配置:方策構造の事前知識を活用した効率的な未知物体再配置マニピュレーション2024/2/1
知覚ノイズに頑健な未知物体再配置のため、把持と配置の分離構造を事前知識として組み込んだ二重ループシステムGSPを提案し、CLIPを活用して高い完了率と少ないステップを実現した。
- Object-centric Inference for Language Conditioned Placement: A Foundation Model based Approach2023/4/1
- A Hyper-network Based End-to-end Visual Servoing with Arbitrary Desired Poses2023/4/1
- Failure-aware Policy Learning for Self-assessable Robotics Tasks2023/2/1
- A Joint Modeling of Vision-Language-Action for Target-oriented Grasping in Clutter2023/2/1
- Learning A Simulation-based Visual Policy for Real-world Peg In Unseen Holes2022/5/1
- Efficient Object Manipulation to an Arbitrary Goal Pose: Learning-based Anytime Prioritized Planning2021/9/1
- Neural Motion Prediction for In-flight Uneven Object Catching2021/3/1
- Efficient learning of goal-oriented push-grasping synergy in clutter2021/3/1