Xiaolin Fang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA模倣学習セグメンテーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- ストリーミングフローポリシー:行動軌道をフロー軌道として扱う拡散・フローマッチングポリシーの簡略化VLA2025/5/1
拡散・フローマッチングポリシーを簡略化し、行動軌道をフロー軌道として扱うことで、サンプリング中にリアルタイムで行動をロボットにストリーミング可能にした手法を提案。
- 大規模モデルによるキーポイント抽象化を用いた物体相対模倣学習模倣学習2024/10/1
大規模視覚言語モデルを活用してタスクに関連し物体間で一貫したキーポイントを自動生成し、少数の実演データから物体姿勢や視点の変化に頑健な模倣学習を実現するフレームワークKALMを提案。
- 不確実性を考慮した物体インスタンスセグメンテーションと身体性インタラクションセグメンテーション2024/8/1
大規模事前学習モデルを複数回クエリして物体セグメンテーションの仮説分布と信頼度を生成し、ロボットが不確実性を考慮して行動選択できる手法を提案。実機実験で有効性を示した。
- DiMSam: Diffusion Models as Samplers for Task and Motion Planning under Partial Observability2023/6/1
- Long-Horizon Manipulation of Unknown Objects via Task and Motion Planning with Estimated Affordances2021/8/1