Piaopiao Jin
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Xiaomi-Robotics-1: 10万時間以上の実世界軌道データによる視覚言語行動モデルのスケーリングVLA2026/7/1
10万時間以上の実世界の操作軌跡データを用いて、汎用的な視覚言語行動(VLA)モデルを事前学習し、未見環境での指示追従や少量データでの適応を可能にする基盤モデルを構築した。
- Xiaomi-Robotics-0:リアルタイム実行可能なオープンソース視覚言語行動モデルVLA2026/2/1
大規模なロボット軌道と視覚言語データで事前学習し、非同期実行のための学習技術と展開時のタイムステップ調整により、民生用GPUで高速かつ滑らかなリアルタイム動作を実現したVLAモデルを提案。
- FPC-VLA:失敗予測と修正のためのスーパーバイザを備えた視覚-言語-行動フレームワークVLA2025/9/1
VLAモデルに失敗予測と修正を行うスーパーバイザを組み合わせ、シミュレーションと実機で成功率を向上させたデュアルモデルフレームワーク。
- VLAモデルのデュアルアクター微調整:対話と修正によるヒューマン・イン・ザ・ループ手法VLA2025/9/1
人間の修正を言語コマンドに変換する「talk-and-tweak」を取り入れた強化学習ベースの二重アクター微調整フレームワークを提案し、実世界の多タスク操作で高成功率と効率向上を実現した。
- Learning 6-DoF Fine-grained Grasp Detection Based on Part Affordance Grounding2023/1/1
- Multi-Modal Fusion in Contact-Rich Precise Tasks via Hierarchical Policy Learning2022/2/1