Fangchen Liu
収録論文 18本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 量より質:データ中心ロボット学習のための影響関数によるデモンストレーションキュレーションデータキュレーション2026/3/1
デモンストレーション学習において、検証データへの損失削減への貢献度を影響関数で推定し、高品質なデータを選別する手法QoQを提案。シミュレーションと実環境で既存手法より高い性能を達成。
- VeoワールドシミュレータによるGeminiロボティクスポリシーの評価sim2real2025/12/1
最先端の動画生成モデルVeoを基盤とした生成評価システムを構築し、ロボットポリシーの通常性能から分布外汎化、物理・意味的安全性までをシミュレーションで評価できることを示した。
- ViTaMIn-B: 信頼性と効率性を備えた視触覚両手操作インターフェース触覚2025/11/1
両手・接触の多い操作タスク向けに、柔軟フレームの視触覚センサDuoTactとMeta Questコントローラによる6DoF両手姿勢取得を組み合わせた、高品質な操作データを効率的に収集できるハンドヘルドシステムを提案した。
- Gemini Robotics 1.5:高度な身体性推論・思考・動作転移で汎用ロボットの最前線を押し広げるVLA2025/10/1
異種ロボットデータから学ぶ動作転移機構と自然言語での多段階推論を組み合わせたVLAモデルと、身体性推論に特化したモデルを発表し、複雑な多段階タスクの実行と解釈性を向上させた。
- ViTaMIn: ロボット不要の視覚触覚マニピュレーションインターフェースによる接触の多いタスクの学習触覚2025/4/1
視覚と触覚を統合した手持ちグリッパで遠隔操作なしに実演データを収集し、マルチモーダル表現学習で接触の多い操作タスクを効率的に学習する手法を提案。
- OTTER: テキスト認識型視覚特徴抽出を備えた視覚-言語-行動モデルVLA2025/3/1
言語指示に意味的に対応する視覚特徴だけを選択的に抽出して行動予測に用いるVLAアーキテクチャを提案し、事前学習済みの視覚言語モデルを凍結したまま高いゼロショット汎化を実現した。
- Video2Policy: インターネット動画を活用したシミュレーションでのマニピュレーションタスクのスケーリングsim2real2025/2/1
インターネット上の人間行動動画からシミュレーションタスクを再構築し、LLM生成報酬による強化学習で汎用方策を訓練、実機転移も実現したフレームワーク。
- ExBody2: 高度で表現豊かなヒューマノイド全身制御全身制御2024/12/1
人間のモーションキャプチャとシミュレーションデータで全身追従制御器を学習し、実機に転移することで、ヒューマノイドが歩行・しゃがみ・ダンスなどの表現豊かな動きを安定して行えるようにした研究。
- Body Transformer:ロボット身体性を活用した方策学習VLA2024/8/1
ロボットの身体をセンサとアクチュエータのグラフとして表現し、マスク付きアテンションで情報を集約するBoTを提案。模倣学習・強化学習の方策において、通常のTransformerやMLPより高性能・高効率であることを示した。
- 次トークン予測によるインコンテキスト模倣学習模倣学習2024/8/1
言語や報酬を使わず、人間の教示軌道をプロンプトとして与えるだけで実機ロボットが新しいタスクを学習なしに実行できる次トークン予測モデルICRTを提案した。
- MOKA: マークベース視覚プロンプティングによるオープンワールドロボットマニピュレーションマニピュレーション2024/3/1
視覚言語モデルに画像上のマークを手がかりに質問応答させ、自由文指示からアフォーダンスを予測してロボットの卓上マニピュレーションを実現する手法を提案。
- FMB: a Functional Manipulation Benchmark for Generalizable Robotic Learning2024/1/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- SpawnNet: Learning Generalizable Visuomotor Skills from Pre-trained Networks2023/7/1
- Chain-of-Thought Predictive Control2023/4/1
- Masked World Models for Visual Control2022/6/1
- Towards More Generalizable One-shot Visual Imitation Learning2021/10/1
- SAPIEN: A SimulAted Part-based Interactive ENvironment2020/3/1