Percy Liang
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLAW:視覚-言語-行動ポリシーと世界モデルの反復的相互改善VLA2026/2/1
実ロボットのロールアウトデータで世界モデルの精度を高め、その世界モデルが生成する合成データでVLAモデルを改善する反復手法を提案し、実タスクで成功率を39.2%向上させた。
- Cosmos Policy: 視覚運動制御と計画のための動画モデル微調整VLA2026/1/1
大規模事前学習済み動画モデルを、アーキテクチャ変更なしの一段階の追加学習だけでロボット方策に変換し、行動・将来画像・価値を潜在フレームとして生成して計画も可能にした手法。
- RoboReward: ロボティクス向け汎用視覚言語報酬モデルVLA2026/1/1
実ロボットの大規模データセットから報酬モデル用データセットとベンチマークを構築し、4B/8Bの視覚言語報酬モデルを訓練。短期的なロボットタスクで大規模VLMを上回る性能を達成し、実機強化学習に適用した。
- WorldGym: 世界モデルを政策評価環境として活用VLA2025/6/1
行動条件付き動画生成モデルを仮想環境として使い、VLAロボット政策の成功率やランキングを実世界と高い相関で評価できる手法を提案。
- RoboArena:汎用ロボットポリシーの分散型実世界評価ロボット評価/ベンチマーク2025/6/1
評価者ネットワークが自由にタスクと環境を選び、ペア比較の二重盲検評価を集約することで、汎用ロボットポリシーをスケーラブルかつ公平にランキングする手法を提案し、7機関・600以上の実機評価で有効性を示した。
- 視覚言語行動モデルの微調整:速度と成功率の最適化VLA2025/2/1
VLAモデルの微調整戦略を検討し、並列デコードやアクションチャンキングを組み合わせた最適化レシピを提案。LIBEROベンチマークで成功率を76.5%から97.1%に向上させ、推論速度も26倍高速化した。
- ボーカルサンドボックス:状況に応じた人とロボットの協働のための継続学習と適応人ロボット協働2024/11/1
音声対話やキネステティック教示など多様な教示から、ロボットが低レベル技能と高レベル計画を継続的に学習・適応する枠組みを提案し、ギフト袋詰めとLEGOストップモーション制作で有効性を示した。
- 身体性エージェントインターフェース:身体的意思決定のためのLLMベンチマークVLA2024/10/1
LLMを用いた身体的意思決定を統一的に評価するための汎用インターフェースを提案し、多様なタスク・モジュール・細粒度エラー指標でLLMの能力を体系的に分析するベンチマークを構築した。
- OpenVLA: オープンソースの視覚-言語-行動モデルVLA2024/6/1
97万件の実機ロボット実演で学習した7BパラメータのオープンソースVLAモデルを提案し、閉源モデルRT-2-Xを上回る汎用マニピュレーション性能と効率的なファインチューニングを実現した。
- Language-Driven Representation Learning for Robotics2023/2/1
- "No, to the Right" -- Online Language Corrections for Robotic Manipulation via Shared Autonomy2023/1/1
- LILA: Language-Informed Latent Actions2021/11/1
- Learning Adaptive Language Interfaces through Decomposition2020/10/1