Lihan Zha
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EmbodiedSWE:長期的器用ロボティクスのためのコーディングエージェントVLA2026/9/23
コーディングエージェントが長期的・器用なロボットタスクを解き、その解を多様な軌道に拡張してVLAを訓練し、実機タスクまで完了できることを示した研究。
- RAVEN: 視覚・空間・時間メモリによる長期的推論とナビゲーションナビゲーション2026/6/1
ロボットの長期運用向けに、視覚特徴と位置・時刻をベクトルDBに保存し、空間マップで検索するメモリシステムRAVENを提案。画像を直接扱うことで高精度かつ低コストな長期QA・ナビゲーションを実現し、実機でも検証した。
- KinDER: ロボット学習と計画のための物理的推論ベンチマークベンチマーク2026/4/1
ロボットの物理的推論能力を評価するためのベンチマークKinDERを提案し、既存手法が多くの環境で課題を抱えることを示した。
- PlayWorld: 自律的な遊びからロボットの世界モデルを学習する世界モデル2026/3/1
ロボットの自己遊びデータのみから高忠実度のビデオ世界モデルを学習する手法を提案し、物理的に一貫した物体操作の予測を実現した。
- LAP: 言語-行動事前学習によるゼロショットの異機体転移VLA2026/2/1
ロボットの低レベル行動を自然言語で表現して事前学習することで、未知のロボット機体にもファインチューニングなしでゼロショット転移できるVLAモデルLAP-3Bを提案した。
- ロボティクスにおける動画生成モデル:応用・研究課題・将来展望世界モデル2026/1/1
動画生成モデルをロボティクスの世界モデルとして活用する研究をサーベイし、模倣学習や強化学習などへの応用と課題を整理した。
- 不完全なシミュレータを用いた信頼性と拡張性のあるロボット方策評価sim2real2025/10/1
少数の実機評価と大規模シミュレーションを組み合わせ、予測駆動型推論でバイアスを補正して方策性能の信頼区間を推定する枠組みを提案。
- 行動を言語として扱う:壊滅的忘却なしにVLMをVLAへ微調整する手法VLA2025/9/1
ロボットの遠隔操作データを自然言語で表現することで、VLMの基盤能力を損なわずにLoRAのみでVLAへ微調整する手法を提案し、実世界実験でゼロショット汎化を実証した。
- WoMAP: 実世界モデルによる身体性を伴うオープン語彙物体位置推定VLA2025/6/1
ガウススプラッティングによる実→シミュ→実パイプラインと潜在世界モデルを組み合わせ、実演データなしでオープン語彙物体位置推定ポリシーを学習する手法を提案。
- 因子分解スケーリング曲線によるデータ収集の指針模倣学習2025/5/1
データ量に対する性能変化を因子ごとに定量化する因子分解スケーリング曲線を構築し、限られた予算で最も影響力のある因子の組み合わせに絞ったデータ収集を可能にする手法を提案。
- Distilling and Retrieving Generalizable Knowledge for Robot Manipulation via Language Corrections2023/11/1
- DoReMi: Grounding Language Model by Detecting and Recovering from Plan-Execution Misalignment2023/7/1