Zilong Zheng
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA/ベンチマークモデルベース計画VLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ESPIRE: 視覚言語モデルの身体化空間推論のための診断ベンチマークVLA/ベンチマーク2026/3/1
視覚言語モデルの空間推論能力を身体化ロボットタスクで評価する診断ベンチマークを提案し、タスクを位置特定と実行に分解して生成問題として扱うことで、受動的な空間推論を超えた分析を可能にした。
- プリズマティック・ワールドモデル:ハイブリッド系の計画のための合成可能なダイナミクス学習モデルベース計画2025/12/1
接触や衝突などの離散的な物理モードを専門家混合(MoE)で分解し、モード遷移を考慮した潜在ワールドモデルを提案。ヒューマノイドなどの連続制御タスクで軌道最適化の精度を向上させた。
- 物理制約下で人間の価値観に沿う対話型ロボットVLA2025/8/1
LLMを搭載したロボットが、家庭内タスクを人間の好みと物理的制約の両方を考慮して実行できるよう、人間のフィードバックからの文脈内学習(ICLHF)フレームワークを提案し、ベンチマークで有効性を示した。
- Navi2Gaze: 基盤モデルを活用したナビゲーションと対象物注視ナビゲーション2024/7/1
視覚言語モデル(VLM)を使い、タスク記述に基づいてロボットが対象物に対して適切な位置と向きを自動で選び、効率的に移動・注視する手法を提案した論文。
- Joint Inference of States, Robot Knowledge, and Human (False-)Beliefs2020/4/1