Li Guo
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAsim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- G³VLA:視覚言語行動モデルのための幾何学的帰納バイアスVLA2026/6/1
カメラの較正情報を視覚トークンに注入する幾何学モジュールを提案し、既存のVLAモデルの性能を多様なベンチマークで向上させた。
- Wanderland:オープンワールド身体性AIのための幾何学的に接地したシミュレーションsim2real2025/11/1
実世界のマルチセンサーキャプチャから高精度な幾何学とフォトリアルな描画を両立する実→シミュレーション基盤を構築し、屋内・屋外都市シーンのデータセットを整備して、身体性ナビゲーションの再現可能な評価基盤を提供する。
- マルチモーダル融合と視覚言語モデル:ロボットビジョンのサーベイVLA2025/4/1
ロボットビジョンにおけるマルチモーダル融合手法と視覚言語モデルの応用をタスク指向で体系的にレビューし、課題と将来方向を整理したサーベイ。