Weili Guan
収録論文 8本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SpaceEra++: ビデオにおける3次元空間推論のための統合フレームワーク空間推論2026/7/2
本論文は、ビデオから3次元空間推論を行うための統合フレームワークSpaceEra++を提案する。フレーム選択戦略と空間整合手法を導入し、空間理解の精度を向上させた。
- RoboSpatialチャレンジ技術報告:選択的推論活性化と参照フレーム曖昧性解消による身体化空間推論空間推論2026/6/30
CVPR 2026のRoboSpatialチャレンジで1位を獲得した、ロボットの空間推論を強化する推論時プロンプト手法を提案した論文。
- 具現化AIのための効率的視覚ポインティング:エージェント駆動データ合成、クロスブロック注意、反復補正視覚ポインティング2026/6/29
言語指示からピクセル座標を推定する視覚ポインティングの精度向上を目指し、データ合成とモデル改良を組み合わせてPointArena 2026で77.2%の精度を達成した。
- OmniEgo-R^2: CVPR 2026 EgoCrossチャレンジのためのルーティング推論フレームワークVLA2026/5/23
手術、産業、エクストリームスポーツ、動物視点など複数領域の自己中心視点動画推論を扱うEgoCrossチャレンジで、時間的証拠の正規化や領域非依存の能力ルーティング等を備えた統合推論パイプラインOmniEgo-R^2を提案し、2位を獲得した。
- EnergyAction: エネルギーに基づくモデルによる片腕から両腕への動作合成両腕操作/エネルギーに基づくモデル/ポリシー転移2026/3/1
本論文では、片腕操作ポリシーをエネルギーに基づくモデルとして表現し、その合成特性を利用して両腕操作タスクへ転移するフレームワークを提案する。時間的・空間的な協調メカニズムと適応的ノイズ除去戦略を導入し、高品質な両腕動作を効率的に生成する。
- ConLA: 人間動画からの対照的潜在行動学習によるロボットマニピュレーションVLA2026/2/1
人間の動画からロボットの行動を教師なしで学習する際、対照学習で動きと見た目を分離し、実ロボット軌道での事前学習を上回る性能を実現した。
- UAV-ON: 空中エージェントによるオープンワールド物体目標ナビゲーションのベンチマークナビゲーション2025/8/1
空中エージェントが高レベルな意味的目標に基づいて大規模オープンワールド環境で物体を探索・ナビゲートするためのベンチマークUAV-ONを提案し、複数のベースライン手法を評価した。
- 少数ショット視覚言語行動インクリメンタル方策学習VLA2025/4/1
少数の実演から新しい操作タスクを継続的に学習するため、タスク固有プロンプトとタスク関係グラフによる進化戦略を組み合わせたTOPICを提案した論文。