Piji Li
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA/操作UAVナビゲーションVLAナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GIFT: 目標注入型ファインチューニングによる効率的な操作ポリシー適応VLA/操作2026/9/7
生成モデルで予測した目標画像を事前学習済みVLAモデルに軽量に組み込むファインチューニング手法GIFTを提案し、少数エポックで性能を大幅に向上させた。
- AirAlign: ジオメトリを考慮したUAV最終メートル航法のための相対ポーズ整列UAVナビゲーション2026/8/22
UAVの最終接近段階での正確なポーズ整列を実現するため、事前学習済みの視覚幾何再構成モデルを用いてRGB画像ペアから相対ポーズを推定するフレームワークを提案した。
- ViSMoE: 身体化された指示表現グラウンディングのための視覚認識スパース混合エキスパートVLA2026/8/22
エージェントが自然言語指示に基づいて遠隔の物体を特定するタスクにおいて、視覚情報の種類に応じて専門化したスパース混合エキスパートを用いることで、ビューと物体の識別表現を改善し、既存手法を上回る性能を達成した。
- AgentVLN:エージェント型視覚言語ナビゲーションに向けてナビゲーション2026/3/1
視覚言語ナビゲーション(VLN)のための新しいフレームワークAgentVLNを提案。VLMを高次推論に用い、3Dトポロジカルウェイポイントを画像平面に投影して視覚プロンプトを生成し、自己補正と能動探索で長期的なナビゲーション誤差を抑制する。