Ruiqi Xian
収録論文 7本 ・ フィジカルAI/ロボット学習
3D占有予測3次元セマンティック補完ナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VISA: VLMによる3D占有ワールドモデルのインスタンス意味監査3D占有予測2026/6/11
3D占有予測の精度向上のため、VLMを用いて物体インスタンスの意味を監査し、その情報を学習時に蒸留する手法を提案。推論時はVLM不要で、閉集合のmIoUを改善した。
- GaussianSSC: トライプレーン誘導による方向性ガウス場を用いた3次元セマンティック補完3次元セマンティック補完2026/3/1
ボクセルグリッドとガウス表現を融合し、トライプレーン誘導の方向性ガウス場でセマンティックシーン補完の精度を向上させる2段階手法を提案。
- 物理的接地を伴う視覚言語モデルによる屋外ロボットナビゲーションナビゲーション2024/9/1
視覚言語モデルに固有受容感覚データを組み合わせて地形の変形性や滑りやすさを評価し、屋外での走行可能領域を動的に推定するナビゲーション手法を提案。脚式・車輪式ロボットで成功率を最大50%向上させた。
- FALCON: 未来予測と物体中心の文脈事前学習によるUAV行動認識VLA2024/9/1
UAV映像の行動認識に向け、物体検出を事前学習時のみに用いて背景の影響を抑え、物体中心の短期・長期未来再構成を組み合わせた自己教師あり学習手法を提案。
- LLM/VLM制御ロボティクスの脆弱性VLA2024/2/1
LLMやVLMで制御されるロボットが入力のわずかな変化に弱く、タスク成功率が最大22.2%低下することを実験で示した研究。
- AZTR: Aerial Video Action Recognition with Auto Zoom and Temporal Reasoning2023/3/1
- MITFAS: Mutual Information based Temporal Feature Alignment and Sampling for Aerial Video Action Recognition2023/3/1