Jie Qin
収録論文 8本 ・ フィジカルAI/ロボット学習
身体性探索3Dシーン理解動画フォレンジックナビゲーションVLA空中ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 効果的かつ効率的な身体性探索のための能動的空间検査身体性探索2026/9/18
身体性探索において、空間的に明示的な検査に基づく知覚と移動を組み合わせたACEフレームワークを提案し、早期終了と過剰継続のトレードオフを緩和してナビゲーション成功率と探索効率を向上させた。
- GPOcc++: 視覚幾何学事前情報を用いた統合スパースガウス占有予測3Dシーン理解2026/7/15
視覚幾何学の事前情報を占有予測に適したスパースガウス表現に変換し、多視点・時系列を統一的に扱う3Dシーン理解手法GPOcc++を提案した。屋内・屋外のベンチマークで高い性能と効率性を示した。
- 長尺動画における改ざんセグメントの説明可能なフォレンジック解析動画フォレンジック2026/6/1
未編集の長尺動画に埋め込まれたAI生成セグメントを検出・位置特定し、その理由を説明する新しいタスクとベンチマーク、ベースライン手法を提案した論文。
- HTNav: 都市空中視覚言語ナビゲーションのための階層構造を持つハイブリッドナビゲーションフレームワークナビゲーション2026/4/1
都市環境での空中VLNタスクに対し、模倣学習と強化学習を組み合わせたハイブリッドフレームワークを提案し、段階的訓練と階層的意思決定によりナビゲーション精度とロバスト性を向上させた。
- DecoVLN: 観察・推論・修正を分離した視覚言語ナビゲーションVLA2026/3/1
長期的な指示に従う視覚言語ナビゲーションの性能を高めるため、記憶構築の最適化と誤差補正のための微調整戦略を導入したフレームワークを提案した。
- AgentVLN:エージェント型視覚言語ナビゲーションに向けてナビゲーション2026/3/1
視覚言語ナビゲーション(VLN)のための新しいフレームワークAgentVLNを提案。VLMを高次推論に用い、3Dトポロジカルウェイポイントを画像平面に投影して視覚プロンプトを生成し、自己補正と能動探索で長期的なナビゲーション誤差を抑制する。
- 履歴強化型二段階Transformerによる空中視覚言語ナビゲーション空中ナビゲーション2025/12/1
大規模都市環境でのUAVナビゲーションにおいて、粗い目標位置予測と細かい視覚分析を組み合わせた二段階Transformerと履歴グリッドマップを提案し、CityNavデータセットで性能を向上させた。
- RangeUDF: Semantic Surface Reconstruction from 3D Point Clouds2022/4/1