Qi Zheng
収録論文 7本 ・ フィジカルAI/ロボット学習
セマンティック占有予測ナビゲーションVLAマニピュレーションVIO初期化
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 屋内セマンティック占有予測における2Dバックボーンの影響調査セマンティック占有予測2026/9/15
屋内セマンティック占有予測において、2D画像バックボーンをCLIP-ResNet、CLIP-ViT、BLIP2、DINOv2に置き換え、DINOv2が最も高いmIoUを示すことを明らかにした。
- 一つのMLLM、一回の呼び出し:空間認識ウェイポイントによる効率的なゼロショット視覚言語ナビゲーションナビゲーション2026/9/6
連続環境での視覚言語ナビゲーション(VLN-CE)において、各意思決定ステップで単一の大規模モデルを一度だけ呼び出す効率的なゼロショットナビゲーションフレームワークO2C-Navを提案。訓練不要のウェイポイント生成器と抽象表現を用いてRGB画像上に候補ウェイポイントを可視化し、MLLMが選択した目標をFMMプランナーで衝突回避経路に変換する。
- AssemMate: グラフベースLLMによるロボット組立支援VLA2025/9/1
知識グラフを入力とするLLMで組立作業の対話支援と把持を実現し、従来比で高精度・高速・短コンテキストを達成した。
- データ効率の良い身体性マニピュレーションのための原子スキルライブラリ構築法マニピュレーション2025/1/1
VLPでタスクをサブタスクに分解し、原子スキルとして抽象化・VLA微調整することで、動的に拡張可能な原子スキルライブラリを構築し、データ効率と新タスク適応性を高める手法を提案。
- 確率的法線エピポーラ制約を用いた堅牢で効率的な視覚慣性初期化VIO初期化2024/10/1
視覚慣性オドメトリの初期化において、確率的法線エピポーラ制約を導入したジャイロバイアス推定と、IMU・視覚融合による速度・重力・スケール推定、さらに改良モジュールを組み合わせ、高速運動や退化シーンでも安定かつ高精度に初期化する手法を提案した。
- Pouring Dynamics Estimation Using Gated Recurrent Units2021/5/1
- Classifying States of Cooking Objects Using Convolutional Neural Network2021/5/1