Qijun Chen
収録論文 29本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- NavJev: 行動中心の視覚圧縮と識別的行動意味記憶による効率的な視覚言語ナビゲーションVLA2026/9/28
MLLMの逐次推論をやめ、候補行動を圧縮表現に変換して軽量な確率的行動選択を行うことで、視覚言語ナビゲーションの推論遅延を大幅に削減したフレームワーク。
- Touvigation:未知の屋内環境における視覚障害者のための身体適応型物体取得支援視覚障害者支援/身体性AI2026/9/18
視覚障害者が未知の屋内で物を探して手に取るのを支援するハンズフリーシステムを提案し、視覚言語理解と持続的な局所空間モデルを組み合わせて身体相対の低遅延ガイダンスを実現、12名の参加者実験で成功率100%を達成した。
- DPed-VLN:動的歩行者環境における社会的規範に沿った視覚言語ナビゲーションのベンチマークVLA2026/9/18
歩行者が動く環境での視覚言語ナビゲーションを評価するHabitat 3.0ベンチマークを構築し、歩行者を考慮した強化学習・模倣学習ポリシーDPetを提案した。
- GaussianSeed: 高解像度3D占有予測のための階層的ガウスシーディング3D占有予測2026/7/22
高解像度の3D占有予測を効率的に行うため、粗密の階層構造を持つガウスプリミティブを用いたフレームワークを提案し、0.1m解像度でリアルタイム推論を実現した。
- 具現化視覚言語ナビゲーションの包括的サーベイと体系的実世界評価ナビゲーション2026/7/1
視覚と言語によるナビゲーション(VLN)の研究を体系的に分類し、物理ロボットでの実世界評価を行った。シミュレーションと実世界の性能差を明らかにし、階層的フレームワークの堅牢性を示した。
- 動力学は教えられるものではなく学習されるもの:潜在動力学幾何の半教師あり発見によるゼロショット方針適応強化学習/適応2026/6/1
ロボット強化学習において、環境の動力学変化に頑健に適応するため、物理パラメータを明示せずに相互作用の結果から潜在空間の幾何構造を学習する手法を提案し、MuJoCoベンチマークで既存手法を上回る性能を示した。
- KinematicRL: 運動学的実現可能性を備えた社会的ナビゲーションのためのシミュレーションから実世界への強化学習フレームワークナビゲーション2026/6/1
この論文は、社会的ナビゲーションのための強化学習フレームワークを提案し、高次制御入力と2D LiDARのみを用いた人間追跡により、シミュレーションと実世界のギャップを低減して動的に実現可能なナビゲーションポリシーを生成する。
- P2DNav: パノラマから俯瞰への推論によるゼロショット視覚言語ナビゲーションナビゲーション2026/5/19
ゼロショットの視覚言語ナビゲーションにおいて、パノラマ方向選択と俯瞰ローカル接地を分離した階層的フレームワークを提案し、性能を向上させた。
- 動的知識空間による自動運転の非交絡生涯学習自動運転2026/3/1
自動運転の生涯学習における破滅的忘却や因果交絡を解決するため、ディリクレ過程混合モデルと因果推論のフロントドア調整を統合したフレームワークを提案した。
- DST-Calib: 二重経路・自己教師あり・ターゲット不要のLiDAR-カメラ外部キャリブレーションネットワークキャリブレーション2026/1/1
LiDARとカメラの外部キャリブレーションを、専用ターゲットや高精度正解ラベルなしでオンライン実行できる自己教師ありネットワークを提案。両側データ拡張と差分マップ構築により、汎化性能と精度を向上させた。
- CLASH: 連続的視覚言語ナビゲーションのための大規模・小規模協調階層フレームワークVLA2025/12/1
視覚言語ナビゲーションにおいて、小規模モデルと大規模モデルを不確実性に基づき協調させ、シミュレーションと実環境で最先端性能を達成した。
- 力発揮型ヒューマノイドの移動操作のための運動学を考慮したマルチポリシー強化学習移動操作2025/11/1
上半身・下半身・差分コマンドの3段階に分けた強化学習で、ヒューマノイドが移動しながら環境に力を加える操作を可能にした研究。
- 視覚言語ナビゲーションにおける身体性ギャップの再考:物理的・視覚的格差の包括的研究VLA2025/7/1
人型・四足・車輪ロボットに対応した物理的に現実的なVLN評価プラットフォームVLN-PEを提案し、既存のVLN手法が実機環境で性能劣化する要因を体系的に分析した。
- テキスト駆動の動作生成をNAOロボットで実現する強化学習最適化制御パイプラインヒューマノイド2025/6/1
テキストから人間の動作を生成し、関節角度ネットワークと強化学習による全身制御でNAOヒューマノイドに転移させる手法を提案した。
- DCPI-Depth: 教師なし単眼深度推定に密な対応関係の事前情報を明示的に注入深度推定2024/5/1
単眼動画からの教師なし深度推定において、密な対応関係から得られる幾何学的制約を明示的に活用する3つの新規損失と双方向ストリーム調整戦略を提案し、弱テクスチャや動物体領域での精度を向上させた。
- クロスモーダルマスクマッチングによるオンライン・ターゲットフリーLiDARカメラ外部キャリブレーションキャリブレーション2024/4/1
大規模視覚モデルを活用したクロスモーダルマスクマッチングにより、ターゲット不要でオンラインにLiDARとカメラの外部パラメータを高精度に推定する手法を提案し、屋内・屋外データセットで有効性を示した。
- 視覚基盤モデルの強みをステレオマッチングに活かすステレオマッチング2024/4/1
視覚基盤モデル(VFM)をステレオマッチングに適応させるViTASアダプタを提案し、KITTI Stereo 2012で最高性能を達成した研究。
- LIX: 自動運転向け視覚的セマンティックセグメンテーションに空間幾何学的事前知識を暗黙的に注入する手法自動運転セグメンテーション2024/3/1
データ融合型教師ネットワークが持つ空間幾何学的事前知識を、単一モーダルの生徒ネットワークに知識蒸留で暗黙的に注入するLIXフレームワークを提案し、ロジット蒸留と特徴蒸留の両面で新手法を導入して性能を向上させた。
- S$^3$M-Net: Joint Learning of Semantic Segmentation and Stereo Matching for Autonomous Driving2024/1/1
- Three-Filters-to-Normal+: Revisiting Discontinuity Discrimination in Depth-to-Normal Translation2023/12/1
- Adaptive Denoising-Enhanced LiDAR Odometry for Degeneration Resilience in Diverse Terrains2023/9/1
- RoadFormer: Duplex Transformer for RGB-Normal Semantic Road Scene Parsing2023/9/1
- Dive Deeper into Rectifying Homography for Stereo Camera Online Self-Calibration2023/9/1
- E3CM: Epipolar-Constrained Cascade Correspondence Matching2023/8/1
- Freespace Optical Flow Modeling for Automated Driving2023/7/1
- D2NT: A High-Performing Depth-to-Normal Translator2023/4/1
- UDTIRI: An Online Open-Source Intelligent Road Inspection Benchmark Suite2023/4/1
- Multiple Thinking Achieving Meta-Ability Decoupling for Object Navigation2023/2/1
- Search for or Navigate to? Dual Adaptive Thinking for Object Navigation2022/8/1