Yong Liu
Zhejiang University
収録論文 62本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RiverVLN: フェーズ接地型時間的視覚言語ナビゲーションによる無人水上艇の河川航行VLA2026/9/20
河川を航行する無人水上艇(USV)向けに、長期的な言語指示を視覚的に検証可能な意味フェーズ列に変換し、予測・実行・再観測ループで連続的なSE(2)姿勢増分を予測するナビゲーション手法PGT-NAVとベンチマークRiverVLNを提案した。
- RecMorph: トポロジー誘導型空間リカレンスによる汎用形態制御汎用形態制御/リカレントネットワーク2026/9/16
身体の運動木構造を深さ優先探索で系列化し、双方向リカレント計算で脚間通信と表現変換を同時に行う汎用形態制御ポリシーを提案。最大30脚の未見形態や四脚ロボット実機に汎化する。
- 見ることから行動へ:スマートグラスを一人称知能プラットフォームとして捉えるスマートグラス/一人称知能/サーベイ2026/8/25
スマートグラスを、人間の知覚・文脈・行動をつなぐ一人称知能プラットフォームとして体系的に調査し、ハードウェア能力軸や基盤能力、L0-L5フレームワークを提案したサーベイ論文。
- 多様な計画ポリシーの発見:品質多様性最適化によるマルチモーダル具現化エージェント計画/強化学習2026/8/9
マルチモーダル具現化エージェントのための多様な計画ポリシーを品質多様性最適化で発見し、行き詰まり時に別のポリシーへ切り替えることでタスク成功率を向上させる。
- WNM-3D: 3Dシーン条件付けによるクローズドループVLNのための世界ナビゲーションモデルVLA/ナビゲーション2026/8/7
連続的な視覚言語ナビゲーション(VLN)のための生成的世界行動モデルを提案し、3Dシーン表現を条件として将来の視覚と行動を同時生成することで、クローズドループのナビゲーション性能を向上させた。
- ワールドモデリングはどこへ向かうのか?世界モデル2026/8/1
エージェントの継続的改善のための世界モデルの概念を、物理状態遷移からエージェント中心の情報遷移へと拡張し、6つのプロキシ形式と3つの活用レベルを提案する。
- TS-Mask VLA: 視覚言語行動モデルのための2次元時空間マスキングと効果的なブリッジングVLA2026/7/1
本論文は、ロボット操作のための視覚言語行動(VLA)モデルを提案し、離散拡散アクションエキスパートと時空間2Dマスキング戦略を導入して、長期的で複雑なタスクにおける行動生成の精度と安定性を向上させる。
- 歩道ロボットのためのハイブリッド2D-3D学習による単眼3D占有知覚3D占有予測2026/6/1
歩道を走行するロボット向けに、LiDAR-RGBペアデータと大規模な非ペア単眼画像を組み合わせたハイブリッド学習で3D占有予測を行うフレームワークWalkOCCを提案し、新たな歩道データセットSidewalk3Dも導入した。
- SAGE-Nav: LLM計画とアライメント融合を活用した階層的シーングラフ誘導ナビゲーションナビゲーション2026/6/1
LLMによる大域計画と階層的シーングラフ符号化、目標認識アライメント融合ネットワークを組み合わせ、物体目標ナビゲーションの性能と汎化性を向上させた。
- VEOcc: 身体化シーン理解のためのボクセル中心オンライン意味占有予測3D占有予測2026/5/24
オンライン3D占有予測とマッピングのためのボクセル中心フレームワークを提案し、初期スケール推定を不要にすることで効率的な地図拡張を実現し、時間的・空間的にロバストな更新戦略を導入した。
- Pro-HOI: 知覚に基づくルート誘導型ヒューマノイド物体インタラクションロコマニピュレーション2026/3/1
ヒューマノイドロボットの物体運搬操作を、ルート軌道を条件としたポリシー学習とデジタルツインによる物体状態推定で実現する汎用フレームワークを提案した。
- RuN: 自然なヒューマノイド歩行のための残差ポリシー歩行2025/9/1
事前学習済みの動作生成器と残差強化学習を組み合わせ、歩行から走行まで滑らかに遷移する自然なヒューマノイド移動を実現した。
- 3D・4D世界モデリングのサーベイ世界モデル2025/9/1
RGB-D画像や占有グリッド、LiDAR点群といったネイティブな3D/4D表現を用いた世界モデリング研究を初めて体系的に整理し、定義・分類・データセット・評価指標をまとめたサーベイ。
- L2Calib: 退化運動に頑健な外部キャリブレーションのためのSE(3)多様体強化学習キャリブレーション2025/8/1
外部キャリブレーションを意思決定問題として定式化し、SE(3)上の強化学習で直接最適化することで、構造化ターゲットや十分な励振がない実運用データでも高精度にキャリブレーションできる手法を提案。
- CogDDN: 認知的需求駆動ナビゲーションと二重プロセス思考による意思決定最適化ナビゲーション2025/7/1
VLMを用いて人間の速い思考と遅い思考を模倣し、未知環境で暗黙の要求に応じて対象物体を探索・ナビゲートするフレームワークを提案。
- 四脚ロボットの全身マニピュレーションと移動を統合する効率的な方策学習マニピュレーション2025/7/1
マニピュレータの運動学モデルを強化学習に組み込み、四脚ロボットの全身移動・操作を統合した方策を効率的に学習する手法を提案し、実機で有効性を示した。
- Gaussian-LIC2: LiDAR・慣性・カメラ統合ガウシアンスプラッティングSLAMSLAM2025/7/1
LiDAR・慣性センサ・カメラを統合し、リアルタイムで高品質な3Dガウシアンマップを構築しながら自己位置推定を行うSLAMシステムを提案。LiDARが届かない領域は深度補完で補い、姿勢推定の頑健性も向上させた。
- LITE: 学習統合型トポロジカル探索による多階層屋内環境の探査探索2025/7/1
YOLO11による階層・階段のトポロジー構築と注意機構ベースの2D探索方策を組み合わせ、多階層屋内を効率的に探索するフレームワークを提案。
- KGN-Pro: 確率的2D-3D対応学習によるキーポイントベースの把持予測マニピュレーション2025/7/1
RGB-D画像から把持キーポイントを予測し、確率的PnP層で3D最適化をエンドツーエンドに組み込むことで、6自由度把持推定の精度と成功率を向上させた研究。
- 階層型探索に基づく協調動作計画群制御2024/10/1
非ホロノミックなアッカーマンモデルの無人地面車両群に対し、二値衝突探索木を用いた階層型のリーダーレス協調動作計画法を提案し、複数グループや障害物環境での有効性を実機検証した。
- 最大航続距離制約下でのマルチロボットタスク割り当てと経路計画群制御2024/9/1
ロボットの最大航続距離を考慮し、経路計画とオークションを統合したタスク割り当て手法を提案。障害物回避距離を反映し、遅延オークションで高速化を図り、実機実験で有効性を検証した。
- 適応的減衰時間表面と極性認識トラッキングを用いた単眼イベント慣性オドメトリイベントカメラ/オドメトリ2024/9/1
イベントカメラの非同期イベントから適応的減衰カーネルベースの時間表面でテクスチャを抽出し、極性反転表面を併用したトラッキングで運動方向変化に頑健な単眼イベント慣性オドメトリを実現した。
- DriveArena: 自動運転のための閉ループ生成シミュレーションプラットフォーム自動運転シミュレーション2024/8/1
生成モデルで実写のような画像を作り出し、交通シミュレータと組み合わせて自動運転エージェントを閉ループで評価できる高忠実度シミュレーションシステムを構築した。
- LiCROcc: LiDARとカメラでレーダーに正確な意味的占有予測を教える意味的占有予測2024/7/1
LiDARとカメラの融合特徴を蒸留することで、レーダー単独およびレーダー・カメラ設定での意味的シーン補完性能を大幅に向上させた研究。
- SARO: 視覚言語モデルによる3D地形を横断する空間認識ロボットシステム歩行2024/7/1
視覚言語モデルを高レベル推論に用い、タスク分解と閉ループ実行、強化学習による低レベル制御を組み合わせて、四足ロボットが3D地形を横断して目標地点に到達できるシステムを構築した。
- 継続的に学習・適応・改善する:自動運転のための二重プロセスアプローチ自動運転2024/5/1
人間の認知プロセスに着想を得て、注意選択と二重プロセス意思決定(分析的推論とヒューリスティック処理)を組み合わせ、反省機構と記憶バンクで自己改善する自動運転フレームワークLeapADを提案。CARLAでの閉ループ評価でカメラ入力のみの手法を上回り、ラベルデータも大幅に削減できることを示した。
- Gaussian-LIC: LiDAR・慣性・カメラ融合によるリアルタイム写実的SLAMSLAM2024/4/1
LiDAR・IMU・カメラを密に融合し、Gaussian Splattingを用いてリアルタイムに写実的な3Dマップを生成するSLAM手法を提案。LiDAR未観測領域は画像の三角測量点で補完し、天空や露出変化もモデル化する。
- Towards Knowledge-driven Autonomous Driving2023/12/1
- Coco-LIC: Continuous-Time Tightly-Coupled LiDAR-Inertial-Camera Odometry using Non-Uniform B-spline2023/9/1
- A Coarse-to-Fine Place Recognition Approach using Attention-guided Descriptors and Overlap Estimation2023/3/1
- Continuous-Time Fixed-Lag Smoothing for LiDAR-Inertial-Camera SLAM2023/2/1
- Adaptive Value Decomposition with Greedy Marginal Contribution Computation for Cooperative Multi-Agent Reinforcement Learning2023/2/1
- Efficient Trajectory Planning and Control for USV with Vessel Dynamics and Differential Flatness2022/9/1
- Cooperative trajectory planning algorithm of USV-UAV with hull dynamic constraints2022/9/1
- Rethinking Dimensionality Reduction in Grid-based 3D Object Detection2022/9/1
- Ctrl-VIO: Continuous-Time Visual-Inertial Odometry for Rolling Shutter Cameras2022/8/1
- DA$^2$ Dataset: Toward Dexterity-Aware Dual-Arm Grasping2022/8/1
- Observability-Aware Intrinsic and Extrinsic Calibration of LiDAR-IMU Systems2022/5/1
- Lightweight Object-level Topological Semantic Mapping and Long-term Global Localization based on Graph Matching2022/1/1
- CLINS: Continuous-Time Trajectory Estimation for LiDAR-Inertial System2021/9/1
- SSC: Semantic Scan Context for Large-Scale Place Recognition2021/7/1
- SA-LOAM: Semantic-aided LiDAR SLAM with Loop Closure2021/6/1
- FlowMOT: 3D Multi-Object Tracking by Scene Flow Association2020/12/1
- CL-MAPF: Multi-Agent Path Finding for Car-Like Robots with Kinematic and Spatiotemporal Constraints2020/11/1
- Moving Forward in Formation: A Decentralized Hierarchical Learning Approach to Multi-Agent Moving Together2020/11/1
- Semantic Graph Based Place Recognition for 3D Point Clouds2020/8/1
- LIC-Fusion 2.0: LiDAR-Inertial-Camera Odometry with Sliding-Window Plane-Feature Tracking2020/8/1
- Targetless Calibration of LiDAR-IMU System Based on Continuous-time Batch Estimation2020/7/1
- Visual-based Kinematics and Pose Estimation for Skid-Steering Robots2020/6/1
- Collision-free Trajectory Planning for Autonomous Surface Vehicle2020/5/1
- Efficient Robotic Task Generalization Using Deep Model Fusion Reinforcement Learning2019/12/1
- RoboCoDraw: Robotic Avatar Drawing with GAN-based Style Transfer and Time-efficient Path Optimization2019/12/1
- Visual-Inertial Localization for Skid-Steering Robots with Kinematic Constraints2019/11/1
- Pose Estimation for Ground Robots: On Manifold Representation, Integration, Re-Parameterization, and Optimization2019/9/1
- PASS3D: Precise and Accelerated Semantic Segmentation for 3D Point Cloud2019/9/1
- LIC-Fusion: LiDAR-Inertial-Camera Odometry2019/9/1
- Coverage Path Planning using Path Primitive Sampling and Primitive Coverage Graph for Visual Inspection2019/8/1
- Robust Visual SLAM with Point and Line Features2017/11/1
- Real-time 3D Human Tracking for Mobile Robots with Multisensors2017/3/1
- Parse Geometry from a Line: Monocular Depth Estimation with Partial Laser Observation2016/11/1
- RISAS: A Novel Rotation, Illumination, Scale Invariant Appearance and Shape Feature2016/3/1
- Place classification with a graph regularized deep neural network model2015/6/1