Hao Liu
Delta Intelligence
収録論文 32本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SEED-UMI: 人間とロボットで外骨格を共有する一対一の器用なデモンストレーションマニピュレーション2026/9/10
人間とロボットが同じ外骨格を装着し、関節エンコーダと手首カメラの計測を共有することで、接触の多いタスクの模倣学習を効率化するフレームワークを提案。
- 時間周波数幾何クロスアテンションによるチャンク型視覚言語行動モデルの改善VLA2026/9/9
行動チャンクを学習可能なウェーブレット変換で時間周波数トークンに分解し、内積とウェッジ積を融合したクロスアテンションで位相間の直交的な関係を捉える、VLAポリシー向けの追加モジュールを提案。
- 周波数条件付きフローマッチングによる視覚-言語-行動モデルVLA2026/9/9
VLAモデルの行動生成をDCT周波数座標で行い、周波数ごとに条件付け・重み付けするFreqFMを提案。LIBERO等で性能向上と実機6タスクでの有効性を示した。
- 適応的規定時間CBFを用いたマルチロボットネットワークの時空間再接続群制御2026/6/1
マルチロボットシステムにおいて、一時的な通信切断と再接続を規定時間内に保証する適応的制御バリア関数フレームワークを提案し、タスク効率を向上させる。
- テレコムワールドモデル:6Gのためのデジタルツイン、基盤モデル、予測計画の統合ネットワーク制御2026/4/1
6Gネットワーク向けに、言語ベースのLLMと物理ベースのデジタルツインの限界を克服するため、学習・行動条件付き・不確実性を考慮したテレコムシステムダイナミクスのモデル化を実現する「テレコムワールドモデル」というアーキテクチャを提案した論文。
- TAG: 物体中心推論のためのターゲット非依存ガイダンスによるVLAポリシーの安定化VLA2026/3/1
VLAポリシーが散らかった環境で誤った物体や位置を掴む問題を、物体を消した観察との差分を利用した推論時ガイダンスで改善する手法を提案。
- 再照明可能な3Dガウシアンスプラッティングによる森林でのゼロショットUAVナビゲーションUAVナビゲーション2026/2/1
実世界データに基づくシミュレーションで、照明を編集可能な3Dガウシアンスプラッティングを用いて強化学習を行い、森林環境で最大10m/sのゼロショット自律飛行を実現した。
- DM0: フィジカルAIに向けた身体性ネイティブな視覚-言語-行動モデルVLA2026/2/1
身体性を後付けでなく最初から統合し、大規模事前学習からフローマッチング行動専門家と空間Chain-of-Thoughtで操作とナビゲーションを統一的に学習するVLAフレームワークDM0を提案。
- RADAR: 実世界ダイナミクス・空間物理知能・自律評価による視覚言語行動モデルの汎化ベンチマークVLA2026/2/1
VLAモデルの実世界汎化を評価するため、物理ダイナミクス・空間推論タスク・3D指標による完全自律評価を統合したベンチマークRADARを提案し、既存モデルを監査した。
- フレキシブル製造のための身体性知能:サーベイ身体性知能/製造2026/2/1
フレキシブル製造における身体性知能の研究を、知覚(Industrial Eye)、制御(Industrial Hand)、意思決定(Industrial Brain)の3視点から整理し、認知強化・技能移行・システム進化からなる3段階の発展モデルを提案したサーベイ。
- イチゴ収穫ロボットの視覚ベース早期故障診断と自己回復農業ロボティクス2026/1/1
イチゴ収穫ロボットの把持ミスや滑りを視覚で早期に検出し、自己回復するフレームワークを提案。把持位置ずれを補正し、空掴みや滑りを予測して収穫を中断・再試行する。
- 視覚言語行動モデルのための安定した言語ガイダンスVLA2026/1/1
VLAモデルが言語の言い回しの変化に弱い「モダリティ崩壊」を解決するため、意味意図と視覚的アフォーダンスを分離する確率的フレームワークRSSを提案し、敵対的な言語摂動下でも頑健な操作性能を実現した。
- E0: Tweedie離散拡散によるVLAモデルの汎化性と細粒度制御の向上VLA2025/11/1
量子化された行動トークン上でTweedie離散拡散を行うVLAフレームワークE0を提案し、視点摂動拡張と合わせて多様な環境での汎化と細かい制御を実現した。
- UAVによる風車ブレード自動検査:停止角度推定とブレード詳細優先露出調整UAV検査2025/7/1
風車ブレードのUAV自動検査のため、フェルマ点に基づく停止角度推定と、撮影時にブレード詳細を優先する露出調整手法を提案し、実証実験で有効性を示した。
- パノラマLiDARカメラ融合を用いた地上ロボットによる複雑環境の意味的探索と高密度マッピング意味的探索・マッピング2025/5/1
LiDARとパノラマカメラを搭載した地上ロボットが、未知の複雑環境を多視点で意味的に観察しながら効率的に探索し、対象物の高密度な意味マップを構築するシステムを提案した。
- 深層強化学習による自動駐車軌道生成自動運転2025/4/1
SACアルゴリズムを用いた深層強化学習フレームワークで自動駐車タスクを最適化し、従来手法より高い成功率と短い操作時間を実現した。
- 複数制約下でのアリコロニーアルゴリズムを用いた物流ロボットの経路計画最適化経路計画2025/4/1
時間窓やタスク順序、動作の滑らかさといった複数の制約を考慮し、アリコロニー最適化アルゴリズムで物流車両の経路計画を最適化する手法を提案した。
- DynamicRouteGPT: 大規模言語モデルに基づくリアルタイム多車両動的ナビゲーションフレームワークナビゲーション2024/8/1
静的Dijkstraで大域的最適経路を求め、交差点での局所判断をLlama3 8Bと因果推論で行う動的経路計画手法を提案。
- 深層学習による無人水上艇の外部パラメータ推定キャリブレーション2024/6/1
無人水上艇の動的なメタセンター変化を予測し、時系列GRNNを用いてセンサの外部パラメータをリアルタイムで補正する手法を提案した。
- TD3とDWAを融合した衝突回避型ロボットナビゲーションナビゲーション2024/5/1
深層強化学習TD3でDWAのサンプリング間隔を最適化し、静的・動的障害物を回避する経路計画手法を提案・検証した論文。
- 深層強化学習に基づく無人車両の適応的速度計画ナビゲーション2024/4/1
障害物接近時の頻繁な減速を抑えるため、DQNとDDQNを用いて障害物に適応しつつ最適な速度計画を維持する局所ナビゲーションシステムを開発した。
- パーティクルフィルタによるニューラルネット推定単眼カメラ姿勢の高精度化自己位置推定2024/4/1
CNNによる単眼カメラの姿勢推定にパーティクルフィルタを組み合わせ、SE(3)上の一様分布を伝播させることで、特に並進成分の精度と軌道の滑らかさを改善した。
- 移動ロボットの経路計画のための深層強化学習経路計画2024/4/1
深層強化学習と双方向探索ハイブリッドA*を組み合わせ、移動ロボットの経路計画を低計算コストで高精度に実現する手法を提案した。
- GarchingSim: An Autonomous Driving Simulator with Photorealistic Scenes and Minimalist Workflow2024/1/1
- The Power of the Senses: Generalizable Manipulation from Vision and Touch through Masked Multimodal Learning2023/11/1
- Guide Your Agent with Adaptive Multimodal Rewards2023/9/1
- An Image Based Visual Servo Method for Probe-and-Drogue Autonomous Aerial Refueling2023/5/1
- Instruction-Following Agents with Multimodal Transformer2022/10/1
- Masked World Models for Visual Control2022/6/1
- URLB: Unsupervised Reinforcement Learning Benchmark2021/10/1
- Multi-modal Trajectory Prediction for Autonomous Driving with Semantic Map and Dynamic Graph Attention Network2021/3/1
- Deep Learning for 3D Point Clouds: A Survey2019/12/1