Huaping Liu
収録論文 57本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SplineWAM: Bスプライン表現によるワールドアクションモデルの適応的行動ホライズンVLA2026/9/30
行動軌道を3次Bスプラインで圧縮し、動作の複雑さに応じて行動チャンクの時間解像度と長さを適応的に変えるワールドアクションモデルを提案。推論呼び出しを削減しつつ成功率を向上させた。
- ロボットのインコンテキスト学習:手法と応用VLA2026/9/28
ロボットのインコンテキスト学習(ICL)に関する文献レビューであり、文脈条件付き方策、幾何学的実演転移、世界モデルベース制御、スキル・エージェントベース実行の4つのインターフェースに分類し、転移の前提や評価手法を整理する。
- 状態行動を超えて:ロボット模倣学習における指令と状態の不一致の活用模倣学習2026/9/27
ロボットの模倣学習において、指令と実際の状態の不一致を重み付けに利用する手法CSDWを提案し、制約のある実機タスクで性能を向上させた。
- TimelyDAgger: VLAポリシー改善のためのタイミング考慮型エキスパートクエリVLA2026/9/27
VLAポリシーの内部特徴を監視し、エキスパートの介入タイミングを適応的に調整することで、限られた介入予算でポリシー改善を効率化する手法を提案。
- Xiaomi-Robotics-U0: 世界基盤モデルによる統合的身体性合成VLA2026/7/1
ロボットの身体性を考慮した画像・動画生成を統合する380億パラメータのマルチモーダル自己回帰モデルを提案し、マルチビュー一貫性やロボットの身体制約を保ちながら、シーン生成や転移、動画生成を高品質で実現した。
- DynFly: 都市環境におけるUAV視覚言語ナビゲーションのための動的認識連続軌道生成UAVナビゲーション2026/6/1
UAVの視覚言語ナビゲーションにおいて、高レベルの推論と実行可能な連続軌道の間のギャップを埋めるため、Bスプラインとフローマッチングを用いた動的認識軌道生成フレームワークDynFlyを提案した。
- 汎用ロボット操作のための身体化チェーン・オブ・ソートの再考VLA2026/6/1
大規模な身体化CoTデータセットを構築し、VLAモデルにおける効果的なCoTの形式と統合方法を検証。推論をテスト時に使わず表現整形の教師信号として用いるERVLAを提案し、高い汎化性能を達成した。
- MyoChallenge 2025: 人間の運動知能のための新しいベンチマーク運動制御2026/5/1
NeurIPS 2025で開催されたMyoChallengeは、高忠実度の筋骨格モデルと物理シミュレーションを用いて、卓球ラリーとサッカーペナルティキックの2つのタスクで運動制御の知能を競うベンチマークを確立した。
- 完全な筋肉の進化:筋骨格系移動のための効率的な形態-制御共設計筋骨格ロボット/共設計/進化計算2026/4/1
筋骨格ロボットの形態と制御を同時に最適化する手法を提案し、PCAと対称性を利用した低次元進化により、複雑な地形での移動性能を向上させた。
- 非同期ノイズ除去によるビデオ事前学習を活用した統合4D世界行動モデリングVLA/世界モデル2026/4/1
ロボットのリアルタイム行動実行と高忠実度な4D世界生成(ビデオ+3D再構成)を単一フレームワークで統合するX-WAMを提案し、非同期ノイズサンプリングにより行動効率と生成品質を両立した。
- EvoGymCM:連続的な材料剛性を活用したソフトロボットの共同設計ソフトロボティクス/共同設計2026/4/1
ソフトロボットの共同設計において、材料剛性を連続変数として扱う新しいベンチマークEvoGymCMを提案し、形態・材料・制御の同時最適化により性能向上を実証した。
- Diff-Muscle: 筋骨格ロボット卓球のための効率的学習筋骨格ロボット/強化学習2026/3/1
筋骨格ロボットの制御を、微分平坦性を用いて冗長な筋活性化空間から低次元の関節空間へ再定式化し、階層的強化学習により卓球ラリーを実現する手法を提案した。
- 次世代SLAMに向けて:性能・ロバスト性・将来展望に焦点を当てた3DGS-SLAMサーベイSLAM2026/2/1
3Dガウシアンスプラッティング(3DGS)とSLAMの統合に関する研究を、描画品質・追跡精度・再構築速度・メモリ消費の4軸で整理し、動的環境やモーションブラーへのロバスト性向上策と今後の課題をまとめたサーベイ。
- 階層的マニピュレーション政策のための世界モデルのスケーリングVLA2026/2/1
大規模事前学習済み世界モデルを高レベルプランナーとして用い、VLAを低レベル実行者とする階層的フレームワークを提案。未知物体や新規状況での汎化性能を大幅に向上させた。
- モノリシック基盤モデルを身体性マルチエージェントアーキテクチャへ変換し人間-ロボット協調を実現マルチエージェント/人間-ロボット協調2025/12/1
単一の基盤モデルを複数の専門エージェントに分解し、知覚・計画・検証・人間への委任を連携させるLLM駆動フレームワークInteractGenを提案。異種ロボットチームでの3ヶ月実証でタスク成功率と協調性の向上を示した。
- あらゆる外乱下であらゆる動作を追従するヒューマノイド動作トラッカーsim2real2025/9/1
二段階強化学習フレームワークAny2Trackを提案し、単一ポリシーで多様な動作を追従しつつ、地形・外力・物性変化などの外乱にオンライン適応して実機でゼロショットsim2realを実現した。
- CollabVLA: 人間と共に夢を見る自己内省型視覚-言語-行動モデルVLA2025/9/1
VLMによる内省的推論と拡散ベースの行動生成を専門家混合設計で統合し、不確実な状況では人間に助言を求める協調的な視覚-言語-行動エージェントを実現した。
- 予測可能で堅牢な制御のための軌道エントロピー強化学習強化学習2025/5/1
行動軌道全体のエントロピーを最小化する新たな帰納バイアスを導入し、変分予測モデルで推定することで、周期性が高くノイズや環境変化に強い方策を学習する手法を提案した。
- S2R-Bench: 自動運転のためのSim-to-Real評価ベンチマークsim2real2025/5/1
実世界の多様な道路・天候・照明条件で収集したセンサ異常データを用い、自動運転の知覚アルゴリズムのロバスト性を評価する初の実環境ベースの腐敗ロバスト性ベンチマークを提案した。
- FlowDreamer: フローベースの動作表現を用いたロボットマニピュレーションのためのRGB-Dワールドモデルワールドモデル2025/5/1
3Dシーンフローを明示的な動作表現として用い、U-Netと拡散モデルを組み合わせてロボット操作のためのRGB-Dワールドモデルを構築し、映像予測と視覚計画タスクで性能を向上させた。
- タスク指向飛行への道:フレームワーク・基盤・原則飛行制御/sim2real2025/4/1
クアッドロータのエンドツーエンド深層強化学習のためのタスク指向フレームワークを提案し、シミュレーションから実機への転移を可能にするソフト・ハード・ファームウェアの統合基盤と設計原則を示した。
- 汎用ロボットのための視覚言語行動モデル構築で重要な要素VLA2024/12/1
視覚言語行動モデル(VLA)の性能を左右する設計要因を大規模実験で分析し、汎用ロボット向けの新しいVLAファミリーRoboVLMsを提案した論文。
- MIPD: 身体性知能運転のためのマルチセンサー対話型知覚データセット自動運転/マルチモーダル知覚2024/11/1
カメラ・LiDAR・4Dレーダーに加え音・光・振動・車速も含むマルチモーダルデータセットMIPDを構築し、身体性知能運転の研究を支援する。
- 高速・相互作用誘起型空気圧発振器による多用途ソフトロボティクスソフトロボティクス2024/11/1
衝突による位相リセットを利用した空気圧自励発振器を開発し、外部アクチュエータなしで最大20Hzの高速動作を実現、昆虫型クローラや蝶型羽ばたき、アヒル型遊泳ロボットでその有用性を示した。
- 複数センサを用いた深層強化学習のためのマルチモーダル情報ボトルネック強化学習2024/10/1
自己中心画像と固有感覚からタスクに関連する統合表現を学習するマルチモーダル情報ボトルネックを提案し、サンプル効率とノイズに対するゼロショット頑健性を向上させた。
- AssistantX: LLMを活用した人間共存環境における能動的アシスタントVLA2024/9/1
4つのLLMエージェントからなるマルチエージェント構成で、人間がいる実環境で自律的に動作し、指示への反応や状況に応じた戦略調整、人間への能動的な支援要請を行うアシスタントを提案した。
- 見てから動く:ロボットマニピュレーションのための非同期能動視覚・行動モデルマニピュレーション2024/9/1
限られた視野や遮蔽に対処するため、カメラの次の最適視点(NBV)とグリッパの次の最適姿勢(NBP)を直列に繋ぎ、少数ショット強化学習で訓練する能動視覚・行動モデルを提案し、RLBenchの視点制約タスクで有効性を示した。
- 身体協調のための分散階層型移動制御器の学習群制御2024/7/1
複雑な全身協調タスクを階層的に分解し、時空間連続性を活用した分散制御戦略を学習させる手法を提案し、多数エージェントへの展開可能性を示した。
- 大規模言語モデルを活用した異種アドホックチームワーク協調群制御2024/6/1
能力の異なるロボットチームに後から加わったロボットが、LLMと新提案のIRoTを用いた訓練不要の階層的動的プランナで未知の仲間と協調し、片付けタスクのベンチマークと実機で有効性を示した論文。
- HumanTHOR: 共有作業空間における人間とロボットの協調のためのシミュレーションプラットフォームとベンチマーク人間ロボット協調2024/6/1
VRで人間がシミュレーション環境内で行動できる身体性フレームワークHumanTHORを構築し、日常タスクのベンチマークとユーザー研究を通じて人間とロボットの協調を評価した。
- 基盤モデルがマニピュレーションのロボット学習にもたらすもの:サーベイマニピュレーション2024/4/1
基盤モデルをロボットのマニピュレーション学習に統合するための包括的枠組みを提案し、各モジュールでの課題と貢献、今後の研究方向を整理したサーベイ。
- 入力遅延のない滑らかな計算:ロボットマニピュレータ計画のためのロバストチューブ型モデル予測制御マニピュレーション2024/3/1
モデル予測制御の計算遅延を、次状態を予測して1ステップ先に最適制御問題を解くことで解消し、線形化誤差の上限を設けて応答速度を最大90%向上させた。
- 競争を通じてロボットの潜在能力を引き出す群制御2024/3/1
競争環境での他者との比較を学習の補助信号として活用し、ロボットが競争から知識を得て潜在能力を最大限に発揮する競争学習フレームワークを提案。マルチエージェント競走環境での実験で、単一ロボット環境の最先端手法より優れた性能を示した。
- SInViG: A Self-Evolving Interactive Visual Agent for Human-Robot Interaction2024/2/1
- Vision-Language Foundation Models as Effective Robot Imitators2023/11/1
- Path Planning for Air-Ground Robot Considering Modal Switching Point Optimization2023/5/1
- Deep Reinforcement Learning for Robotic Pushing and Picking in Cluttered Environment2023/2/1
- Coupled Modeling and Fusion Control for a Multi-modal Deformable Land-air Robot2022/11/1
- Embodied Referring Expression for Manipulation Question Answering in Interactive Environment2022/10/1
- A Multi-modal Deformable Land-air Robot for Complex Environments2022/10/1
- Scene Graph for Embodied Exploration in Cluttered Scenario2022/7/1
- Intelligent Amphibious Ground-Aerial Vehicles: State of the Art Technology for Future Transportation2022/7/1
- Hybrid Robotic Grasping with a Soft Multimodal Gripper and a Deep Multistage Learning Scheme2022/2/1
- Sim2Real Object-Centric Keypoint Detection and Description2022/2/1
- Self-supervised 3D Semantic Representation Learning for Vision-and-Language Navigation2022/1/1
- Audio-Visual Grounding Referring Expression for Robotic Manipulation2021/9/1
- Knowledge-based Embodied Question Answering2021/9/1
- A Robust Tube-Based Smooth-MPC for Robot Manipulator Planning2021/3/1
- Adversarial Skill Learning for Robust Manipulation2020/11/1
- Fault-Aware Robust Control via Adversarial Reinforcement Learning2020/11/1
- Towards Embodied Scene Description2020/4/1
- MQA: Answering the Question via Robotic Manipulation2020/3/1
- Fabric Defect Detection Using Vision-Based Tactile Sensor2020/3/1
- Reinforcement Learning from Imperfect Demonstrations under Soft Expert Guidance2019/11/1
- Imitation Learning from Observations by Minimizing Inverse Dynamics Disagreement2019/10/1
- Learning and Inferring Movement with Deep Generative Model2018/5/1
- Task Transfer by Preference-Based Cost Learning2018/5/1