Jiaheng Hu
収録論文 23本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SimEX: シミュレーション統合型ロボティクス自動研究フレームワークsim2real2026/9/30
LLMコーディングエージェントがシミュレーション内で試行錯誤してロボットツールボックスを構築し、少数の実機試行でシミュレータを校正しながら実ロボットの操作スキルを効率的に獲得する自動研究フレームワーク。
- ロボットポリシー編成における重要要素:階層型VLAエージェントの体系的研究VLA/階層制御2026/6/9
階層型VLAシステムの設計原則を体系的に研究し、プランナーとコントローラの選択や接続方法などが性能に与える影響を分析。導出した原則に基づくシステムが、フラットなVLAや素朴な階層構造より優れることをシミュレーションと実機で示した。
- シンプルな手法で十分:VLAモデルは強化学習による自然な継続学習者であるVLA2026/3/1
大規模事前学習済みVLAモデルの継続強化学習を体系的に検証し、LoRAを用いた単純な逐次ファインチューニングが破滅的忘却をほとんど起こさず、複雑な継続学習手法を上回ることを示した。
- 因子分解型潜在行動ワールドモデルワールドモデル2026/2/18
動画から潜在行動を学習する際、シーンを複数の独立因子に分解し、各因子が独自の潜在行動を推論・予測するフレームワークFLAMを提案。複数エンティティが同時に動く複雑な環境での予測精度と表現品質を向上させ、下流の政策学習を容易にする。
- ノイズを含むセンサ入力からヒューマノイドサッカーロボットの俊敏なキック技能を学習強化学習2025/12/1
ノイズの多いセンサ入力下でも、ヒューマノイドロボットが連続してボールを蹴り、多様な配置でゴールを決められる強化学習システムを開発した。
- マッシュ、スプレッド、スライス!視覚的空間進捗による物体状態操作の学習マニピュレーション2025/9/1
物体の位置を変えずに物理的・視覚的状態が進行する操作(マッシュ、スプレッド、スライスなど)を統一フレームワークSPARTAで学習し、実機で高精度・高速訓練を実現した。
- RoboSSM: 状態空間モデルによるスケーラブルな文脈内模倣学習模倣学習2025/9/1
Transformerの代わりに状態空間モデル(Longhorn)を用いた文脈内模倣学習手法を提案し、長い文脈のプロンプトでも効率的に推論できることを示した。
- L3M+P:大規模言語モデルを用いた生涯プランニングタスクプランニング2025/8/1
知識グラフを世界状態の表現として用い、LLMと古典的プランナを組み合わせて、家庭用ロボットが長期運用で環境の動的記憶を維持しつつ自然言語タスクを計画できるフレームワークを提案。
- SLAC: 教師なしシミュレーション事前学習による安全で効率的な実機ロボット強化学習sim2real2025/6/1
低忠実度シミュレータでタスク非依存の潜在行動空間を事前学習し、実機でのオフポリシー強化学習を安全かつ高効率化する手法を提案。双腕移動マニピュレーションで1時間以内に全身接触タスクを学習。
- 見ることを学ぶ:方策分解による意思決定のための情報探索マニピュレーション2024/10/1
ロボットが操作に必要な情報を能動的に探し出す「情報探索方策」と、得た情報を使って操作を行う「情報受容方策」に分解して別々に学習する手法DISaMを提案し、実機を含む5つの操作タスクで有効性を示した。
- SkiLD: 因子間相互作用に導かれた教師なしスキル発見教師なし強化学習2024/10/1
状態を因子に分解し、因子間の多様な相互作用を引き起こすスキルを教師なしで学習する手法を提案。家庭環境ロボットなど長期的な疎報酬タスクで既存手法を上回る。
- 効率的な階層強化学習のための分離された教師なしスキル発見階層強化学習2024/10/1
教師なしで分離されたスキルを学習し、階層強化学習で効率的に再利用する手法DUSDiを提案。
- FLaRe: 大規模強化学習ファインチューニングによる熟達した適応型ロボットポリシーVLA2024/9/1
事前学習済みロボットポリシーを大規模強化学習でファインチューニングし、未見環境での長期的移動操作タスクの成功率を大幅に向上させ、新しい身体や行動への迅速な適応を実現した。
- ロボティクスにおける深層強化学習:実世界での成功に関するサーベイ強化学習2024/8/1
深層強化学習をロボットに応用した実世界での成功事例を調査し、成功要因や未開拓領域、今後の研究方向を整理したサーベイ論文。
- TeleMoMa: モバイルマニピュレーションのためのモジュール式で汎用的な遠隔操作システム遠隔操作2024/3/1
RGB-DカメラやVRコントローラなど複数の入力インターフェースを統合し、移動マニピュレータの全身遠隔操作を可能にするモジュール式システムを開発。模倣学習用の実演データ収集を容易にし、その有効性を実機とシミュレーションで示した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- Mini-BEHAVIOR: A Procedurally Generated Benchmark for Long-horizon Decision-Making in Embodied AI2023/10/1
- ELDEN: Exploration via Local Dependencies2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Causal Policy Gradient for Whole-Body Mobile Manipulation2023/5/1
- Teleoperated Robot Grasping in Virtual Reality Spaces2023/1/1
- Guided Deep Reinforcement Learning for Articulated Swimming Robots2023/1/1
- GLSO: Grammar-guided Latent Space Optimization for Sample-efficient Robot Design Automation2022/9/1