論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/ヒューマノイド/操作ロボティクス
ヒューマノイドVLAにおけるループの閉鎖:検証可能な移動操作のための持続的3Dオブジェクトトークン
RGB-D観測から役割インデックス付きの3Dオブジェクト記録を維持し、それをオブジェクトトークンとして行動生成と幾何学的述語チェックの両方に使用することで、検証可能な閉ループ実行を実現するPOT-VLAを提案。実機でベースラインを大幅に上回る成功率を達成。
原題: Closing the Loop in Humanoid VLA: Persistent 3D Object Tokens for Verifiable Loco-Manipulation / Peng Ren, Haoyang Ge, Jiang Zhao 他
日本語で読む → - 論文ヒューマノイド/バランス制御ロボティクス
物体質量を伴うヒューマノイドのバランス制御:トレードオフ解析と持ち上げ制御
物体の質量がヒューマノイドのバランス安定性に与える動的影響を厳密に解析し、バランス状態領域(BSB)を用いて物体質量とバランス能力のトレードオフを特徴付け、持ち上げ制御に応用した。
原題: Balancing of Humanoid with Object Mass: Trade-off Analyses and Lifting Control / Hyunjong Song, William Z. Peng, Joo H. Kim
日本語で読む → - 論文ヒューマノイドロボティクス
自然な人間対話を実現する受付ロボット用多関節ヒューマノイドヘッド
受付業務向けに、21自由度の表情・首機構とシリコン皮膚を備え、顔認識と大規模言語モデルを統合したヒューマノイドヘッドを開発し、人間らしさと感情表現を評価した。
原題: Articulated Humanoid Head for a Robot Receptionist Capable of Natural Human Interaction / Tharusha Fonseka, Charuka Bandara, Moshintha Hewavitharana 他
日本語で読む → - 論文ヒューマノイドデザインロボティクス
ヒューマノイドロボット設計における不気味の谷のベイズ的枠組み
ロボットの親和性を数理モデル化する階層ベイズ生成モデルを提案し、カテゴリ曖昧性や感覚間不一致が親和性低下を引き起こす仕組みをシミュレーションと人間実験で検証した。
原題: A Bayesian framework for the uncanny valley in humanoid robot design / Shimon Honda, Rin Shibano, Hideyoshi Yanagisawa
日本語で読む → - 論文ヒューマノイド/手話生成/リターゲティングロボティクス
手話生成から人型ロボット実行へ:衝突回避を伴う視覚言語ガイド付きリターゲティング
手話生成システムの出力を人型ロボットで実行可能な関節軌道に変換する枠組みを提案。自己交差を防ぐ衝突緩和モジュールと、視覚言語モデルによる失敗検出・修正を組み合わせた。
原題: From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation / Nabeela Khan, Bowen Wu, Runwu Shi 他
日本語で読む → - 論文ヒューマノイド/器用操作/再構成ロボットロボティクス
Handroid: 器用な手とヒューマノイドを橋渡しする再構成可能ロボット
27自由度の電動ボディを器用な手または卓上ヒューマノイドとして再構成できる小型ロボットを開発し、操作・移動・再構成を含む長期的タスクを実証した。
原題: Handroid: Bridging Dexterous Hand and Humanoid / Ruogu Li, Chenyang Ma, Sikai Li 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
Extreme-RGMT: 高ダイナミックスキルの継続学習による堅牢な汎用ヒューマノイド制御
汎用の動作追跡ポリシーと専門的な高ダイナミック動作の実行を両立させるため、継続学習フレームワークを提案し、難易度に基づくサンプリングと軌道再サンプリングで性能を向上させた。
原題: Extreme-RGMT: Continual Learning of Highly Dynamic Skills for Robust Generalist Humanoid Control / Yubiao Ma, Han Yu, Kai Guo 他
日本語で読む → - 論文ヒューマノイド/運動認識ロボティクス
自己組織化マップによるヒューマノイドロボットの運動プリミティブ発見と位相認識
ミラーニューロンシステムに着想を得て、NICOヒューマノイドロボットの腕と手の運動を自己組織化マップで学習し、エコー状態ネットワークで運動の位相をオンライン認識する2層アーキテクチャを提案した。
原題: Motion Primitive Discovery in a Humanoid Robot via Self-Organising Maps for Phase Recognition / Radovan Gregor, Igor Farkaš
日本語で読む → - 論文ヒューマノイド操作/VLA/強化学習ロボティクス
ROVE: 強化学習によるヒューマノイド操作のための人間介入の活用
不完全な人間介入データを用いてヒューマノイドVLAモデルを強化学習で訓練するフレームワークROVEを提案。楽観的価値推定とクロスエンボディ映像を活用し、高価値な行動を優先学習することで実世界の接触を伴う操作タスクで性能を向上させた。
原題: ROVE: Unlocking Human Interventions for Humanoid Manipulation via Reinforcement Learning / Wei Xiao, Weiliang Tang, Yuying Ge 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
EgoPriMo: 対話型ヒューマノイド制御のための自己中心視点動作生成
自己中心視点の人間デモから全身動作の事前分布を学習し、テキスト指示に基づいて動作の再構築・生成・予測を行う統一フレームワークを提案した。
原題: EgoPriMo: Egocentric Motion Generation for Interactive Humanoid Control / Haoyang Ge, Peng Ren, Yukun Shi 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
知覚行動基盤モデル:人間の動作プリエントをロボット中心の地形に適応させる
人間の動作データを基盤としたヒューマノイド制御モデルを、ロボットの周囲地形に適応させるフレームワークを提案。地形に合わせた参照動作を合成し、教師-学生学習で実ロボットに展開する。
原題: Perceptive Behavior Foundation Model: Adapting Human Motion Priors to Robot-Centric Terrain / Zifan Wang, Yizhao Li, Teli Ma 他
日本語で読む → - 論文ヒューマノイドロボット/ジェスチャ生成ロボティクス
WaveSync: ヒューマノイドロボットの同期した共話ジェスチャのための制約付き波面最適化
ヒューマノイドロボットが発話と同期した自然なジェスチャを生成するためのハイブリッドフレームワークを提案。LLMで意味的な重要度を推定し、動的運動プリミティブと波面最適化により、ハードウェアの制約を満たしつつジェスチャと音声の同期を実現する。
原題: WaveSync: Constrained Wavefront Optimization for Synchronized Co-Speech Gestures in Humanoid Robots / Thang Tran Viet, Thanh Nguyen Canh, Gia Huy Uong 他
日本語で読む → - 論文ヒューマノイド/シミュレーションロボティクス
SIMPLE: ヒューマノイドの移動操作のためのシミュレーションベースのポリシー学習と評価
ヒューマノイドの全身移動操作タスクを対象とした、大規模で再現可能な統一シミュレーションテストベッドを提案し、多様なタスクとデータ生成パイプラインを統合して、シミュレーションと実世界の性能相関を示した。
原題: SIMPLE: Simulation-Based Policy Learning and Evaluation for Humanoid Loco-manipulation / Songlin Wei, Zhenhao Ni, Jie Liu 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
RGB: RL誘導による全身MPPIヒューマノイド制御
事前学習済みの強化学習ポリシーをサンプリング事前分布として使い、MPPIのコストでタスク目的を指定する全身制御フレームワークを提案。再学習なしでタスク精度を向上させる。
原題: RGB: RL Guided Whole-Body MPPI for Humanoid Control / Yunsoo Seo, Sol Choi, Euncheol Im 他
日本語で読む → - 論文ヒューマノイド/リスク知覚ロボティクス
機械のリスク知覚に向けて:ヒューマノイドのための信頼キャリブレーションと前兆ベースのリスク推定の統合
ヒューマノイドロボットの事故を前兆情報から確率的にモデル化し、信頼度と連動させてリアルタイムにリスク適応行動を行う枠組みを提案した論文。
原題: Toward Machine Risk Perception: Integrating Trust Calibration and Precursor-Based Risk Estimation for Humanoid / He Wen
日本語で読む → - 論文ヒューマノイド/移動操作ロボティクス
MotionWAM: 実時間ヒューマノイド移動操作のための基盤ワールドアクションモデル
本論文は、ビデオワールドモデルの中間特徴を利用して、単一の行動空間で全身動作を予測する実時間ヒューマノイド移動操作モデルMotionWAMを提案し、実機で高い成功率を達成した。
原題: MotionWAM: Towards Foundation World Action Models for Real-Time Humanoid Loco-Manipulation / Jia Zheng, Teli Ma, Yudong Fan 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
FADA: ダイナミクス整合による少数ショット領域適応を用いたヒューマノイド制御
ヒューマノイド制御における領域間のダイナミクス不整合に対処するため、プランナーと逆動力学モデルを分離し、少数の実機データでIDMのみを微調整するフレームワークを提案した。
原題: FADA: Few-Shot Domain Adaptation via Dynamics Alignment for Humanoid Control / Angchen Xie, Nikhil Sobanbabu, Ishayu Shikhare 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
SceneBot: 接触プロンプトによる汎用ヒューマノイド全身追跡とシーンインタラクション
接触ラベルを条件として与えることで、自由空間動作と接触を伴う操作を単一のポリシーで統一的に扱うヒューマノイド全身追跡フレームワークを提案した。
原題: SceneBot: Contact-Prompted General Humanoid Whole Body Tracking with Scene-Interaction / Sirui Chen, Shibo Zhao, Zhen Wu 他
日本語で読む → - 論文ヒューマノイド歩行ロボティクス
TACT-ful:ペイロードに頑健な知覚ヒューマノイド歩行のためのマルチチャネル地形アフォーダンスとコンプライアンス訓練
単一の高さ情報では捉えられない地形特性を考慮するため、平坦性・急峻性・速度考慮の高さ可能性を組み合わせたマルチチャネル地形コストと前進登坂報酬を提案し、GPU並列DCM足場プランナと非対称アクタークリティック方策を深度画像からPPOで訓練する。また、仮想力を受ける下半身コンプライアンス訓練を導入し、力センサなしで負荷外乱に適応するヒューマノイド歩行を実現する。
原題: TACT-ful: Multi-Channel Terrain Affordance and Compliance Training for Payload-Robust Perceptive Humanoid Locomotion / Thanh Ly, Truong-Duy Dang, Chien Le 他
日本語で読む → - 論文ヒューマノイド/移動操作/sim2realロボティクス
OASIS: シミュレーションデータ収集から実世界のヒューマノイド移動操作へ
実世界の画像から3D生成モデルで物体アセットを自動構築し、シミュレーション内で遠隔操作によりデータを収集・拡張して、ヒューマノイドの移動操作ポリシーを訓練する枠組みを提案。実機ゼロショット展開で、多くのタスクで実機遠隔操作データによる訓練を上回る成功率を達成。
原題: OASIS: From Simulation Data Collection to Real-World Humanoid Loco-Manipulation / Zehao Yu, Jiakun Zheng, Weiji Xie 他
日本語で読む → - 論文ヒューマノイド動作生成ロボティクス
TEXEDO: コントローラを考慮した言語条件付きヒューマノイド動作生成のためのテスト時スケーリング
テキストから生成されたヒューマノイドの動作を、実行可能性と意味的整合性の両方を検証して選択するテスト時スケーリング手法を提案し、シミュレーションと実機で効果を実証した。
原題: TEXEDO : Test Time Scaling for Controller-aware Language-conditioned Humanoid Motion Generation / Jianuo Cao, Yuxin Chen, Yuzhen Song 他
日本語で読む → - 論文ヒューマノイド学習ロボティクス
TaskNPoint: 数分でヒューマノイドにバックハンドを教える方法
動的スキルは軌道の重要な一部分に依存するという構造的性質に基づき、人間のコーチが提供する少数のデモとインタラクションウィンドウを用いて、ヒューマノイドにテニスやサッカーなどの動的タスクを短時間で学習させるプロトコルを提案した。
原題: TaskNPoint: How to Teach Your Humanoid to Hit a Backhand in Minutes / Blake Werner, Ilona Demler, Pietro Perona 他
日本語で読む → - 論文ヒューマノイド/電力モデルロボティクス
Unitree G1ヒューマノイドアームの物理ベース電力消費モデルの同定
Unitree G1の左腕の電力消費を予測する物理ベースの線形モデルを提案し、実機データからパラメータを同定して高い精度で検証した。
原題: Identification of a Physics-Based Electrical Power Consumption Model for the Unitree G1 Humanoid Arm / Nestor N. Deniz, Sebastian Vega, Simon Parsons 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
ヒューマノイドの移動と操作のためのMPC誘導強化学習の高速化とスケーリング
MPCを強化学習の訓練時に報酬として活用するMPC-RLを提案し、並列GPUソルバーπ^nMPCを開発してヒューマノイドの移動・操作タスクで高性能を実証した。
原題: Accelerating and Scaling MPC-Guided Reinforcement Learning for Humanoid Locomotion and Manipulation / Junheng Li, Liang Wu, Sergio A. Esteban 他
日本語で読む → - 論文強化学習/ヒューマノイドロボティクス
批評家アーキテクチャの重要性:ヒューマノイドの移動操作における二重批評家と統一批評家の比較
ヒューマノイドロボットの移動と操作を統合する強化学習において、単一の統一批評家と分離した二重批評家のどちらが有効かをUnitree G1で比較し、二重批評家が学習効率と成功率で優れることを示した。
原題: Critic Architecture Matters: Dual vs. Unified Critics for Humanoid Loco-Manipulation / Mehmet Turan Yardımcı
日本語で読む → - 論文ヒューマノイド制御ロボティクス
VAIC: 視覚誘導によるヒューマノイドの俊敏な物体インタラクション制御 - 分離コマンドを用いて
ヒューマノイドロボットが、深度カメラと自己状態のみから、箱運びやスケートボードなどの多様な動的物体操作を単一のポリシーで実行できるようにする、教師-生徒蒸留に基づく制御フレームワークを提案した。
原題: VAIC: Vision-Guided Humanoid Agile Object Interaction Control via Decoupled Commands / Dongting Li, Qianyang Wu, Xingyu Chen 他
日本語で読む → - 論文ヒューマノイド操作ロボティクス
GenHOI: タスク固有の訓練なしに生成ビデオを模倣する接触を考慮したヒューマノイドと物体のインタラクション
生成ビデオを模倣することで、タスク固有の訓練や物理デモデータなしに、ヒューマノイドロボットが多様な物体操作タスクをゼロショットで実行できるフレームワークを提案した。
原題: GenHOI: Contact-Aware Humanoid-Object Interaction by Imitating Generated Videos without Task-Specific Training / Zhihai Bi, Qiang Zhang, Guoyang Zhao 他
日本語で読む → - 論文行動表現/ヒューマノイドロボティクス
PHASOR: ヒューマノイド身体のための位相固定型汎用行動表現
行動埋め込み空間を第一級の設計対象とし、動作の周期性を位相多様体と姿勢分岐に分解して、複数のヒューマノイドロボットに共有可能な解釈可能で身体非依存の行動表現を構築した。
原題: PHASOR: Phase-Anchored Universal Action Representations for Humanoid Embodiments / Kihyun Kim, Chaeyun Kim, Jongho Shin 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
HumanoidArena: 自己中心視点の階層的全身体学習のベンチマーク
ヒューマノイドロボットの階層的制御(高レベル方策と低レベル運動追跡器)の性能を評価する新しいシミュレーションベンチマークを提案し、脚部が重要な7つのタスクを設計して、方策と追跡器のインターフェースの実行可能性や頑健性を検証する。
原題: HumanoidArena: Benchmarking Egocentric Hierarchical Whole-body Learning / Taowen Wang, Zikang Xie, Bin Yang 他
日本語で読む → - 論文ヒューマノイド/移動操作/sim2realロボティクス
VLK: 再構築シーンでの合成インタラクションによるヒューマノイドの移動操作学習
3Dガウススプラッティングで再構築した屋内シーンで、視覚・言語・運動のペアデータを合成生成し、ヒューマノイドの移動操作ポリシーを学習する手法を提案。実機Unitree G1でナビゲーションと物体運搬を実証した。
原題: VLK: Learning Humanoid Loco-Manipulation from Synthetic Interactions in Reconstructed Scenes / Yen-Jen Wang, Jiaman Li, Sirui Chen 他
日本語で読む →