論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/24 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
ActGaze: 反事実的視覚介入による行動に基づく注視学習で高精度マニピュレーションを実現
VLAモデルの視覚的注意をタスクに関連する領域に集中させるため、反事実的視覚介入によって行動予測に重要な領域を特定し、注視を学習させる手法を提案。実機実験で高精度マニピュレーションタスクにおいて既存手法を上回る性能を示した。
原題: ActGaze: Learning Action-Grounded Gaze through Counterfactual Visual Interventions for High-Precision Manipulation / Jinxuan Zhu, Jiaheng Wang, Chao Tang 他
日本語で読む → - 論文マニピュレーションロボティクス
CAMP: 制約空間における協調的なアーム・ハンド動作計画
アームとハンドの協調動作を必要とする制約環境でのマニピュレーションに向け、ハンド探索とアーム緩和を組み合わせた高成功率な動作計画手法CAMPを提案した。
原題: CAMP: Cooperative Arm-Hand Motion Planning in Constrained Spaces / Ziyuan Wang, Yunlong Shan, Fei Mo 他
日本語で読む → - 論文マニピュレーションロボティクス
シミュレータ非依存の布操作のための簡易グリッパインタフェース
グリッパの姿勢・開閉状態・把持領域だけを用い、接触や摩擦を考慮せずに位置制約で布を把持・操作できるモデルを提案し、シミュレータと実機の両方で布折りたたみを実現した。
原題: A Simple Gripper Interface for Simulator-Agnostic Cloth Manipulation / Abhilash Nayak, Franco Coltraro, Maria Alberich-Carramiñana 他
日本語で読む → - 論文ロボティクス/信念修復ロボティクス
AquaMend: 身体性エージェントの潜在信念故障に対する最小再プロービングと条件付きロールバック
物理変化やセンシング誤りでエージェントの信念が崩れた際に、再プロービング・ロールバック・継続支援を確率的に選択する手法を提案し、シミュレーションで再起動より損失を21.6%削減した。
原題: AquaMend: Minimal Re-probing and Conditional Rollback for Latent-Belief Failures in Embodied Agents / Yufan Liu, Shang Luo, Yang Liu 他
日本語で読む → - 論文ナビゲーションロボティクス
UCON: 動的環境における不確実性を考慮した履歴再関連付けナビゲーション
動的環境での知覚不安定性と不確実性最適化の不一致に対処するため、点群の履歴再関連付けとカルマンフィルタによる不確実性セクターを軌道最適化に組み込んだナビゲーション手法を提案。
原題: UCON: Uncertainty-aware Navigation with Historical Re-association in Dynamic Environments / Bing Sun, Yue Lin, Yongsheng Yuan 他
日本語で読む → - 論文モデルベース強化学習ロボティクス
表現世界モデル:表現空間における状態・遷移・実行可能計画の学習
潜在表現空間内で直接的に状態・遷移・計画を学習し、再帰的ロールアウトや行動空間探索なしに計画を実行する手法を提案。連続制御とロボットマニピュレーションで有効性を示す。
原題: Representation World Model: Learning States, Transition and Executable Plans in Representation / Yijun Yuan, Weicheng Zheng, Weibang Wang 他
日本語で読む → - 論文自律掘削ロボティクス
目標選択から掘削まで:連続自律掘削のための学習ベースフレームワーク
LiDAR地形認識による目標選択と強化学習・模倣学習を組み合わせ、連続的な自律掘削を実現するフレームワークを提案し、実機実験で有効性を示した。
原題: From Target Selection to Digging: A Learning-Based Framework for Continuous Autonomous Excavation / Shuai Zhao, Ji-an Pan, Quantao Yang 他
日本語で読む → - 論文安全評価ロボティクス
自動運転車の安全参照モデルのための回避と制動の反応を組み合わせる
人間の運転者の制動と回避操舵を統合したファジィ安全モデルを提案し、高臨界カットインシナリオで評価した。
原題: Combining Evasive and Braking Reactions for Safety Reference Models in Automated Vehicles / Riccardo Donà, Konstantinos Mattas, Biagio Ciuffo
日本語で読む → - 論文視覚ナビゲーションロボティクス
遠隔カメラからの学習ベース視覚ナビゲーション
遠隔監視カメラの映像から自己中心的な深度を予測し、地図なしで衝突回避しながらロボットをナビゲートする手法を提案。
原題: ReVNM: Learning-Based Visual Navigation from a Remote Camera / Michikuni Eguchi, Kohei Honda, Masafumi Endo 他
日本語で読む → - 論文能動的支援ロボティクス
自ら動くロボット:能動的ロボットの構築と評価のためのフレームワーク
ロボットの能動的支援を統一形式化し、3段階に整理。最高レベルの自発的支援に対応するフレームワークを提案し、閉ループ評価の重要性を示す。提案手法GAPは受動的観察からユーザー目標を予測し行動する。
原題: Robots That Take Initiative: A Framework for Building and Evaluating Proactive Robots / Maithili Patel, Sonia Chernova
日本語で読む → - 論文モデリングロボティクス
産業用ロボットのサイクロイド減速機における負荷・速度・温度依存の伝達誤差のフーリエ級数モデリング
産業用ロボットのサイクロイド減速機に生じる周期的な伝達誤差を、負荷トルク・速度・温度の多項式関数で振幅と位相を表すフーリエ級数でモデル化し、平均二乗誤差0.026 mradで予測できることを示した。
原題: Modeling Load-, Velocity-, and Temperature-Dependent Transmission Errors of Cycloidal Drives for Industrial Robots Using Fourier Series / Christian J. E. Bauer, Valentin Kamm, Marcel Dzubba 他
日本語で読む → - 論文ヘビ型ロボットロボティクス
高密度関節と関節再配置可能なヘビ型ロボットによる障害物援用移動
関節密度が高いヘビ型ロボットが障害物環境で停滞せず、低消費電力で安定して推進できることを実験的に示した。
原題: Dense-Joint-Based Obstacle-Aided Locomotion with a Joint-Repositionable Snake Robot / Kyosuke Minomo, Ryo Takahashi, Kotaro Yasui 他
日本語で読む → - 論文タスクプランニングロボティクス
LLMチェイニングによる汎用サービスロボットのタスクプランニングの設計と評価
LLMを命令分類と行動生成の2段階に分けるチェイニング構成で、プロンプト長を約45%削減しつつタスクプランニングの一貫性を向上させ、実機HSRで評価した。
原題: Design and Evaluation of LLM Chaining-Based Task Planning for General Purpose Service Robots / Lucas Da Mota Bruno, Jiahao Sim, Yoshinobu Hagiwara
日本語で読む → - 論文ベンチマークロボティクス
RoboRecover: 実行逸脱下におけるロボット方策の回復力ベンチマーク
実行中の逸脱状態から元のタスクを回復する能力を評価するベンチマークを提案し、初期状態の性能が回復性能を決めないことを示した。
原題: RoboRecover: Benchmarking Robot Policy Recovery under Execution Deviations / Yang Li, Chen Zhao, Zhuoran Wang 他
日本語で読む → - 論文モデルベース制御/ワールドモデルAI
行動識別型ワールドモデルによる反事実モデル予測制御
計画時に候補行動を区別できるよう、逆動力学と行動復元正則化を組み込んだワールドモデルAD-WMを提案し、MPCの成功率と実機ゼロショット転移を改善した。
原題: AD-WM: Action-Discriminative World Models for Counterfactual Model Predictive Control / Jiabin Qiu, Zixuan Chen, Hongye Cao 他
日本語で読む → - 論文4D人体動作復元画像認識
Ego-Exo4D人体メッシュデータセット:一人称・多視点映像からの4D人体動作復元
一人称視点と多視点の同期映像データセットEgo-Exo4Dに対し、密な4D人体動作復元データセットと復元パイプラインを構築・公開した。
原題: Ego-Exo4D Human Meshes Dataset: 4D Human Motion Reconstruction for Ego-Exo Captures / Abhiram Maddukuri, Georgios Pavlakos
日本語で読む → - 論文VLA画像認識
行動表現の方向・スケール分解:VLAモデルで何をトークン化すべきかの再考
VLAモデルの行動トークン化において、並進・回転の増分を方向とスケールに分解するDSD表現を提案し、シミュレーションと実機で成功率の向上を実証した。
原題: Direction-Scale Decomposition in Action Representation: Rethinking What to Tokenize for Vision-Language-Action Models / Yufei Duan, Hang Yin, Alberta Longhini 他
日本語で読む → - 論文VLAAI
PUBG Ally:音声対話型の具現化AIチームメイト
PUBG: BATTLEGROUNDSでプレイヤーと音声でやり取りしながら自律的に行動するAIチームメイトを構築し、約3.9万セッションの実プレイデータで訓練・評価した研究。
原題: PUBG Ally: A Conversational Embodied Agent as an AI Teammate / Beomsoo Kim, Byeongju Kim, Dohyun Kim 他
日本語で読む → - 論文VLAロボティクス
World Action Agent:視覚的アクション空間でのロボット操作を可能にするVLM活用フレームワーク
VLMをマルチエージェント構成でロボット操作に活用し、接触ビュー・アクションリハーサル・ビュー内補正を組み合わせた視覚的アクション作業空間を提案。LIBERO-Proで75.6%の成功率を達成。
原題: World Action Agent: Harnessing VLMs for Robot Manipulation via World Action Rehearsal / Yehang Zhang, Haojian Huang, Yifan Chang 他
日本語で読む → - 論文視覚サーボロボティクス
透視4直線・5直線問題の特異点解析
4本および5本の直線を観測する画像ベース視覚サーボと姿勢推定において、カメラと直線の相対配置が制御・安定性に問題を生じる特異点を計算代数幾何学を用いて解析した。
原題: Singularity Analysis for the Perspective-Four and Five-Line Problems / Jorge García Fontán, Abhilash Nayak, Sébastien Briot 他
日本語で読む → - 論文安全フィルタ/異形態学習ロボティクス
CrossSafe: 異形態ロボット間で汎用化する潜在安全フィルタ
ロボットの形態情報を条件とした潜在空間でのハミルトン・ヤコビ到達可能性解析により、異なる機体間で安全制約を共有できる安全フィルタを提案した。
原題: CrossSafe: Towards Cross-Embodiment Latent Safety Filters / Ihab Tabbara, Yuxuan Yang, Hussein Sibai
日本語で読む → - 論文システム同定制御
ホバリング中のオクトコプターのシステム同定:全高調波直交マルチサイン入力を用いて
全高調波直交マルチサイン信号を飛行制御系に注入する新しい飛行機動設計法を提案し、小型オクトコプターのホバリング付近での飛行試験で有効性を実証した。
原題: System Identification of an Octocopter in Hover using Full-Harmonic Orthogonal Multisine Inputs / Justin J. Matt, George V. Altamirano
日本語で読む → - 論文ソフトロボティクス/強化学習ロボティクス
腱駆動型ロボットクラゲ:拘束型ソフトアクチュエーションと強化学習による深度制御
柔軟基板に離散的な拘束を組み合わせた腱駆動アクチュエータでロボットクラゲを構築し、強化学習によりシミュレーションと実機の両方で深度制御を実現した。
原題: A Tendon-Driven Robotic Jellyfish with Constrained Soft Actuation and Depth Control via Reinforcement Learning / Jiarui Peng, Yutong Wu, Zelong Wang 他
日本語で読む → - 論文VLAロボティクス
Rolling-WAM: 転がる想像による世界行動モデル
ロボット操作のための世界行動モデルにおいて、映像と行動のノイズ除去を再計画サイクルごとに分割して行うことで、計算遅延を抑えつつ4.5倍の再計画高速化を実現した手法。
原題: Rolling-WAM: World Action Models with Rolling Imagination / Yinghua Zhou, Junjie Ye, Yiqi Zhao 他
日本語で読む → - 論文模倣学習ロボティクス
ロボット模倣学習のための固有感覚と能動的行動に基づく指先センシングの自己教師ありアンカリング
指先の触覚・近接センサを固有感覚と行動に自己教師ありで対応付け、接触前後の情報を活用して模倣学習の成功率を高める手法を提案。
原題: Self-Supervised Anchoring of Fingertip Sensing to Proprioception and Proactive Actions for Robot Imitation Learning / Tomohiro Motoda, Masaki Murooka, Keisuke Shirai 他
日本語で読む → - 論文マニピュレーションロボティクス
CALM: 電流整合型リンクマニピュレーションによる単腕での大型物体持ち上げ
モータ電流を関節負荷フィードバックとして活用し、前腕や肘を含む腕全体で大型物体を持ち上げる長期的接触操作をシミュレーションで学習し、実機へ転移するフレームワークを提案した。
原題: CALM: Current Aligned Link Manipulation for Single Arm Oversized Object Lifting / Jun Hu, Sihan Chen, Kosta Jovanovic 他
日本語で読む → - 論文ロコマニピュレーションロボティクス
接触を決定変数とする:脚式ロコマニピュレーションのための能力トレードオフ接触選択
脚式ロボットのロコマニピュレーションにおいて、環境との接触面と全身姿勢を同時に選択する問題を定式化し、能力トレードオフを考慮した効率的な接触選択手法CTCSを提案した。
原題: Contact as a Decision Variable: Capability-Tradeoff Contact Selection for Legged Loco-Manipulation / Al Jaber Mahmud, Shuai Li, Xuan Wang
日本語で読む → - 論文マニピュレーションロボティクス
全手把持のためのリアルタイム力制御フレームワーク
触覚センサなしで手全体の接触を幾何学的に推定し、摩擦制約やアクチュエータ限界を考慮して接触力をリアルタイムに再計算することで、外乱下でも把持を維持・再把持できる制御系を実現した。
原題: Real-Time Force Regulation for Whole-Hand Dexterous Grasping / Sang Min Kim, Alexander Alexiev, Tzu-Yuan Lin 他
日本語で読む → - 論文マニピュレーションロボティクス
身体状態に基づく再計画による物理適応型マニピュレーション
関節負荷や可動域制限などの内部身体状態をLLMで解釈し、実行中にマニピュレーション戦略を再計画する枠組みを提案。シミュレーションと実機で、成功率を保ちつつ身体的負担を軽減できることを示した。
原題: Body-Grounded Replanning for Physically Adaptive Manipulation / Namiko Saito, Hiroshi Kera
日本語で読む → - 論文sim2realロボティクス
X2Real:実世界汎用ポリシー評価のための拡張可能なシミュレーションベンチマーク
実機との相関0.84を達成したIsaac Labベースの進化型シミュレーションベンチマークで、10能力次元・44タスクにより汎用マニピュレーションポリシーを忠実・多様・公平に評価する。
原題: X2Real: an eXtensive simulation benchmark for real-world generalist policies / Lian Ruan, Jade Yang, Sherphylan Gao 他
日本語で読む →