論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文動作生成/拡散モデル/MPPIロボティクス
GRACE: 勾配不要のロボット動作生成 - 拡散モデルとMPPIの後方平均推定の統合
拡散ポリシーをMPPI制御で誘導し、微分不可能な安全制約を扱える勾配不要の動作生成手法GRACEを提案。シミュレーションと実機で成功率向上を確認。
原題: GRACE: Gradient-Free Robot Action Generation via Combined Diffusion-MPPI Posterior Mean Estimation / Leesai Park, Jiho HOng, Sanghyun Kim
日本語で読む → - 論文移動操作ロボティクス
RLMM-Flow: 潜在空間強化学習を用いたフローベース移動操作フレームワーク
移動操作ロボットの全身動作生成を、専門家デモからのフローポリシー事前学習と潜在空間での強化学習後調整を組み合わせて改善するフレームワークを提案した。
原題: RLMM-Flow: A Flow-based Mobile Manipulation Framework with Latent-Space Reinforcement Learning / Shuhang Wang, Ziming Li, Hui Cheng
日本語で読む → - 論文継続的RL/自律レースロボティクス
自律レースにおける継続的RLによる汎化:RoboRacerプラットフォームでの検証
実世界データのみを用いて、継続的バックプロパゲーションに基づく継続的RLフレームワークを提案し、複数のトラックで汎用的なポリシーを訓練した後、15分以内の微調整で古典的制御器を上回る性能を達成した。
原題: Continual-RL for Generalization in Autonomous Racing on the RoboRacer Platform / Joel Siegert, Edoardo Ghignone, Michele Magno
日本語で読む → - 論文VPR/生涯学習ロボティクス
SLAM:忘却耐性と領域ロバストな生涯VPRのための構造化・局所化解析多様体適応
生涯視覚場所認識(VPR)における解析的クラス増分学習(ACIL)の領域シフト脆弱性を解決するため、不変多様体とスタイル分離によるドメイン整合、およびEKFとの同型性に基づく制御理論的枠組みSLAMを提案し、非定常データセットで性能を向上させた。
原題: SLAM: Structured and Localized Analytic Manifold Adaptation for Forgetting-Immune and Domain-Robust Lifelong VPR / Kenta Tsukahara, Kanji Tanaka, Rai Hisada
日本語で読む → - 論文世界モデル画像認識
マスク視覚アクションによる統一世界モデリング
ロボットの行動をビデオのピクセル空間で表現する新しいインターフェースを導入し、少量のデータで学習したモデルが将来予測や逆モデリングを実現する。
原題: Masked Visual Actions for Unified World Modeling / Hadi Alzayer, Wenlong Huang, Haonan Chen 他
日本語で読む → - 論文VLA/ロバスト性ロボティクス
両刃の剣としての推論:視覚-言語-行動モデルにおけるアーキテクチャと段階横断的ロバスト性
推論ステップを追加するとVLAモデルのロバスト性が向上するかを、3つのモデル(推論なし、テキストCoT、潜在反復ループ)で比較し、潜在反復モデルが最も脆弱であることを示した。また、推論出力を安全信号として利用する防御手法の限界も明らかにした。
原題: Reasoning as a Double-Edged Sword: Architecture and Cross-Stage Robustness in Vision-Language-Action Models / Tuan Duong Trinh, Naveed Akhtar, Basim Azam
日本語で読む → - 論文VLAロボティクス
パッチポリシー:高密度視覚表現による効率的な身体制御
Vision Transformerの事前学習済みパッチ特徴を直接利用する軽量なロボットポリシーを提案し、グローバル表現や大規模VLAを凌ぐ性能を達成した。
原題: Patch Policy: Efficient Embodied Control via Dense Visual Representations / Gaoyue Zhou, Zichen Jeff Cui, Ada Langford 他
日本語で読む → - 論文協調運転制御
インテグリティ・ゲート型エコCACC:信号交差点における協調運転のための認識論的許容性
協調運転システムがセンサ異常や認識の不整合で誤動作しないよう、内部モデルと外部センシングの整合性を監視し、信頼度に応じてエコ運転と安全優先のフォールバックを切り替える枠組みを提案した。
原題: Integrity-Gated Eco-CACC: Epistemic Admissibility for Cooperative Driving at Signalized Intersections / Lyes Saad Saoud, Moussa Ayyash
日本語で読む → - 論文制御統合制御
強化学習と最適制御を架橋する実行可能行動マッピング
強化学習の行動を最適制御問題の実行可能なパラメータ集合に写像するアルゴリズムを提案し、制約を厳密に満たしつつ柔軟な制御を実現する。ロボット卓球のリアルタイム動作計画で有効性を示した。
原題: Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping / Stefan Richter, Alberto Giammarino, Guillem Torrente 他
日本語で読む → - 論文物体検出ロボティクス
LiDAR物体検出のための入力解像度スケーリングの探索
LiDAR点群を用いた3D物体検出において、実行時間と精度のトレードオフを動的に調整するため、単一のDNNモデルで入力解像度を可変にする手法と、デッドラインを考慮したスケジューラを提案した。
原題: On Exploring Input Resolution Scaling For Anytime LiDAR Object Detection / Ahmet Soyyigit, Shuochao Yao, Heechul Yun
日本語で読む → - 論文自動運転AI
逆走の解明:エンドツーエンド自動運転モデルにおける解釈可能性の活用
自動運転のエンドツーエンドモデルに教師なし辞書学習を組み込み、運転行動を意味概念に分解して因果影響を分析し、概念介入で誤動作を修正して性能を向上させる手法を提案した。
原題: Driving the Wrong Way: Leveraging Interpretability in End2End Autonomous Driving Models / Franz Motzkus, Sebastian Bernhard
日本語で読む → - 論文VLA/タスク計画ロボティクス
エージェント統括型視覚言語行動スキル合成における意味的ハンドオフ失敗の診断
長期的な家庭タスクでスキル間の境界が不明確なために生じる失敗を、BEHAVIOR-1K環境で分析し、スキル単体の性能と合成時の頑健性を分離評価する手法を提案した。
原題: Diagnosing Semantic Handoff Failures in Agent-Orchestrated Vision-Language-Action Skill Composition / Ke Rui, Yushen Zuo, Jiawei Wang 他
日本語で読む → - 論文HRIロボティクス
公共空間3箇所で運用した人型ロボットヘッドの受容性に関するケーススタディ
感情表現を伴う多言語対話が可能な人型ロボットヘッドを3つの公共空間で数日間運用し、TAM2アンケートで受容性を評価。観光案内所や図書館では好意的に受け入れられたが、役所では対話意欲が低く、応答速度の遅さが課題と判明した。
原題: A Case Study on the Acceptance of a Humanoid Robotic Head Employed in Three Public Spaces / Marcel Heisler, Luca Randecker, Christian Becker-Asano
日本語で読む → - 論文マニピュレーションロボティクス
先見的残差強化学習による視覚言語行動モデルを用いた長期的ロボット操作
凍結したVLAベースポリシー上で残差RLを行う際、各サブタスクの成功報酬に将来の成功確率を掛け合わせることで、サブタスク間の受け渡し品質を最適化し、長期的なタスク成功率を向上させる手法を提案した。
原題: Foresight Residual RL for Long-Horizon Robot Manipulation with Vision-Language-Action Models / Yuhan Liu, Xinyu Zhang, Litao Liu 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
博物館に戻る:感情シミュレーションの有無によるアンドロイドAndreaの受容調査
ドイツの博物館でアンドロイドロボットAndreaを6日間公開し、感情シミュレーションの有無が来館者の受容に与える影響をアンケートで調査した。感情シミュレーションは主観評価に有意な効果をもたらさなかった。
原題: Back to the museum: Investigation of the acceptance of Android Andrea with and without emotion simulation in a museum / Marcel Heisler, Christian Becker-Asano
日本語で読む → - 論文VLA評価画像認識
HumanCLAW: 視覚言語モデルは身体を通して行動できるか?
視覚言語モデル(VLM)の身体を使った行動能力を評価するフレームワークを提案し、41の屋内シーンで1,218エピソードのベンチマークを構築。最先端のVLMでも成功率は最大16.8%にとどまり、物体認識ではなく身体の自己認識が欠如していることが課題と判明。
原題: HumanCLAW: Can Vision-Language Models Act Through a Body? / Li Siyao, Jiawei Gu, Shuai Liu 他
日本語で読む → - 論文自動運転ロボティクス
PrismAD: 意味的Mixture-of-Plannersによる分離型計画法を用いたエンドツーエンド自動運転
自動運転の計画タスクを、相互作用・幾何・意図の3つの専門家に分離し、意味的ルーターで適応的に統合するフレームワークを提案した。
原題: PrismAD: Decoupled Planning via Semantic Mixture-of-Planners for End-to-End Autonomous Driving / Kang Ding, Zhigui Lin, Hongsong Wang 他
日本語で読む → - 論文物理的HRI/計画ロボティクス
キャッチ、スロー、リピート:人間とロボットのパートナージャグリングのための計画
人間とロボットが協力してボールを投げ合うジャグリングを実現するための、リアルタイムの計画・制御アーキテクチャを提案した。予測トラッキングと軌道最適化を統合し、初心者から熟練者までの被験者で3ボールカスケードを達成した。
原題: Catch, Throw, Repeat: Planning for Human-Robot Partner Juggling / Jonathan Rainer Lippert, Kai Ploeger, Abir Chowdhury 他
日本語で読む → - 論文科学エージェントAI
ロボット化学実験室における大規模言語モデルエージェントのストレステスト
ロボット化学実験室を物理世界のテストベッドとして使い、大規模言語モデルエージェントの科学的エージェンシーを測定可能にした研究。実験の実行可能性と証拠に基づく再計画の能力を評価した。
原題: Stress-testing large language model agents in a robotic chemistry laboratory / Lulu Guo, Yingkai Sun, Xiaobo Li 他
日本語で読む → - 論文歩行ロボティクス
深層強化学習による動的粘性環境下での蛇型ロボットの適応的うねり移動
深層強化学習を用いて、動的に変化する粘性環境で蛇型ロボットが適応的に移動する方法を提案。教師ポリシーから生徒ポリシーへの知識蒸留により、センサ情報のみで環境変化に対応する非正弦波の適応歩容を獲得した。
原題: Adaptive Undulatory Locomotion of Snake-like Robots in Dynamic Viscous Environments via Deep Reinforcement Learning / Tsuyoshi Kimoto, Akio Yamano, Kohei Honda 他
日本語で読む → - 論文経路計画/制御ロボティクス
クラスタリング組み込みモデル予測経路積分制御:平均化による失敗の回避と動的障害物に対する効率的なクラスタ選択の実現
標準的なMPPI制御が障害物前で平均化により失敗する問題を解決するため、DBSCANクラスタリングと衝突由来の幾何学的特徴を用いて軌道モードを分離し、最適なクラスタを選択するCE-MPPIを提案した。
原題: Clustering-Embedded Model Predictive Path Integral Control: Avoiding Averaging-Induced Failure and Enabling Efficient Cluster Selection for Dynamic Obstacles / Zidong Liu, Kaixin Chang, Xu Chen
日本語で読む → - 論文群制御ロボティクス
匿名通信下のロボット群におけるクォーラムセンシングの確率的フィルタリング
ロボット群のクォーラムセンシングにおいて、匿名通信による二重計数バイアスを補正する確率的フィルタリング手法を提案し、ベースラインやランダム化手法と比較して精度と安定性のトレードオフを評価した。
原題: Stochastic Filtering for Quorum Sensing in Robot Swarms under Anonymous Communication / Fabio Oddi, Andreagiovanni Reina, Vito Trianni
日本語で読む → - 論文UAVナビゲーションロボティクス
RASR: 距離認識スケール復元によるメートル単位UAVナビゲーション
GNSSが使えない環境での画像ゴールUAVナビゲーションにおいて、距離と方位を正確に推定するため、グローバルスケール較正に距離依存の残差補正を加えるRASRを提案した。
原題: RASR: Range-Aware Scale Recovery for Metric UAV Navigation / Hongtao Liang, Xinyu Shao, Chenxu Wang 他
日本語で読む → - 論文運動計画ロボティクス
運動計画のための関数空間拡散
軌道を連続関数として扱い、関数空間で拡散を行うことで、解像度に依存しない運動計画を実現する手法を提案した。
原題: Function-Space Diffusion for Motion Planning / Zinuo Chang, Yipu Chen, Byoungwoo Park 他
日本語で読む → - 論文歩行生成/拡散モデル/パーソナライズロボティクス
被験者条件付き拡散モデルによる歩行速度横断的な下肢運動学の個人化生成
単一の歩行速度での計測データから、未見の速度における個人化された下肢関節軌道を生成する被験者条件付き残差拡散フレームワークを提案した。健常者データのみで訓練し、脳卒中患者にも適用可能なことを示した。
原題: Generating Personalized Lower-Limb Kinematics Across Walking Speeds Using Subject-Conditioned Diffusion / Diya Dinesh, Adrian Krieger, Changseob Song 他
日本語で読む → - 論文VLAロボティクス
言葉は長く語る:言語によるロボットポリシー合成のガイド
この論文では、ロボットのポリシー獲得を対話的なプログラム合成タスクとして扱うフレームワーク「ARCHITECT」を提案し、人間の自然言語による修正をコードに反映し、再利用可能なスキルライブラリを構築することで、長期的なタスクでの性能向上と人間の介入削減を実現しています。
原題: A Few Words Go a Long Way: Language Guided Robot Policy Synthesis / Daphne Chen, Archit Ritesh Jain, Eric Goossen 他
日本語で読む → - 論文VLAロボティクス
「やる」前に「動く」を学ぶ:タスク非依存事前学習によるVLAモデルの効率化
VLAモデルのデータ不足問題を解決するため、言語ラベル不要の自己教師あり逆動力学で運動プリエントを事前学習し、少量の専門家データで言語接地する2段階フレームワークTAPを提案。SIMPLERベンチマークで100万軌道の教師あり学習と同等性能を達成し、実機でも頑健性が向上した。
原題: Learning to Move Before Learning to Do: Task-Agnostic pretraining for VLAs / Junhao Shi, Siyin Wang, Xiaopeng Yu 他
日本語で読む → - 論文マニピュレーションロボティクス
ConceptTree: ロボット操作のブラックボックス意思決定に意味的透明性をもたらす
ロボット操作の高レベルスキル選択を、人間が解釈可能な概念に基づく決定木で表現し、透明性と介入可能性を実現するフレームワークを提案した。実世界の複雑な長期的タスクで既存手法より優れた性能を示し、個々の概念の修正による細かい介入も可能にした。
原題: ConceptTree: Bringing Semantic Transparency to Black-Box Decision Making for Robotic Manipulation / Yongyan Wen, Feifan Liu, Jinyi Chen 他
日本語で読む → - 論文ナビゲーションロボティクス
未構造環境向け能力認識型トラバーサビリティナビゲーション
ロボットの身体性(能力)を考慮した走行可能性推定フレームワークCATを提案し、地形のセマンティックマップにロボット固有の走行可能性ベクトルを埋め込むことで、異なる形態のロボットでの安全性を向上させた。
原題: Towards Capability-Aware Traversability Navigation for Unstructured Environments / Gianluca Capezzuto, Felipe Tommaselli, Matheus P. Angarola 他
日本語で読む → - 論文データ選択/模倣学習/VLAロボティクス
SIEVE: VLAモデルを用いた模倣学習のための構造認識データ選択
ロボットのデモデータから再利用可能なプリミティブと遷移構造を抽出し、構造的な被覆率を最大化するようにデータを選択することで、少ないデータと学習ステップで高性能なVLAポリシーを学習する手法を提案した。
原題: SIEVE: Structure-Aware Data Selection for Imitation Learning with VLA Models / Changti Wu, Bin Yu, Zhaolong Shen 他
日本語で読む →