論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文歩行ロボティクス
制約を考慮した拡散事前分布による高忠実かつ多用途な四足歩行
四足歩行の模倣学習において、GANの代わりに拡散モデルを運動事前分布として用い、多様な動作生成とハードウェア安全を両立する枠組みDiff-CASTを提案した。
原題: Constraint-Aware Diffusion Priors for High-Fidelity and Versatile Quadruped Locomotion / Jianhui Chen, Ruixin Zhan, Liu Liu 他
日本語で読む → - 論文自動運転ロボティクス
ReflectDrive-2: 強化学習整合型自己編集による離散拡散運転プランナー
自動運転向けに、離散トークンで軌道を表現し、自己編集で軌道を修正するマスク拡散プランナーを提案。強化学習で編集能力を訓練し、性能を向上させた。
原題: ReflectDrive-2: Reinforcement-Learning-Aligned Self-Editing for Discrete Diffusion Driving / Huimin Wang, Yue Wang, Bihao Cui 他
日本語で読む → - 論文シーングラフ/単眼SLAMロボティクス
LEXI-SG: 部屋誘導フィードフォワード再構成による単眼3Dシーングラフマッピング
RGBカメラのみを用いて、オープンボキャブラリの3Dシーングラフを構築する初の密な単眼マッピングシステムを提案。部屋単位で再構成を遅延させ、グローバルな整合性を保つ。
原題: LEXI-SG: Monocular 3D Scene Graph Mapping with Room-Guided Feed-Forward Reconstruction / Christina Kassab, Hyeonjae Gil, Matías Mattamala 他
日本語で読む → - 論文器用操作ロボティクス
DexSynRefine: 物理的に実現可能な器用なロボット動作のための人間と物体のインタラクション動作の合成と洗練
人間と物体のインタラクション動作を構造化された動作事前分布として扱い、タスク空間残差強化学習と接触ダイナミクス適応により物理的に実現可能な器用なロボット動作を生成するフレームワークを提案。実世界成功率を大幅に向上させた。
原題: DexSynRefine: Synthesizing and Refining Human-Object Interaction Motion for Physically Feasible Dexterous Robot Actions / Hyesung Lee, Hyunwoo Jung, Si-Hwan Heo 他
日本語で読む → - 論文模倣学習ロボティクス
デモンストレーション周辺での適応的探索のためのエルゴード模倣
模倣学習における訓練と実環境のミスマッチに対応するため、デモの幾何学的構造から目標分布を構築し、追従と探索を適応的に切り替えるエルゴード制御に基づく軌道生成手法を提案した。
原題: Ergodic Imitation for Adaptive Exploration around Demonstrations / Ziyi Xu, Cem Bilaloglu, Yiming Li 他
日本語で読む → - 論文モーションプランニングロボティクス
オープンモーションプランニングライブラリ 2.0
サンプリングベースのモーションプランニングアルゴリズムを多数実装したライブラリOMPLのメジャーアップデート版を紹介し、ハードウェア加速によるリアルタイムプランニングとAI研究ワークフローとの統合を目指す。
原題: The Open Motion Planning Library 2.0 / Weihang Guo, Theodoros Tyrovouzis, Emiliano Flores 他
日本語で読む → - 論文歩行ロボティクス
ロボット・イカゲーム:狭いトンネルを横断する四足歩行
四足ロボットが狭いトンネルなどの閉鎖環境を自律的に移動するための強化学習フレームワークを提案。手続き的環境生成とポリシー蒸留を組み合わせ、複雑な報酬設計なしで多様なトンネル形状に対応する。
原題: Robot Squid Game: Quadrupedal Locomotion for Traversing Narrow Tunnels / Amir Hossain Raj, Dibyendu Das, Xuesu Xiao
日本語で読む → - 論文状態推定ロボティクス
未知の時間遅延を伴う慣性航法システムのためのガリレイ状態推定
GNSS測定の未知の時間遅延を明示的にモデル化し、ガリレイ対称性に基づく等変フィルタ(EqF)を用いて航法状態と時間遅延を同時推定する新しい手法を提案した。実機UAV実験とシミュレーションで有効性を示した。
原題: Galilean State Estimation for Inertial Navigation Systems with Unknown Time Delay / Giulio Delama, Martin Scheiber, Yixiao Ge 他
日本語で読む → - 論文シミュレーションロボティクス
Chrono-Gymnasium: オープンソースのGymnasium互換分散シミュレーションフレームワーク
高忠実度物理シミュレーションを大規模クラスタで分散実行するフレームワークを提案し、RLエージェントの訓練と着陸機設計のベイズ最適化で有効性を示した。
原題: Chrono-Gymnasium: An Open-Source, Gymnasium-Compatible Distributed Simulation Framework / Bocheng Zou, Harry Zhang, Khailanii Slaton 他
日本語で読む → - 論文動作解析ロボティクス
軟剛ハイブリッドリンク系の動力学計算とスポーツ用義足を装着したアスリートの動作解析への応用
剛体リンクと柔軟体を統合したハイブリッドリンク系の動力学計算手法を提案し、スポーツ用義足を装着したアスリートの動作解析に応用した。逆動力学による床反力推定誤差は約12%で、筋力推定も可能にした。
原題: Dynamics Computation of Soft-Rigid Hybrid-Link System and Its Application to Motion Analysis of an Athlete Wearing Sport Prosthesis / Sunghee Kim, Yuta Shimane, Taiki Ishigaki 他
日本語で読む → - 論文3Dアセット生成画像認識
Articraft: 大規模な関節付き3Dアセット生成のためのエージェントシステム
大規模言語モデルを用いて、関節付き3Dアセットを生成するプログラムを自動で書くエージェントシステムArticraftを提案し、10K以上のアセットを含むデータセットを構築した。
原題: Articraft: An Agentic System for Scalable Articulated 3D Asset Generation / Matt Zhou, Ruining Li, Xiaoyang Lyu 他
日本語で読む → - 論文VLA/操作ロボティクス
AffordVLA: 暗黙的特徴アライメントによるアフォーダンス表現の視覚言語行動モデルへの注入
VLAモデルの視覚表現に操作中心のアフォーダンス知覚を暗黙的に注入するフレームワークを提案し、シミュレーションと実世界で高い性能を達成した。
原題: AffordVLA: Injecting Affordance Representations into Vision-Language-Action Models via Implicit Feature Alignment / Weijie Kong, Zhian Su, Wei Yu 他
日本語で読む → - 論文群制御/セキュリティロボティクス
LLM制御マルチロボット協調における単一ロボット侵害による不安全行動の伝播
LLMで制御されるマルチロボットシステムに対し、1台のロボットを侵害するだけで、ロボット間通信を通じて悪意ある指示を伝播させ、システム全体で協調的な不安全行動を引き起こす攻撃手法を提案・評価した論文。
原題: Propagating Unsafe Actions in LLM Controlled Multi-Robot Collaboration via Single Robot Compromise / Zhen Huang, Zhihuang Liu, Mengxuan Luo 他
日本語で読む → - 論文マニピュレーションロボティクス
KaRMA: ロボットハンドの巧緻操作能力を測る運動学的指標
ロボットハンドの指先で物体を転がしながら連続的に動かす巧緻操作能力を、運動学のみで定量化する新しい指標KaRMAを提案し、16種類のハンドで評価した。
原題: KaRMA: A Kinematic Metric for Fine Manipulation Ability in Robotic Hands / Martin Peticco, Pulkit Agrawal
日本語で読む → - 論文マッピングロボティクス
LAPS: 能動的プーリングとサンプリングによるニューラル距離場を用いたインクリメンタルLiDARマッピングの改善
ニューラル距離場を用いた逐次LiDARマッピングにおいて、破滅的忘却を防ぐためのリプレイ管理手法LAPSを提案。信頼性に基づく能動的プーリングと不確実性に基づく能動的サンプリングにより、限られたメモリで重要な履歴データを保持し、未学習領域への最適化を集中させることで、再構成の完全性を向上させる。
原題: LAPS: Improving Incremental LiDAR Mapping using Active Pooling and Sampling for Neural Distance Fields / Dongjae Lee, Wooseong Yang, Yifu Tao 他
日本語で読む → - 論文移動操作ロボティクス
脚式マニピュレータの動的ピックアンドプレース学習
四足ロボットに6自由度アームを搭載し、階層型強化学習で動的ピックアンドプレースを実現。質量推定モジュールにより重量変化に適応し、シミュレーションと実機で高い成功率を達成した。
原題: Learning Dynamic Pick-and-Place for a Legged Manipulator / Moonkyu Jung, Jiseong Lee, Zhengmao He 他
日本語で読む → - 論文ドローン/視覚誘導ロボティクス
木のどこにとまるか:木をつかむドローンのための視覚誘導
木にとまるドローンが、枝の太さや傾き、曲がり具合を画像処理で評価し、最適な着地点を選ぶ方法を提案した論文。
原題: Where to Perch in a Tree: Vision-Guidance for Tree-Grasping Drones / Alex Dunnett, Leonie Bottomley, Mirko Kovac 他
日本語で読む → - 論文安全制御ロボティクス
ポリシーライブラリCBF:並列ロールアウトによる実行時の有限時間安全性保証
複数のフォールバックポリシーを並列に評価し、最も侵襲の少ない安全な動作を選択する実行時安全フィルタを提案。理論解析とシミュレーションで有効性を示した。
原題: Policy Library CBF: Finite-Horizon Safety at Runtime via Parallel Rollouts / Taekyung Kim, Hideki Okamoto, Bardh Hoxha 他
日本語で読む → - 論文SLAMロボティクス
動的屋内環境向けユビキタスマッピングと位置推定の実現
固定RGB-Dカメラ網を用いて動的屋内環境のリアルタイムマッピングとロボット位置推定を行うUbiSLAMを提案し、ロボット単体の負荷を減らしつつ高精度なナビゲーションを実現する。
原題: Towards Ubiquitous Mapping and Localization for Dynamic Indoor Environments / Halim Djerroud, Nico Steyn, Olivier Rabreau 他
日本語で読む → - 論文6D姿勢推定画像認識
RGB-D残差ニューラルネットワークによるキーポイントヒートマップ回帰を用いた6D姿勢推定
RGB画像からキーポイントのヒートマップを予測し、PnP RANSACで6D姿勢を推定する枠組みを提案。深度データを融合するアーキテクチャも導入し、LINEMODデータセットで精度を向上させた。
原題: 6D Pose Estimation via Keypoint Heatmap Regression with RGB-D Residual Neural Networks / Ismail Aljosevic, Amir Masoud Almasi, Ana Parovic 他
日本語で読む → - 論文自動運転シミュレーションロボティクス
PCASim: 都市交通環境のためのプロンプト可能な閉ループ敵対的シミュレーション
大規模言語モデルと知識ベースを用いて、ユーザー要求に応じた安全上重要な交通シナリオを生成し、強化学習で車両挙動を訓練することで、閉ループテストにおけるシナリオ生成と安全エージェント訓練の共進化を実現する。
原題: PCASim: Promptable Closed-loop Adversarial Simulation for Urban Traffic Environment / Chuancheng Zhang, Zhenhao Wang, Kaizheng Li 他
日本語で読む → - 論文ソフトロボティクス/センサロボティクス
ソフト格子構造における双方向光センサによる動作追跡(BOAT)
ソフトロボティクスの格子構造に埋め込む、圧縮と伸張を識別できる双方向光センサを開発し、空気圧人工筋肉による駆動と組み合わせて変形監視とデジタルシャドウ同期を実証した。
原題: Bidirectional Optical sensors for Actuation Tracking (BOAT) in soft lattice systems / Petr Trunin, Carolina Gay, Anderson Brazil Nardin 他
日本語で読む → - 論文グリッパー/宇宙ロボティクスロボティクス
軟質油圧駆動による器用で柔軟なグリッパー:微小重力操作向け
国際宇宙ステーションでの自由飛行ロボットAstrobee用に、2本指6自由度の器用で柔軟なグリッパーDexCoHandを開発し、シミュレーションと地上実験でその性能を実証した。
原題: A Dexterous and Compliant Gripper With Soft Hydraulic Actuation for Microgravity Manipulation / William Su, Jordan Kam, Yixiao Wang 他
日本語で読む → - 論文群制御制御
制御バリア関数による視野安全を考慮した分散型3Dリーダー・フォロワー編隊制御
マルチUAVシステム向けに、カメラの視野(FOV)制約を保証しながら編隊追従を実現する分散型3Dリーダー・フォロワー編隊制御フレームワークを提案。CBF-QP安全フィルタで速度指令を最小限に修正し、フォロワーがリーダーを視野内に維持する。
原題: Distributed 3D Leader-Follower Formation Control with Field-of-View Safety via Control Barrier Functions / Immanuel R. Santjoko, Richie R. Suganda, Miao Pan 他
日本語で読む → - 論文群制御HCI
ATRACT: 負傷者トリアージを支援する信頼できるロボット自律システム
ドローン映像とウェアラブルセンサーを統合し、戦場での負傷者トリアージを支援する人間参加型の意思決定システムを提案。データ拡張に条件付き変分オートエンコーダを用い、行動認識で85.7%の精度を達成。
原題: ATRACT: A Trustworthy Robotic Autonomous system to support Casualty Triage / Tasweer Ahmad, Rafael Pina, Sandip Pradhan 他
日本語で読む → - 論文ベンチマークロボティクス
PRISM: シミュレーション環境における意図を伴う計画と推論
LLMベースの身体性エージェントの失敗原因を、知覚・推論・長期計画のどの能力に起因するかを診断するベンチマークPRISMを提案した論文。
原題: PRISM: : Planning and Reasoning with Intent in Simulated Embodied Environments / Yunn Kang Lim, Pengzhan Sun, Ziyi Bai 他
日本語で読む → - 論文軌道予測ロボティクス
CVAEによるマルチモーダル歩行者軌道予測の改善:ベンチマークとロボットデータの研究
Social-STGCNNにCVAEを組み合わせ、歩行者の多様な未来軌道を確率的に予測する手法を提案し、公開ベンチマークと実ロボット収集データで評価した。
原題: On Improving Multimodal Pedestrian Trajectory Prediction with CVAE: A Study on Benchmark and Robot Data / Yuzhou Liu, Cristina Olaverri-Monreal
日本語で読む → - 論文自動運転マップ生成ロボティクス
ジオデータ駆動型HDマップ生成ワークフロー:参照不要の制約ベース検証を統合した手法
オープンな地理データから車線レベルのHDマップを生成し、外部参照地図なしで制約ベース検証を組み込むワークフローを提案・評価した論文。
原題: Geo-Data-Driven HD Map Generation Workflow with Integrated Reference-Free Constraint-Based Verification / Ruidi He, Vaibhav Tiwari, Mohanad Al-Ghobari 他
日本語で読む → - 論文生涯学習ロボティクス
視覚言語モデルにおける生涯学習:クロスモーダル知識保持を備えた強化EWC
視覚と言語の両モダリティを扱う大規模モデルが逐次学習で破滅的忘却を起こす問題に対し、マルチモーダルFisher情報行列と適応正則化を統合した強化EWCフレームワークを提案し、忘却率を78%削減しつつモダリティ間の整合性を維持することを示した。
原題: Lifelong Learning in Vision-Language Models: Enhanced EWC with Cross-Modal Knowledge Retention / Hamza Ahmed Durrani, Rafay Suleman Durrani
日本語で読む → - 論文計画/ワールドモデルロボティクス
探索を超えた潜在幾何学:ワールドモデルにおける計画の償却
滑らかで一様な潜在空間を持つ事前学習済みワールドモデルにおいて、反復的なオンライン探索を軽量な目標条件付き逆動力学モデル(GC-IDM)に置き換え、計画を償却する手法を提案。4つのベンチマークでCEM等と同等以上の性能を維持しつつ、計算コストを100〜130倍削減した。
原題: Latent Geometry Beyond Search: Amortizing Planning in World Models / Hoang Nguyen, Xiaohao Xu, Xiaonan Huang
日本語で読む →