論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文センサ融合/動的物体追跡ロボティクス
建設現場における動的物体検出と追跡:魚眼カメラとLiDARセンサ融合モデル
四足ロボットに搭載したLiDARと魚眼カメラのセンサ融合により、建設現場で動的物体をリアルタイムに検出・追跡するフレームワークを提案した。
原題: Dynamic Object Detection and Tracking in Construction: A Fisheye Camera and LiDAR Sensor Fusion Model / Yilong Chen, Huili Huang, Yong K. Cho
日本語で読む → - 論文意味的占有マッピングロボティクス
GEM-Occ: 視覚幾何学的証拠から身体化された意味的占有記憶へ
屋内エージェントのための階層的意味的占有マッピングを実現するため、新しいベンチマークHIOccと、局所的な視覚幾何学予測を一時的な証拠として扱い、永続的な階層記憶に融合するGEM-Occフレームワークを提案した。
原題: GEM-Occ: From Visual Geometry Evidence to Embodied Semantic Occupancy Memory / Hu Zhu, Bohan Li, Xianda Guo 他
日本語で読む → - 論文移動操作ロボティクス
RLMM-Flow: 潜在空間強化学習を用いたフローベース移動操作フレームワーク
移動操作ロボットの全身動作生成を、専門家デモからのフローポリシー事前学習と潜在空間での強化学習後調整を組み合わせて改善するフレームワークを提案した。
原題: RLMM-Flow: A Flow-based Mobile Manipulation Framework with Latent-Space Reinforcement Learning / Shuhang Wang, Ziming Li, Hui Cheng
日本語で読む → - 論文衝突処理cs.GR
凸衝突回避領域
変形物体の衝突処理を、各頂点の凸な可動領域を事前に構築して非貫通を明示的に保証する手法を提案。二次衝突や低次元接触にも対応し、XPBDなどと組み合わせて高効率に衝突処理を行う。
原題: Convex Collision-Free Regions / Tomoyo Kikuchi, Takashi Kanai
日本語で読む → - 論文世界モデル/計画自然言語
時間距離JEPA:潜在世界モデル予測制御のための計画認識表現学習
報酬なし軌跡から時間的コストを学習し、潜在世界モデルの計画性能を向上させる手法を提案した。
原題: Temporal-Distance JEPA: Plan-Aware Representation Learning for Latent World Model Predictive Control / Jiaxin Bai, Jiaxuan Xiong
日本語で読む → - 論文模倣学習/操作ロボティクス
GuidedAttention: OODロバストなロボット操作のための解釈可能かつ修正可能な視覚的注意機構
視覚運動ポリシーに解釈可能で修正可能な注意キーポイントを中間表現として導入し、ユーザーが初期化時に修正可能な模倣学習フレームワークを提案。シミュレーションと実世界でOOD条件下での操作性能を向上させた。
原題: GuidedAttention: Interpretable and Correctable Visual Attention for OOD-Robust Robot Manipulation via Imitation Learning / Masaki Murooka, Ryoichi Nakajo, Keisuke Shirai 他
日本語で読む → - 論文sim2realロボティクス
エージェント型Real2Sim:視覚言語エージェントによる物理ベースの世界モデリング
ロボットと物体の相互作用の実世界記録を、物理シミュレーション可能な双子モデルに自動変換するフレームワークを提案。視覚言語エージェントが幾何・物理パラメータ・軌道などを自律的に推定し、剛体操作から変形物体、人型動作までを統一的に扱う。
原題: Agentic Real2Sim: Physics-based World Modeling with Vision-Language Agents / Guanxiong Chen, Qianjun Xia, Jiawei Peng 他
日本語で読む → - 論文模倣学習ロボティクス
三腕ビジュオモーター模倣学習によるロボットポリシーの獲得
三腕ロボットの模倣学習において、人間の操作者が同時に制御できるのは2腕までという制約を克服するため、デモンストレーションのタイミングを再調整する手法DATSを提案し、実世界の6タスクで有効性を示した。
原題: Tri-Manual Visuomotor Imitation Learning of Robot Policies / James Zhao, Mingyuan Ba, Weiming Zhi
日本語で読む → - 論文遠隔操作ロボティクス
MDIR: 接触を伴う遠隔操作のためのタスク多様体インピーダンス再ターゲティング手法
固定の直交インピーダンス制御による遠隔操作デモを、実行可能な可変インピーダンス指令へ再パラメータ化する手法を提案。デモ軌道近傍でのタスクチャネル応答を維持しつつ、手首力のピークやインパルスなどを低減する。
原題: MDIR: A Task-Manifold Impedance Retargeting Method for Contact-Rich Teleoperation / Liu Jiahao, Kento Kawaharazuka, Tasuku Makabe 他
日本語で読む → - 論文VLA/触覚/操作ロボティクス
τ: 未来の視覚的監督から学習する触覚拡張型視覚言語行動モデル
接触を伴う操作タスク向けに、将来の視覚情報を教師信号として触覚表現を学習し、事前学習済みVLAモデルに統合するフレームワークを提案。専用データセットTacAuraも導入し、未見物体やシーンへの汎化性能を向上させた。
原題: {\tau}: Learning Touch-Augmented Vision-Language-Action Models from Future Visual Supervision / Ning Cheng, Jinan Xu, Wanlin Li 他
日本語で読む → - 論文歩行ロボティクス
Koopman DCM: 不安定固有関数による脚式バランス制御のデータ駆動表現
脚式ロボットのバランス制御に使われるDCMを、Koopman作用素の固有関数として一般化し、実機データのみから学習する手法を提案した。実二足ロボットで歩行追従性能が向上し、MPCと組み合わせた生存性制約も実現した。
原題: Koopman DCM: Unstable Eigenfunctions as Data-driven Representations for Legged Balancing / Stéphane Caron
日本語で読む → - 論文ヒューマノイド/運動認識ロボティクス
自己組織化マップによるヒューマノイドロボットの運動プリミティブ発見と位相認識
ミラーニューロンシステムに着想を得て、NICOヒューマノイドロボットの腕と手の運動を自己組織化マップで学習し、エコー状態ネットワークで運動の位相をオンライン認識する2層アーキテクチャを提案した。
原題: Motion Primitive Discovery in a Humanoid Robot via Self-Organising Maps for Phase Recognition / Radovan Gregor, Igor Farkaš
日本語で読む → - 論文双腕操作ロボティクス
把持・受け渡し・回転:構成拡散とエネルギーベース最適化による双腕物体再配向
双腕ロボットによる物体の再配向(把持、受け渡し、目標姿勢への配置)を、拡散モデルとエネルギーベース最適化を組み合わせて実現する手法を提案した。
原題: Grasp, Handover, Rotate: Bimanual Object Reorientation via Compositional Diffusion and Energy-Based Optimization / Wun Lam Yeung, Wenjun Liu, Yui Cheung Yu 他
日本語で読む → - 論文動作生成/拡散モデル/MPPIロボティクス
GRACE: 勾配不要のロボット動作生成 - 拡散モデルとMPPIの後方平均推定の統合
拡散ポリシーをMPPI制御で誘導し、微分不可能な安全制約を扱える勾配不要の動作生成手法GRACEを提案。シミュレーションと実機で成功率向上を確認。
原題: GRACE: Gradient-Free Robot Action Generation via Combined Diffusion-MPPI Posterior Mean Estimation / Leesai Park, Jiho HOng, Sanghyun Kim
日本語で読む → - 論文協調運転制御
インテグリティ・ゲート型エコCACC:信号交差点における協調運転のための認識論的許容性
協調運転システムがセンサ異常や認識の不整合で誤動作しないよう、内部モデルと外部センシングの整合性を監視し、信頼度に応じてエコ運転と安全優先のフォールバックを切り替える枠組みを提案した。
原題: Integrity-Gated Eco-CACC: Epistemic Admissibility for Cooperative Driving at Signalized Intersections / Lyes Saad Saoud, Moussa Ayyash
日本語で読む → - 論文歩行ロボティクス
深層強化学習による動的粘性環境下での蛇型ロボットの適応的うねり移動
深層強化学習を用いて、動的に変化する粘性環境で蛇型ロボットが適応的に移動する方法を提案。教師ポリシーから生徒ポリシーへの知識蒸留により、センサ情報のみで環境変化に対応する非正弦波の適応歩容を獲得した。
原題: Adaptive Undulatory Locomotion of Snake-like Robots in Dynamic Viscous Environments via Deep Reinforcement Learning / Tsuyoshi Kimoto, Akio Yamano, Kohei Honda 他
日本語で読む → - 論文ナビゲーションロボティクス
未構造環境向け能力認識型トラバーサビリティナビゲーション
ロボットの身体性(能力)を考慮した走行可能性推定フレームワークCATを提案し、地形のセマンティックマップにロボット固有の走行可能性ベクトルを埋め込むことで、異なる形態のロボットでの安全性を向上させた。
原題: Towards Capability-Aware Traversability Navigation for Unstructured Environments / Gianluca Capezzuto, Felipe Tommaselli, Matheus P. Angarola 他
日本語で読む → - 論文VLA/ヒューマノイド/操作ロボティクス
ヒューマノイドVLAにおけるループの閉鎖:検証可能な移動操作のための持続的3Dオブジェクトトークン
RGB-D観測から役割インデックス付きの3Dオブジェクト記録を維持し、それをオブジェクトトークンとして行動生成と幾何学的述語チェックの両方に使用することで、検証可能な閉ループ実行を実現するPOT-VLAを提案。実機でベースラインを大幅に上回る成功率を達成。
原題: Closing the Loop in Humanoid VLA: Persistent 3D Object Tokens for Verifiable Loco-Manipulation / Peng Ren, Haoyang Ge, Jiang Zhao 他
日本語で読む → - 論文ナビゲーションロボティクス
SOPD-SocialNav: 視覚言語ソーシャルナビゲーションのための選択的オンポリシー蒸留
大規模な視覚言語モデルから軽量な学生モデルへ、エントロピーに基づくトークン選択と温度制御付きJSダイバージェンスを用いて社会的ナビゲーション知識を蒸留する手法を提案。実機ロボットでの検証も行った。
原題: SOPD-SocialNav: Selective On-Policy Distillation for Vision-Language Social Navigation / Xinyu Zhang, Zishuo Wang, Ling Xiao
日本語で読む → - 論文安全監視ロボティクス
病棟におけるPhysical AIの安全仕様としての臨床パス
病棟で動作するPhysical AIの安全性を確保するため、臨床パスを実行時安全仕様として捉え、ウェアラブルセンサや医療機器、支援ロボットを統合した監視アーキテクチャを提案した論文。
原題: Clinical Pathways as Safety Specifications for Physical AI in Hospital Wards / Gabriele Franchini, Giulio Mallardi, Michele De Carolis 他
日本語で読む → - 論文把持合成ロボティクス
FIRMGrasp: 摩擦を考慮したリスクマージンによる堅牢な把持合成
摩擦係数の不確実性を条件付きリスク価値(CVaR)で考慮した新しい把持品質指標を提案し、摩擦に敏感な把持を特定して堅牢性を向上させる。
原題: FIRMGrasp: A Friction-Informed Risk Margin for Robust Grasp Synthesis / Clinton Enwerem, John S. Baras, Calin Belta
日本語で読む → - 論文手術ロボティクスロボティクス
手術剥離における組織付着マッピングのためのベイズ牽引最適化
ロボット手術の組織剥離タスクにおいて、組織の付着状態をベイズ的に推定し、最も情報量の多い牽引動作を選択する手法を提案。シミュレーションと実機で有効性を検証した。
原題: Bayesian Retraction Optimization for Tissue Attachment Mapping in Surgical Dissection / Shing-Hei Ho, Bao Thach, Toan Vo 他
日本語で読む → - 論文sim2realロボティクス
有効パラメータと実挙動:ロボティクスにおける繰り込み ― 無限電子質量からシミュレーション実機ギャップへ
シミュレータが省略する詳細を吸収する有効パラメータを用いて実挙動を再現する、繰り込みに基づくsim-to-realギャップの新しいアプローチを提案し、PD制御や動的ロープ操作、水中遊泳で実証した。
原題: Effective Parameters, Real Behavior: Renormalization for Robotics -- From Infinite Electron Mass to Sim-to-Real Gap / Youran Sun, Jiaxuan Guo, Xingyu Ren 他
日本語で読む → - 論文スキル発見/継続学習ロボティクス
ASPIRE: ロボットのためのエージェント的スキル発見
ロボット制御プログラムを自律的に作成・改善し、再利用可能なスキルライブラリを構築する継続学習システムASPIREを提案。シミュレーションと実世界で高い性能とゼロショット汎化を示した。
原題: ASPIRE: Agentic /Skills Discovery for Robotics / Runyu Lu, Yubo Wu, Ethan Kou 他
日本語で読む → - 論文制御理論制御
極座標における車両の運動学的自転車モデルの大域的指数安定化
駐車速度での車両モデルを極座標に変換し、人間らしい駐車軌道を生成する滑らかなフィードバック則を設計して大域的指数安定化を実現した論文。
原題: Global Exponential Stabilization of the Kinematic Bicycle Model of a Car in Polar Coordinates / Velimir Todorovski, Kwang Hak Kim, Alessandro Astolfi 他
日本語で読む → - 論文力学学習ロボティクス
CaLiSym: 構造化正準リフトによる実世界システムのシンプレクティック力学学習
実世界のロボットシステム(駆動・散逸・拘束を含む)に対して、状態をリフトした位相空間上でシンプレクティック写像を学習する軽量フレームワークを提案し、外挿予測誤差を最大69.5%削減した。
原題: CaLiSym: Learning Symplectic Dynamics of Real-World Systems through Structured Canonical Lifts / Aristotelis Papatheodorou, Pranav Vaidhyanathan, Natalia Ares 他
日本語で読む → - 論文ナビゲーションロボティクス
混雑環境における四足ロボットの俊敏なナビゲーション学習
四足ロボットが混雑した動的環境を安全かつ俊敏に移動するため、速度障害物理論とエンドツーエンド学習を組み合わせたナビゲーションシステムVOP-Navを提案した。
原題: Learning Agile Navigation in Crowded Environments for Quadruped Robots / Shuyu Wu, Zeyu Liu, Tianbao Zhang 他
日本語で読む → - 論文ステレオマッチング画像認識
WAVE-Stereo: ワープ整列ボリューム符号化によるステレオマッチング
相関ボリュームと特徴ワーピングを統合した新しいステレオマッチング手法を提案し、複数ベンチマークで高精度かつ高速な性能を実証した。
原題: WAVE-Stereo: Warp-Aligned Volume Encoding for Stereo Matching / Zehan Liu, Yage He, Xianwu Gong
日本語で読む → - 論文VLA/制御ロボティクス
機構的解釈可能性と最適制御によるワールドアクションモデルの堅牢性向上
機構的解釈可能性を用いてワールドアクションモデルの堅牢性を解析し、対比的活性化方向による学習不要のステアリングと、モデルベース最適制御によるフィードバック制御を提案して堅牢性を向上させた。
原題: Steering Robustness into World Action Models via Mechanistic Interpretability and Optimal Control / Jihoon Hong, Julian Skifstad, Qiyue Dai 他
日本語で読む → - 論文AUV/画像伝送cs.IR
低帯域通信リンクにおけるAUV収集海底画像の遠隔認識
AUVが収集した海底画像を低帯域通信で効率的に伝送するため、AIで代表画像や類似画像を選び圧縮して送る手法を提案し、実海域試験でデータ量を大幅削減できることを示した。
原題: Remote Awareness of Seafloor Images Collected by AUVs over Low-Bandwidth Communication Links / Adrian Bodenmann, Cailei Liang, Miquel Massot-Campos 他
日本語で読む →