論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転ロボティクス
模倣を超えて:ハードネガティブから学ぶ安全なエンドツーエンド自動運転
成功事例だけでなく失敗事例も学習に取り入れることで、軌道の安全性を向上させる自動運転の模倣学習フレームワーク「BeyondDrive」を提案した論文。
原題: Beyond Imitation: Learning Safe End-to-End Autonomous Driving from Hard Negatives / Junli Wang, Zhihua Hua, Xueyi Liu 他
日本語で読む → - 論文強化学習/視覚ロボティクス
確率的分離ポリシー勾配による効率的なオンポリシー視覚強化学習
軌道ロールアウトのランダム摂動でポリシー勾配を推定し、単一GPUで数時間の学習を実現する軽量な視覚強化学習手法SDPGを提案。視覚MuJoCoベンチマークで既存手法より高速・低メモリ・高報酬を達成し、実機へのsim-to-real転送も実証した。
原題: Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient / Haoxiang You, Yilang Liu, Davis Zong 他
日本語で読む → - 論文歩行/外骨格ロボティクス
制約付きカーネル化運動プリミティブによる多地形外骨格の適応歩容生成
下肢外骨格の適応歩行計画を実現するため、人間の歩行デモから確率的運動プリミティブを学習し、RGB-Dカメラの環境情報を線形制約として組み込むことで、平地・斜面・階段・障害物などの多地形に対応する歩容をリアルタイム生成する手法を提案した。
原題: Adaptive Gait Generation for Multi-Terrain Exoskeletons via Constrained Kernelized Movement Primitives / Edoardo Trombin, Miroljub Mihailovic, Matheus Henrique Ferreira Moura 他
日本語で読む → - 論文パラメータ同定ロボティクス
低コストロボットアームのための再現可能かつ物理的に実現可能な動的パラメータ同定フレームワーク
低コストロボットアームCRANE-X7の動的パラメータを、物理的実現可能性を保証しつつ同定するフレームワークを提案。慣性積の削減、SDP投影、閉ループ誤差補正を組み合わせ、統計的に中心的なモデルを選択する。
原題: A Reproducible and Physically Feasible Dynamic Parameter Identification Framework for a Low-Cost Robot Arm / Junji Oaki, Koki Yamane, Koki Inami 他
日本語で読む → - 論文制御/アクチュエーションロボティクス
VRA: 電圧制約アクチュエーションにおける離散時間関節加速度の接地
電圧制約下の電気アクチュエータで物理的に実現不可能な関節加速度を排除する、電圧実現可能加速度(VRA)インターフェースを提案し、ハードウェア実験で有効性を実証した。
原題: VRA: Grounding Discrete-Time Joint Acceleration in Voltage-Constrained Actuation / Lingwei Zhang, Jiaming Wang, Tianlin Zhang 他
日本語で読む → - 論文群制御ロボティクス
SCALE-COMM: マルチエージェント強化学習通信のための共有・対照整列潜在埋め込み
部分観測の自律移動ロボット群の協調のため、通信学習を政策最適化から分離し、タスク関連情報を捉えた低次元の安定した通信表現を自己教師ありで学習するフレームワークを提案した。
原題: SCALE-COMM: Shared, Contrastively-Aligned Latent Embeddings for MARL Communication / Mahmoud Abouelyazid, Eman Hammad
日本語で読む → - 論文進化ロボット設計/LLMロボティクス
検索が記憶になるとき:ロボット設計の試行錯誤を転移可能なスキルへ変換する
進化的ロボット設計の探索履歴を自然言語のスキルライブラリとして蓄積し、LLMエージェントがそれを参照して設計を改善する自己進化システムを提案した。
原題: When Search Becomes Memory: Turning Robot Design Trials into Transferable Skills / Yunfei Wang, Xiaohao Xu, Yang Li 他
日本語で読む → - 論文群制御ロボティクス
逆最適制御を用いた非通信移動ロボットの軌道計画
通信しない移動ロボット群の衝突回避のため、逆最適制御で目標状態を推定し、相互予測を考慮した軌道計画・予測アルゴリズムを提案した。シミュレーションで到達時間が約9.8%短縮された。
原題: Trajectory Planning for Non-Communicating Mobile Robots using Inverse Optimal Control / Nina Majer, Yannick Epple, Xin Ye 他
日本語で読む → - 論文VLA/操作ロボティクス
PrimitiveVLA: 再利用可能な運動プリミティブ学習による効率的で汎用的なロボット操作
VLAモデルのデータ効率と汎化を改善するため、デモを再利用可能な運動プリミティブに分解し、推論時に組み立てるフレームワークを提案した。
原題: PrimitiveVLA: Learning Reusable Motion Primitives for Efficient and Generalizable Robotic Manipulation / Yutai Li, Shaohui Peng, Jiaming Guo 他
日本語で読む → - 論文データ収集/模倣学習ロボティクス
粗密模倣学習のための触覚フィードバック付き視覚触覚データ収集システム
操作者が指で直接グリッパーを操作し、自然な触覚フィードバックを保ちながら、視覚・触覚データとタスクの時間構造を収集するシステムを提案。粗密学習アルゴリズムに適したマルチモーダルデータセットを生成する。
原題: A Visuo-Tactile Data Collection System with Haptic Feedback for Coarse-to-Fine Imitation Learning / Yeseung Kim, Nayoung Oh, Jun Park 他
日本語で読む → - 論文群制御ロボティクス
MR-SLAM: 複数ロボットマッピングのための複合現実による没入型空間監視
Meta Quest 3ヘッドセットを用いて、複数のTurtleBot3ロボットを遠隔操作しながらSLAMマッピングを監視する複合現実システムを提案し、実機評価でその有効性を示した。
原題: MR-SLAM: Immersive Spatial Supervision for Multi-Robot Mapping via Mixed Reality / Prakash Aryan, Cem Erdogdu, Kavinaya Kumarchokkappan 他
日本語で読む → - 論文VLAロボティクス
PriorVLA: 事前知識を保持した視覚言語行動モデルの適応
事前学習済みの視覚言語行動モデルを下流タスクに適応させる際、事前知識を保持しつつ効率的に活用するフレームワークPriorVLAを提案。凍結した事前エキスパートと適応エキスパートを組み合わせ、パラメータ更新を25%に抑えつつ、分布外や少数サンプル設定で高い性能を達成。
原題: PriorVLA: Prior-Preserving Adaptation for Vision-Language-Action Models / Xinyu Guo, Bin Xie, Wei Chai 他
日本語で読む → - 論文軌道予測ロボティクス
環境認識型の長期間船舶軌道予測のための階層的二段階フレームワーク
船舶の長期間軌道予測を、粗い長期予測とセルベースの短期予測を階層的に融合し、海流・風・波などの環境情報を組み込むことで高精度化した。
原題: Hierarchical Two-Stage Framework for Environment-Aware Long-Horizon Vessel Trajectory Prediction / Ganeshaaraj Gnanavel, Tharindu Fernando, Sridha Sridharan 他
日本語で読む → - 論文群制御ロボティクス
部分既知環境下でのヘテロロボットチームのための偵察支援計画
地上ロボットの移動コストを削減するため、偵察用ドローンが情報収集を支援する計画フレームワークを提案し、情報利得に基づく行動刈り込みとグラフニューラルネットワークによる高速化を実現した。
原題: Scout-Assisted Planning for Heterogeneous Robot Teams under Partially Known Environments / Hoang-Dung Bui, Abhish Khanal, Raihan Islam Arnob 他
日本語で読む → - 論文マニピュレーションロボティクス
OASIS: SE(3)軌道予測による観測・行動空間の整合を利用したロボット操作
視覚・言語・行動モデルの中間表現を行動空間の剛体幾何に合わせるため、SE(3)軌道予測を導入したポリシーを提案し、シミュレーションと実機で成功率と汎化性能を向上させた。
原題: OASIS: Observation-Action Space Alignment via SE(3) Trajectory Prediction for Robotic Manipulation / Xinzhe Chen, Sihua Ren, Liqi Huang 他
日本語で読む → - 論文実験自動化AI
プロンプトからプロトコルへ:実験室自動化のためのAIエージェント
大規模言語モデルと実験室オーケストレーションを統合し、自然言語で実験プロトコルの作成・監視・分析を可能にするAIエージェントを提案。シミュレーション実験で97%の成功率と操作削減を達成。
原題: From Prompts to Protocols: An AI Agent for Laboratory Automation / Angelos Angelopoulos, James F. Cahoon, Ron Alterovitz
日本語で読む → - 論文VLAロボティクス
RoVLA: ロバストな視覚言語行動モデルのための多重整合性制約
視覚言語行動モデルのロバスト性を高めるため、指示意味・軌道進化・観測摂動の3つの変換に対する整合性制約を導入したRoVLAを提案。
原題: RoVLA: Multi-Consistency Constraints for Robust Vision-Language-Action Models / Jingzhou Luo, Yifan Wen, Yongjie Bai 他
日本語で読む → - 論文ロボット操作cs.CR
求めていたものではない:家庭用ロボット操作におけるタイポグラフィ攻撃
家庭用ロボットの操作パイプライン全体に対するタイポグラフィ攻撃の影響を、HabitatシミュレーションとHomeRobotベンチマークで評価し、攻撃成功率67.8%で誤った物体を物理的に掴んで運ぶことを実証した。
原題: Not What You Asked For: Typographic Attacks in Household Robot Manipulation / Ali Iranmanesh, Peng Liu
日本語で読む → - 論文移動機構ロボティクス
惑星探査のための地形適応型グルーサホイール:設計と実験的検証
惑星探査ローバーの車輪のグルーサ高さを連続的に調整できる機構を提案し、様々な地形での実験により滑りやエネルギー消費を大幅に改善できることを示した論文。
原題: Terrain-Adaptive Grouser Wheel for Optimal Planetary Exploration: Design and Experimental Investigation / Vincent Griffo, Yashwanth Kumar Nakka
日本語で読む → - 論文教育/ロボティクスHCI
RoboBlockly Studio: 対話型ブロックプログラミングとロボットフィードバックによる計算的思考の育成
ブロックプログラミング、対話型AIチューター、実体ロボットを統合したシステムを設計・評価し、高校生の計算的思考学習を支援する。
原題: RoboBlockly Studio: Conversational Block Programming with Embodied Robot Feedback for Computational Thinking / Leyi Li, Chenyu Du, Jiafei Sun 他
日本語で読む → - 論文群制御ロボティクス
ギャップに注意:未知環境におけるマルチロボットのフィードバック駆動エルゴード被覆
未知環境で複数ロボットが環境情報の分布をリアルタイムに推定しながら、エルゴード探索を拡張して適応的に被覆する手法を提案し、シミュレーションで有効性を検証した。
原題: Mind the Gaps: Multi-Robot Feedback-Driven Ergodic Coverage in Unknown Environments / Thales Costa Silva, Nora Ayanian
日本語で読む → - 論文自動実験/ソフトウェアアーキテクチャAI
NIMO Controller: Model Context Protocolに基づく自動運転ラボオーケストレータ
自己運転ラボ(SDL)のソフトウェアを、AIエージェントにも対応した標準化されたインターフェースで構築するため、Model Context Protocol(MCP)に基づくアーキテクチャとオーケストレータ「NIMO Controller」を提案し、色合わせSDLのケーススタディで実証した。
原題: NIMO Controller: a self-driving laboratory orchestrator based on the Model Context Protocol / Naruki Yoshikawa, Ryo Tamura
日本語で読む → - 論文世界モデル画像認識
ハイブリッド身体性タスクにおける長期的進化のためのワールド・エゴモデリング
本論文は、長期的なハイブリッド身体性タスク(ナビゲーションと操作の組み合わせ)において、世界と自己の進化を分離してモデル化する新しいパラダイム「ワールド・エゴモデリング」を提案し、その実装としてWEMモデルとベンチマークHTEWorldを構築した。
原題: World-Ego Modeling for Long-Horizon Evolution in Hybrid Embodied Tasks / Zuyao Lin, Jianhui Zhang, Peidong Jia 他
日本語で読む → - 論文マニピュレーションロボティクス
SkiP: ロボット操作の効率化のためのスキップと精密化のタイミング
模倣学習のポリシーが毎ステップ予測するのをやめ、動作が単調な区間はスキップし、接触や把持などの重要区間だけを高解像度で予測する新しい手法を提案。動作の複雑さを自動検出して区間を分割し、実行ステップを15〜40%削減しつつ成功率を維持・向上させる。
原題: SkiP: When to Skip and When to Refine for Efficient Robot Manipulation / Mingtong Dai, Guanqi Peng, Yongjie Bai 他
日本語で読む → - 論文経路計画ロボティクス
経路ベースセンサのためのベイジアンネットワーク:通信不能環境における情報収集と経路計画
経路に沿った観測結果(例:危険検知の有無)から事象の空間分布を推定するベイジアンネットワーク手法を提案し、情報利得を最大化する経路計画を行う。
原題: Bayesian Networks for Path-Based Sensors: Gathering Information and Path Planning in Communication Denied Environments / Alkesh K. Srivastava, George P. Kontoudis, Donald Sofge 他
日本語で読む → - 論文VLAロボティクス
EvoScene-VLA: アクションデコーダ内でシーン信念を進化させ、チャンク化ロボット制御を実現
ロボットのアクションによって変化するシーン状態を、チャンク間で持続的に更新するVLAポリシーを提案し、シミュレーションと実機で成功率を向上させた。
原題: EvoScene-VLA: Evolving Scene Beliefs Inside the Action Decoder for Chunked Robot Control / Chushan Zhang, Ruihan Lu, Jinguang Tong 他
日本語で読む → - 論文視覚言語ナビゲーションロボティクス
SEDualVLN: 空間強化デュアルシステムによる視覚言語ナビゲーション
視覚言語ナビゲーションの性能を高めるため、空間認識を強化した2つのシステム(VLMとMLLM)を組み合わせたフレームワークを提案し、VLN-CEベンチマークで最高性能を達成した。
原題: SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation / Jingzhi Huang, Junkai Huang, Wenxuan Song 他
日本語で読む → - 論文VLAロボティクス
DyGRO-VLA: 動的グループ化残差最適化による視覚言語行動モデルのクロスタスクスケーリング
視覚言語行動モデルの汎用性を高めるため、情報理論に基づくクロスタスク表現学習と動的残差最適化を組み合わせた二段階最適化フレームワークを提案した。
原題: DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization / Sixu Lin, Yunpeng Qing, Litao Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboFlow4D: リアルタイムフロー誘導ロボット操作のための軽量フローワールドモデル
視覚観察とテキスト指示から3Dフローを直接予測し、動作生成を誘導する軽量なエンドツーエンドのフローワールドモデルを提案し、シミュレーションと実世界で操作成功率と計算効率を向上させた。
原題: RoboFlow4D: A Lightweight Flow World Model Toward Real-Time Flow-Guided Robotic Manipulation / Sixu Lin, Junliang Chen, Huaiyuan Xu 他
日本語で読む → - 論文触覚/運動推定ロボティクス
TacSE3: 低テクスチャ視触覚画像からの等変SE(3)運動推定による把持内追跡と補償
低テクスチャの視触覚画像からSE(3)上の剛体運動を推定するパイプラインを提案し、把持内の物体追跡と外乱補償に応用した。
原題: TacSE3: Equivariant SE(3) Motion Estimation from Low-Texture Visuotactile Images for In-Gripper Tracking and Compensation / Zhongyuan Liao, Junzhe Wang, Qingyang Liu 他
日本語で読む →