論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ソフトウェアアーキテクチャ復元cs.SE
LLM支援による実世界ROS 2システムのアーキテクチャ復元:エージェントベースの多レベル階層構造再構築手法
ROS 2ベースのロボットシステムにおいて、ソースコードや起動ファイルなどの分散アーティファクトから階層的な構造アーキテクチャを復元する手法を提案。LLMエージェントと多レベルの中間表現を用いて、実システムで評価した。
原題: Towards LLM-Assisted Architecture Recovery for Real-World ROS~2 Systems: An Agent-Based Multi-Level Approach to Hierarchical Structural Architecture Reconstruction / Dominique Briechle, Raj Chanchad, Tobias Geger 他
日本語で読む → - 論文群制御ロボティクス
動的流れにおけるマイクロ群ロコモーション最適化:多目的マルチエージェント強化学習を用いたアプローチ
CFDと多目的マルチエージェント強化学習を組み合わせ、拍動流中のマイクロロボット群の制御ポリシーを学習し、上流進行・エネルギー効率・滑らかさを同時に最適化した。
原題: Micro-Swarm Locomotion Optimization in Dynamic Flow using Multi-Objective Multi-Agent Reinforcement Learning / Josef Berman, Oren Gal
日本語で読む → - 論文レーダー/VLMロボティクス
視覚整合4Dレーダによる天候ロバストなシーン意味理解
悪天候でも頑健な4Dレーダを用い、凍結した視覚言語モデルと整合させてシーン記述を生成する手法を提案。約700万パラメータの学習で、霧や雪のシーンでカメラを上回る性能を示した。
原題: Weather-Robust Scene Semantics with Vision-Aligned 4D Radar / Kali Hamilton, Christoffer Heckman
日本語で読む → - 論文SLAMロボティクス
低動的環境におけるマルチセッション地表面テクスチャSLAM
地表面テクスチャのみを特徴とする環境で、マルチセッションSLAMの軌跡推定精度を向上させる手法を比較し、KLダイバージェンスを用いた類似度スコアとループ閉じ込み信頼度へのバイアスが最も効果的であることを示した。また、セッション間で地面が変化するマルチセッション画像と高精度な姿勢情報を含むデータセットを公開した。
原題: Multi-Session Ground Texture SLAM in Low-Dynamic Environments / Kyle M. Hart, Brendan Englot
日本語で読む → - 論文ロボット学習基盤ロボティクス
RIO: クロスエンボディメントロボット学習のための柔軟なリアルタイムロボットI/O
多様なロボットハードウェアと形態に対応した、柔軟で軽量なロボット制御・遠隔操作・データ整形・センサ設定・ポリシー展開のためのオープンソースPythonフレームワークを提案し、VLAモデルの展開と微調整を実証した。
原題: RIO: Flexible Real-Time Robot I/O for Cross-Embodiment Robot Learning / Pablo Ortega-Kral, Eliot Xing, Arthur Bucker 他
日本語で読む → - 論文V2X通信ロボティクス
複数LED送信機とイベントカメラを用いた車両可視光通信の実環境レイテンシ解析
イベントカメラをVLC受信機として用い、複数LEDからの同時受信と実車両環境でのエンドツーエンド遅延を評価し、協調認識要件を満たすことを示した論文。
原題: Real-world Latency Analysis of Vehicular Visible Light Communication with Multiple LED Transmitters and an Event-Based Camera / Ryota Soga, Tsukasa Shimizu, Shintaro Shiba 他
日本語で読む → - 論文自己折り畳みロボット/3Dプリンティングロボティクス
受動駆動型自己折り畳みロボットの3Dプリンティングと機能モジュール統合
平らな3Dプリント導電性PLAシートに弾性バンドを通して自己折り畳みさせる手法を提案し、電子部品や磁石を配置した状態から立体構造を形成。折り角度を予測するモデルを導出し、キューブやグリッパー、腱駆動指などの応用を実証した。
原題: 3D Printing of Passively Actuated Self-Folding Robots with Integrated Functional Modules / Gaolin Ge, Qifeng Yang, Haoran Lu 他
日本語で読む → - 論文マニピュレーションロボティクス
ロボットによる机の整理:環境制約を活用した異種物体操作のためのマルチプリミティブ手法
机の上にある剛体・変形物体を収集や積み重ねなどの目的に応じて整理するタスク指向フレームワークを提案し、環境制約を利用した複数の操作プリミティブとタスクプランナーを統合した。
原題: Robotic Desk Organization: A Multi-Primitive Approach to Manipulating Heterogeneous Objects via Environmental Constraints / Yi Dong, Yangjun Liu, Jinjun Duan 他
日本語で読む → - 論文模倣学習ロボティクス
失敗デモデータの活用法:注意機構の分布差を利用した模倣学習の効果的データ選択
成功デモのみで訓練されることが多い模倣学習において、収集時に得られる失敗データを注意機構に組み込むことで活用し、初期観察から適切なモードを選択して行動安定性を向上させる手法を提案。さらに、失敗サンプルと成功デモ間の注意差を定量化する指標で学習に有益な失敗データを選別する。
原題: How to Utilize Failure Demo Data?: Effective Data Selection for Imitation Learning Using Distribution Differences in Attention Mechanism / Kana Miyamoto, Kanata Suzuki, Tetsuya Ogata
日本語で読む → - 論文マニピュレーションロボティクス
反復作業を含む建設活動のための操作計画
VR環境での単一デモンストレーションから建設作業の操作スキルを獲得し、スクリュー運動の幾何学を用いて反復的な建設タスクをロボットで実行する手法を提案した。
原題: Manipulation Planning for Construction Activities with Repetitive Tasks / Wangyi Liu, Dasharadhan Mahalingam, Fanru Gao 他
日本語で読む → - 論文模倣学習/データ生成ロボティクス
模倣学習のための高忠実度合成デモンストレーション生成の原理的アプローチ
3Dガウススプラッティングと動的運動プリミティブを組み合わせ、専門家の軌道構造を保ちつつ多様な合成デモを生成するフレームワークを提案。障害物回避も考慮し、接触を伴う操作タスクの学習に有効なデータを生成する。
原題: A Principled Approach for Creating High-fidelity Synthetic Demonstrations for Imitation Learning / Moniruzzaman Akash, Momotaz Begum
日本語で読む → - 論文実験自動化AI
プロンプトからプロトコルへ:実験室自動化のためのAIエージェント
大規模言語モデルと実験室オーケストレーションを統合し、自然言語で実験プロトコルの作成・監視・分析を可能にするAIエージェントを提案。シミュレーション実験で97%の成功率と操作削減を達成。
原題: From Prompts to Protocols: An AI Agent for Laboratory Automation / Angelos Angelopoulos, James F. Cahoon, Ron Alterovitz
日本語で読む → - 論文校正ロボティクス
AX=YB問題に対する不確実性を考慮した最適校正法
ハンドアイ校正問題に対し、Lie代数に基づく反復最適化で大域的最適解を近似し、データの不確実性を明示的にモデル化せずに相対不確実性指標で反復を動的調整する手法を提案。高不確実性条件下で精度を大幅に向上させた。
原題: Optimal Uncertainty-Aware Calibration for the AX=YB Problem / Yanjia Chen, Xiangfei Li, Huan Zhao 他
日本語で読む → - 論文医療ロボティクスロボティクス
解剖学的ランドマーク誘導による深層強化学習を用いた自律的胃内ナビゲーション
カプセル内視鏡の胃内ナビゲーションを、解剖学的ランドマークを利用した深層強化学習で自律化し、シミュレーションと実環境で高い被覆率と短時間化を達成した。
原題: Anatomical Landmark-Guided Deep Reinforcement Learning for Autonomous Gastric Navigation / Haoxuan Wu, Sishen Yuan, Haitao Gao 他
日本語で読む → - 論文ナビゲーションワールドモデル画像認識
アンカー付きエピポーラガイダンスによるドリフト耐性ナビゲーションワールドモデル
逐次ロールアウトによるノイズ蓄積と幾何学的ドリフトを防ぐため、疎な未来アンカーを予測し、その間のフレームを生成する新しいワールドモデルを提案。双方向エピポーラ幾何でアンカーを拘束し、長期的な視覚品質と幾何的一貫性を向上させた。
原題: Drift-Resistant Navigation World Model with Anchored Epipolar Guidance / Po-Chien Luan, Zimin Xia, Wuyang Li 他
日本語で読む → - 論文ロボット操作cs.CR
求めていたものではない:家庭用ロボット操作におけるタイポグラフィ攻撃
家庭用ロボットの操作パイプライン全体に対するタイポグラフィ攻撃の影響を、HabitatシミュレーションとHomeRobotベンチマークで評価し、攻撃成功率67.8%で誤った物体を物理的に掴んで運ぶことを実証した。
原題: Not What You Asked For: Typographic Attacks in Household Robot Manipulation / Ali Iranmanesh, Peng Liu
日本語で読む → - 論文SLAMロボティクス
GPS非依存・劣化環境下でのUAVナビゲーションのためのロバストなビジュアルSLAM:マルチパラダイム評価と実装研究
GPSが使えず視覚が劣化した環境でのUAV自己位置推定のために、古典的・深層学習・リカレント・ViTなど5つのV-SLAMシステムを比較評価し、劣化条件下でのロバスト性と組み込み実装の指針を示した論文。
原題: Robust Visual SLAM for UAV Navigation in GPS-Denied and Degraded Environments: A Multi-Paradigm Evaluation and Deployment Study / Prasoon Kumar, Akshay Deepak, Sandeep Kumar
日本語で読む → - 論文計画ロボティクス
信念空間における軌道ツリーの最適化:モデル予測制御からタスク・動作計画への応用
部分観測ロボット計画問題において、逐次軌道ではなく分岐を持つ軌道ツリーを信念空間で最適化する手法を提案し、MPCとTAMPの両方で有効性を示した。
原題: Optimizing Trajectory-Trees in Belief Space: An Application from Model Predictive Control to Task and Motion Planning / Camille Phiquepal, Marc Toussaint
日本語で読む → - 論文群制御AI
ミッションを伝えれば群れが動く:Web-of-Dronesにおけるエージェント強化LLM推論
自然言語でミッションを指示するとUAV群が自律実行する、LLMベースの群制御フレームワークを提案・評価した論文。
原題: Say the Mission, Execute the Swarm: Agent-Enhanced LLM Reasoning in the Web-of-Drones / Andrea Iannoli, Lorenzo Gigli, Luca Sciullo 他
日本語で読む → - 論文連続体ロボットロボティクス
腱駆動連続体ロボットのデータ駆動動的モデリング
腱駆動連続体ロボットの非線形で高次元な動力学を、N4SID、ARX、SINDYcなどのデータ駆動システム同定手法で比較し、2自由度モデルで精度良く表現できることを示した。モデル予測制御にも適用し実時間制御の可能性を実証した。
原題: Data-Driven Dynamic Modeling of a Tendon-Actuated Continuum Robot / Harald Minde Hansen, Bjørn Kåre Sæbø, Kristin Y. Pettersen 他
日本語で読む → - 論文3次元復元画像認識
TriP: 三角形パズルによる頑健な並進平均化手法
カメラ位置復元のための並進平均化問題に対し、三角形の幾何から局所スケールを推定し、対数領域で同期させることで、外れ値に頑健で高精度な解法を提案した。
原題: TriP: A Triangle Puzzle Approach to Robust Translation Averaging / Zhekai Fan, Wanze Li, Jinxin Wang 他
日本語で読む → - 論文制御/蒸留ロボティクス
拡散モデルを用いた動的ニューラルクープマン蒸留によるリアルタイムロボット制御
拡散モデルの反復ノイズ除去による遅延を解消するため、多段階推論を単一パスに蒸留しつつ多様性を保つフレームワークを提案し、D4RLベンチマークと実機で高速な閉ループ制御を実証した。
原題: Dynamic Neural Koopman Distillation for Real-Time Robot Control Using Diffusion Models / Lei Zheng, Peiqi Yu, Zengqi Peng 他
日本語で読む → - 論文VLAロボティクス
WorldVLN: 空中視覚言語ナビゲーションのための自己回帰的世界行動モデル
空中VLNを予測駆動の世界行動問題として捉え、自己回帰ビデオバックボーンで世界状態遷移を予測し、実行可能なウェイポイント行動に直接デコードする初のモデルWorldVLNを提案。2段階訓練と強化学習により、ベンチマークで12%以上の成功率向上を達成し、実ドローンへのゼロショット転送も実証。
原題: WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation / Baining Zhao, Jiacheng Xu, Weicheng Feng 他
日本語で読む → - 論文触覚ロボティクス
EITと空気圧を組み合わせたハイブリッドロボット皮膚による高精度な力分布再構成
3Dプリントとスプレーコーティングで作製した、電気インピーダンス断層撮影(EIT)と空気圧触覚センシングを組み合わせたロボット皮膚を提案し、力の再構成精度を向上させた。
原題: EIT-Pneumatic Hybrid Robotic Skin for Practical and Accurate Force Map Reconstruction / Junhwi Cho, Sunggyu Bae, Junghyeon Ma 他
日本語で読む → - 論文マニピュレーションロボティクス
想像された未来から実行可能な行動へ:ロボット操作のための潜在行動の混合
ビデオ生成モデルによる未来予測をロボット操作に活用する際、予測フレームを直接ポリシーに渡すのではなく、複数の逆動力学モデルを用いて潜在行動の混合表現に変換する制御指向インターフェースMoLAを提案し、シミュレーションと実機で性能向上を確認した。
原題: From Imagined Futures to Executable Actions: Mixture of Latent Actions for Robot Manipulation / Yajie Li, Bozhou Zhang, Chun Gu 他
日本語で読む → - 論文探索ロボティクス
段階的到達可能グラフと構造事前情報を用いた地上ロボットの多階探索
多階建物内での地上ロボットの自律探索を、到達可能な支持面を表す疎なグラフを段階的に構築し、階間の接続性を仮説的に保持することで効率的に行う手法を提案した。
原題: Multi-Floor Exploration for Ground Robots via an Incremental Reachable Graph and Structural Priors / Zhiwen Zhu, Jiaqi Chen, Xiangyi Huang 他
日本語で読む → - 論文自動運転/リスクマップロボティクス
部分観測環境における自動運転のための統合リスクマップ学習
自動運転における遮蔽によるリスクを、交通流リスクと衝突リスクを統合したリスクマップとしてモデル化・学習し、拡散モデルによる敵対的シナリオ生成も組み合わせて、部分観測下でのリスク認識計画を実現した。
原題: Learning A Unified Risk Map for Autonomous Driving in Partially Observable Environments / Jie Jia, Yaofeng Su, Zeyu Bao 他
日本語で読む → - 論文VLAAI
身体化LLMの探求:観測精度の向上が問題解決を妨げる場合
ロボットに組み込んだLLMエージェントの観測情報を変えて実験し、生のRGB入力が最も性能が良く、完全な真値観測では逆に悪化することを発見。シミュレーションでノイズが性能向上に寄与することを示した。
原題: Probing Embodied LLMs: When Higher Observation Fidelity Hurts Problem Solving / Oussama Zenkri, Oliver Brock
日本語で読む → - 論文触覚ロボティクス
高精細触覚知覚のための微分可能シミュレーションを用いた低次元ニューラルモデリング
高解像度の触覚シミュレーションを効率化するため、粗いMPMシミュレーションとニューラルデコーダを組み合わせ、粒子以下の触覚詳細を再構成する低次元ニューラルフレームワークを提案した。
原題: Reduced-order Neural Modeling with Differentiable Simulation for High-Detail Tactile Perception / Yuhu Guo, Zhikai Shen, Jiasheng Qu 他
日本語で読む → - 論文自動運転/強化学習画像認識
MTA-RL: マルチモーダルトランスフォーマーによる3Dアフォーダンスと強化学習を用いた堅牢な都市運転
RGB画像とLiDAR点群をトランスフォーマーで融合し、幾何学的な3Dアフォーダンスを予測して強化学習の観測空間とすることで、解釈可能でサンプル効率の高い都市自動運転を実現した。CARLAシミュレーションでゼロショット汎化性能が向上することを示した。
原題: MTA-RL: Robust Urban Driving via Multi-modal Transformer-based 3D Affordances and Reinforcement Learning / Guangli Chen, Dianzhao Li, Wenjian Zhong 他
日本語で読む →