論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文イベントカメラ/運動予測画像認識
E-TIDE: イベント列からの高速で構造を保つ運動予測
イベントカメラのデータから将来のイベント表現を予測する軽量なエンドツーエンドモデルを提案し、大規模事前学習なしで競争力のある性能を実現した。
原題: E-TIDE: Fast, Structure-Preserving Motion Forecasting from Event Sequences / Biswadeep Sen, Benoit R. Cottereau, Nicolas Cuperlier 他
日本語で読む → - 論文VLA画像認識
生成モデルは空間を理解している:暗黙の3D事前知識を活用したシーン理解
動画生成モデルが内部に持つ暗黙の3D構造・物理の事前知識を抽出し、マルチモーダル大規模言語モデルに組み込むことで、明示的な3D教師なしに空間推論や操作タスクの性能を高めるフレームワークVEGA-3Dを提案した。
原題: Generation Models Know Space: Unleashing Implicit 3D Priors for Scene Understanding / Xianjin Wu, Dingkang Liang, Tianrui Feng 他
日本語で読む → - 論文マニピュレーションロボティクス
LDHP: ライブラリ駆動型階層計画による非把持巧緻マニピュレーション
把持できない物体の操作に向け、接触状態計画と把持計画を階層化し、実行可能性を保証するライブラリ駆動型プランナを提案。実機で持ち上げや挿入タスクの頑健性を示した。
原題: LDHP: Library-Driven Hierarchical Planning for Non-prehensile Dexterous Manipulation / Tierui He, Jiahui Zuo, Fumin Zhang 他
日本語で読む → - 論文ナビゲーションロボティクス
認定ニューラルHamilton-Jacobi到達可能性による偶発事象を考慮した計画
未知環境での多目標ナビゲーションのために、学習ベースの到達可能性とサンプリングベースの計画を統合し、安全性を保証するフレームワークを提案した。
原題: Contingency-Aware Planning via Certified Neural Hamilton-Jacobi Reachability / Kasidit Muenprasitivej, Derya Aksaray
日本語で読む → - 論文データ生成ロボティクス
RADAR: 意味的計画と自律的因果環境リセットによる閉ループロボットデータ生成
VLMによるタスク生成とGNN方策、自動成功判定、FSMによる環境リセットを組み合わせ、人手を介さずロボット操作データを収集し続ける閉ループシステムを提案。
原題: RADAR: Closed-Loop Robotic Data Generation via Semantic Planning and Autonomous Causal Environment Reset / Yongzhong Wang, Keyu Zhu, Yong Zhong 他
日本語で読む → - 論文歩行ロボティクス
データ駆動型物理埋め込みダイナミクスと予測制御・強化学習による四足歩行
ラグランジュニューラルネットワークを強化学習とモデル予測制御に統合し、四足歩行の物理的に整合したダイナミクス学習と効率的な実時間計画を実現した。
原題: Data-Driven Physics Embedded Dynamics with Predictive Control and Reinforcement Learning for Quadrupeds / Prakrut Kotecha, Aditya Shirwatkar, Shishir Kolathaya
日本語で読む → - 論文アフォーダンス推論画像認識
arg-VU: ロボット手術の視覚理解のための物理認識3D幾何によるアフォーダンス推論
3Dガウシアンスプラッティングと拡張位置ベースダイナミクスを組み合わせ、変形する手術組織の物理的に整合したアフォーダンス推論を実現するフレームワークを提案。
原題: arg-VU: Affordance Reasoning with Physics-Aware 3D Geometry for Visual Understanding in Robotic Surgery / Nan Xiao, Yunxin Fan, Farong Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
TransDex: 透明物体の巧みな操作のための点群再構成による視触覚ポリシーの事前学習
透明物体操作時の自己遮蔽や深度ノイズに対処するため、Transformerベースの自己教師あり点群再構成で事前学習した3D視触覚融合ポリシーを提案し、実機実験で既存手法を上回る性能を示した。
原題: TransDex: Pre-training Visuo-Tactile Policy with Point Cloud Reconstruction for Dexterous Manipulation of Transparent Objects / Fengguan Li, Yifan Ma, Chen Qian 他
日本語で読む → - 論文VLA画像認識
HiMemVLN:階層的記憶システムによるオープンソースゼロショット視覚言語ナビゲーションの信頼性向上
オープンソースLLMを用いた視覚言語ナビゲーションにおける「ナビゲーション健忘」問題を分析し、階層的記憶システムを導入することで性能を約2倍に改善した研究。
原題: HiMemVLN: Enhancing Reliability of Open-Source Zero-Shot Vision-and-Language Navigation with Hierarchical Memory System / Kailin Lyu, Kangyi Wu, Pengna Li 他
日本語で読む → - 論文ソフトロボティクスロボティクス
多セグメント再構成可能なモジュール式ケーブル駆動ソフトロボットアーム
積み重ね可能なモジュール式ケーブル駆動ソフトアームを提案し、セグメント数を増やすことで作業空間を大幅に拡大できることを実証した。また、シリコンの硬さが柔軟性と剛性のトレードオフに与える影響を調べた。
原題: A Novel Modular Cable-Driven Soft Robotic Arm with Multi-Segment Reconfigurability / Moeen Ul Islam, Cheng Ouyang, Xinda Qi 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルのための触覚モダリティ融合
視覚言語行動モデルに触覚信号を軽量に統合するTacFiLMを提案し、接触を伴う挿入・引き出しタスクで成功率や力の安定性を改善した。
原題: Tactile Modality Fusion for Vision-Language-Action Models / Charlotte Morissette, Amin Abyaneh, Wei-Di Chang 他
日本語で読む → - 論文自動運転/安全性ロボティクス
VLAベース運転システムのための安全ケースパターン:SimLingoからの洞察
VLAベースの自動運転システム向けに、安全ケース設計手法RAISEを提案し、SimLingoの事例で安全性主張の構築を実証した論文。
原題: Safety Case Patterns for VLA-based driving systems: Insights from SimLingo / Gerhard Yu, Fuyuki Ishikawa, Oluwafemi Odu 他
日本語で読む → - 論文VLAロボティクス
DIAL: 潜在世界モデリングによる意図と行動の分離を用いたエンドツーエンドVLA
VLAモデルにおいて、高次意思決定と低次運動実行を潜在意図ボトルネックで橋渡しし、VLMの潜在空間で未来予測を行い、軽量ポリシーで行動を生成する枠組みを提案した。
原題: DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA / Yi Chen, Yuying Ge, Hui Zhou 他
日本語で読む → - 論文自動運転ロボティクス
PRAM-R:LLM誘導モダリティルーティングによる適応的自動運転のための知覚-推論-行動-記憶フレームワーク
自動運転のマルチモーダル知覚を効率化するため、LLMが環境に応じてセンサモダリティを選択・重み付けするフレームワークを提案し、計算コスト削減と精度維持を実証した。
原題: PRAM-R: A Perception-Reasoning-Action-Memory Framework with LLM-Guided Modality Routing for Adaptive Autonomous Driving / Yi Zhang, Xian Zhang, Saisi Zhao 他
日本語で読む → - 論文制約付き生成機械学習
事前学習生成モデルの橋渡しによる制約付き生成の改善
複雑な実世界の制約領域内でサンプルを生成するため、事前学習済み生成モデルを微調整して制約を満たしつつ現実性を保つ手法を提案した。
原題: Improved Constrained Generation by Bridging Pretrained Generative Models / Xiaoxuan Liang, Saeid Naderiparizi, Yunpeng Liu 他
日本語で読む → - 論文飛行制御/外乱抑制ロボティクス
GustPilot: 風外乱に強いクアッドロータ航法のための階層型DRL-INDIフレームワーク
深層強化学習による速度指令生成とINDI制御による外乱抑制を組み合わせ、50gの小型ドローンで風のある環境でも高い成功率を実現した。
原題: GustPilot: A Hierarchical DRL-INDI Framework for Wind-Resilient Quadrotor Navigation / Amir Atef Habel, Roohan Ahmed Khan, Fawad Mehboob 他
日本語で読む → - 論文ヒューマノイド動作生成ロボティクス
PhyGile: 物理プレフィックス誘導による俊敏な汎用人型ロボット動作追従のための動作生成
物理誘導プレフィックスを用いて人型ロボットのネイティブ動作を直接生成し、汎用動作追従コントローラと組み合わせることで、実機で俊敏かつ安定した全身動作を実現するフレームワークを提案した。
原題: PhyGile: Physics-Prefix Guided Motion Generation for Agile General Humanoid Motion Tracking / Jiacheng Bao, Haoran Yang, Yucheng Xin 他
日本語で読む → - 論文VLAロボティクス
黄金のチケット:単一のノイズベクトルで生成ロボットポリシーを改善
事前学習済みの拡散・フローマッチングポリシーに対し、ガウス分布から毎回サンプリングする代わりに固定の初期ノイズ(黄金のチケット)を与えることで、追加学習なしにタスク成功率を向上させる手法を提案。
原題: You've Got a Golden Ticket: Improving Generative Robot Policies With A Single Noise Vector / Omkar Patil, Ondrej Biza, Thomas Weng 他
日本語で読む → - 論文360度映像ストリーミングcs.NI
意味的ポテンシャル場による訓練不要の適応型360度映像ストリーミング
意味的物体が視線を引き寄せるポテンシャル場としてビューポート予測を定式化し、訓練不要で適応型360度映像ストリーミングを実現するフレームワークOrbitStreamを提案した。
原題: Training-Free Adaptive 360-degree Video Streaming via Semantic Potential Fields / Aizierjiang Aiersilan, Zhangfei Yang
日本語で読む → - 論文VLAロボティクス
HapticVLA: 推論時触覚センシング不要のVision-Language-Actionモデルによる接触リッチマニピュレーション
触覚をオフラインで学習し、推論時には触覚センサなしで接触を伴う器用な操作を実現するVLAモデルを提案。実世界実験で86.7%の成功率を達成。
原題: HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing / Konstantin Gubernatorov, Mikhail Sannikov, Ilya Mikhalchuk 他
日本語で読む → - 論文人間参加型最適化ロボティクス
人間参加型パレート最適化:必要時支援トレーニングと性能評価のためのトレードオフ特性評価
運動技能訓練やリハビリにおいて、課題難易度とユーザー性能のトレードオフを、人間参加型のベイズ多基準最適化で効率的に特性評価する手法を提案し、触覚フィードバックを用いた手動技能訓練のユーザー研究で有効性を示した。
原題: Human-in-the-Loop Pareto Optimization: Trade-off Characterization for Assist-as-Needed Training and Performance Evaluation / Harun Tolasa, Volkan Patoglu
日本語で読む → - 論文歩行ロボティクス
CASSR: 到達可能性に基づく連続A*探索によるリアルタイム足踏み計画
二足歩行ロボットの足踏み計画を、連続的な運動学的制約をA*探索内で再帰的に伝播させることで高速化し、最大30歩の接触列を125ms未満で計画する手法を提案した。
原題: CASSR: Continuous A-Star Search through Reachability for real time footstep planning / Jiayi Wang, Steve Tonneau
日本語で読む → - 論文衛星観測計画ロボティクス
静止衛星データと階層的計画を用いた衛星観測の動的ターゲティング
衛星観測の動的ターゲティング性能を向上させるため、静止衛星からの補助データを活用し、階層的計画手法を導入した。従来のオンセンサー予測データのみを用いる手法と比較し、最大で性能が向上することを示した。
原題: Dynamic Targeting of Satellite Observations Using Supplemental Geostationary Satellite Data and Hierarchical Planning / Akseli Kangaslahti, Itai Zilberstein, Alberto Candela 他
日本語で読む → - 論文劣駆動ロボット制御ロボティクス
振動抑制の観点からの微分平坦な劣駆動平面ロボットの最適制御
微分平坦性を持つ劣駆動平面ロボットにおいて、最適制御を用いて軌道計画を行い、受動関節の剛性・減衰の変動に対するロバスト性を高め、残留振動を低減する手法を提案した。
原題: Optimal control of differentially flat underactuated planar robots in the perspective of oscillation mitigation / Stefano Lovato, Michele Tonan, Matteo Bottin 他
日本語で読む → - 論文軌道最適化ロボティクス
DRAFTO: ロボットマニピュレータのための分離縮小空間と適応的実現可能性修復を用いた軌道最適化
滑らかさ、安全性、関節限界、タスク要件を考慮した軌道最適化アルゴリズムDRAFTOを提案し、関節限界の実現可能性を扱うために最適化を分離し、高効率で信頼性の高い軌道生成を実現した。
原題: DRAFTO: Decoupled Reduced-space and Adaptive Feasibility-repair Trajectory Optimization for Robotic Manipulators / Yichang Feng, Xiao Liang, Minghui Zheng
日本語で読む → - 論文強化学習/交通制御機械学習
RE-SAC: バス群制御における偶然不確実性と認識不確実性の分離 — 安定でロバストなアンサンブル深層強化学習アプローチ
バス運行の待機制御において、偶然不確実性と認識不確実性を明示的に分離するアンサンブルSACを提案し、Q値の不安定化を抑えて希少状態での推定誤差を最大62%削減した。
原題: RE-SAC: Disentangling aleatoric and epistemic risks in bus fleet control: A stable and robust ensemble DRL approach / Yifan Zhang, Liang Zheng
日本語で読む → - 論文群制御ロボティクス
予測時空間観測と深層強化学習による分散型エンドツーエンド多機追跡
LiDAR生データから直接制御指令を生成する分散型MARLフレームワークを提案し、予測時空間観測により障害物回避と動的目標の包囲を実現、実機ドローン群で検証した。
原題: Decentralized End-to-End Multi-AAV Pursuit Using Predictive Spatio-Temporal Observation via Deep Reinforcement Learning / Yude Li, Zhexuan Zhou, Huizhe Li 他
日本語で読む → - 論文VLAロボティクス
世界行動モデルはVLAより汎化するのか?ロバスト性の比較研究
VLAと世界行動モデル(WAM)をLIBERO-PlusやRoboTwin 2.0-Plusで視覚・言語の摂動下に比較し、WAMの高いロバスト性を示した研究。
原題: Do World Action Models Generalize Better than VLAs? A Robustness Study / Zhanguang Zhang, Zhiyuan Li, Behnam Rahmati 他
日本語で読む → - 論文世界モデルロボティクス
EVA: 逆動力学報酬による実行可能ロボット行動へのビデオ世界モデル整合
ビデオ生成モデルをロボットの世界モデルとして使う際、生成映像が物理的に実行可能な行動に変換されるよう、逆動力学モデルを報酬として強化学習で整合させる手法を提案した。
原題: EVA: Aligning Video World Models with Executable Robot Actions via Inverse Dynamics Rewards / Ruixiang Wang, Qingming Liu, Yueci Deng 他
日本語で読む → - 論文群制御ロボティクス
ネットワークコーディングをマルチロボットシステムに導入:無線通信上の自律システムの相互作用研究
無線通信の遅延や損失に対応するため、適応的ネットワークコーディングをマルチロボットシステムに適用し、協調位置推定と安全な追い越しの事例で有効性を示した。
原題: Bringing Network Coding into Multi-Robot Systems: Interplay Study for Autonomous Systems over Wireless Communications / Anil Zaher, Kiril Solovey, Alejandro Cohen
日本語で読む →