論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
Efficient-WAM: 低コストな未来想像を備えた10億パラメータの世界行動モデル
未来の視覚予測を圧縮し、推論コストを大幅に削減した世界行動モデルを提案。実機で約100msの低遅延を実現しつつ、制御性能を維持する。
原題: Efficient-WAM: A 1B-Parameter World-Action Model with Low-Cost Future Imagination / Jiajun Li, Tiecheng Guo, Yifan Ye 他
日本語で読む → - 論文歩行ロボティクス
GuideWalk: 多様な地形を横断する人型ロボットのための統合型自律ナビゲーションと移動学習
人型ロボットが多様な地形で障害物を回避しながら安定して移動できるよう、ナビゲーションと移動を統合したエンドツーエンドのフレームワークを提案した。
原題: GuideWalk: Learning Unified Autonomous Navigation and Locomotion for Humanoid Robots across Versatile Terrains / Haoxuan Han, Chen Chen, Linao Gong 他
日本語で読む → - 論文データセット/触覚/模倣学習ロボティクス
HapTile: 接触を伴う模倣学習のための触覚情報を統合した視覚・触覚・言語・行動データセット
接触を伴う操作タスクの模倣学習向けに、指先触覚とオペレータへの触覚フィードバックを統合した視覚・触覚・言語・行動データセットを構築し、ベンチマーク評価も行った。
原題: HapTile: A Haptic-Informed Vision-Tactile-Language-Action Dataset for Contact-Rich Imitation Learning / Amirhosein Alian, Yongqiang Zhao, Shiyi Gu 他
日本語で読む → - 論文安全強化学習機械学習
滑らかな安全性構造化ポリシー合成による安全なオンライン学習
安全性監視と介入を行動生成に統合したポリシーアーキテクチャAutoSafeを提案し、性能追求と安全確保の行動を滑らかに切り替えることで、学習の滑らかさを保ちつつ安全性を確保する。
原題: Safe Online Learning via Smooth Safety-Structured Policy Composition / Hongpeng Cao, Liqun Zhao, Yuliang Gu 他
日本語で読む → - 論文UAV着陸/強化学習画像認識
マルチモーダルエージェントAIと能動的波浪補償による海事プラットフォームへの堅牢なUAV自律着陸
波浪による動揺を補償する安定化プラットフォームを備えたUSVと、強化学習エージェントで制御されるUAVを連携させ、海事プラットフォームへの安全な自律着陸を実現する枠組みを提案した。
原題: Robust Autonomous UAV Landing on Maritime Platforms via Multimodal Agentic AI and Active Wave Compensation / Francisco S. Neves, Pedro N. Pereira, Raul D. S. G. Campilho 他
日本語で読む → - 論文医療ロボティクスロボティクス
視触覚と明示的な力制御を用いた腹部ボリューム再構成のためのロボット超音波診断
専門医の走査動作と力データを記録・再生し、ステレオ視と剛性計測で患者の腹部形状を把握しながら、力制御でプローブを密着させて自律的に腹部スキャンを行うシステムを構築した。
原題: Visuotactile and Explicitly Force-Controlled Robotic Ultrasound for Abdominal Volumetric Reconstruction / Adrian Piedra, R Brooke Jeffrey, Oussama Khatib
日本語で読む → - 論文システム同定ロボティクス
RigPI: VLMシード付き微分可能シミュレーションによる剛体の動的パラメータ同定
ロボットと物体の相互作用中に、剛体や多リンク剛体の慣性・摩擦パラメータを、視覚言語モデルによる初期化と微分可能シミュレーションの勾配情報を用いて正確に同定するフレームワークを提案した。
原題: RigPI: Dynamic Parameter Identification of Rigid Body via VLM-Seeded Differentiable Simulation / Xincheng He, Rongrong Zhang, Wei Jiang 他
日本語で読む → - 論文マニピュレーションロボティクス
行動プロンプト方策:操作のためのデモンストレーションをプロンプトとして活用
単一の人間のデモンストレーションをプロンプトとして用い、推論時に新しいタスクを実行できるロボットのパラダイムを提案。新しいアーキテクチャ、データ収集インターフェース、評価ベンチマークを導入し、微調整なしで新しいスキルを教える柔軟な方法を示した。
原題: Behavior Prompting Policy: Demonstrations as Prompts for Manipulation / Austin Patel, Ben Pekarek, Joel Enrique Castro Hernandez 他
日本語で読む → - 論文触覚/操作ロボティクス
触覚対応ワールドアクションモデル:非対称注意による触覚統合
接触を伴う操作タスクで、視覚と触覚を統合した世界行動モデルを提案。触覚トークンが視覚ダイナミクスを乱す問題を非対称注意機構で解決し、実ロボットで成功率を向上させた。
原題: Tactile-WAM: Touch-Aware World Action Model with Tactile Asymmetric Attention / Siyu Wu, Linjing You, Junjie Zhu 他
日本語で読む → - 論文操作学習ロボティクス
Dexterity-BEV: 3D世界と行動の整合による汎用ロボットポリシー学習
2D基盤モデルの限界を克服するため、カメラ校正と深度を用いて2D入力を3D頂点マップに変換し、BEV座標系で入力と行動を整合させることで、視点変化に頑健で汎用的な操作ポリシーを学習する手法を提案した。
原題: Dexterity-BEV: Aligning 3D World and Actions for Generalizable Robot Policies Learning / Huayi Zhou, Wei Gao, Dekun Lu 他
日本語で読む → - 論文両手操作/データ生成/強化学習ロボティクス
言語条件付き両手巧緻操作のための強化学習によるスケーラブルなマルチタスクデータ生成
両手巧緻操作の汎用ポリシー学習に必要な大規模データを、強化学習と汎用報酬設計・ドメインランダム化・言語注釈を組み合わせたパイプラインでシミュレーション生成し、マルチタスク学習の汎化性能を向上させた。
原題: Scalable Multi-Task Data Generation via Reinforcement Learning for Language-Conditioned Bimanual Dexterous Manipulation / Zechu Li, Yufeng Jin, Puze Liu 他
日本語で読む → - 論文データエンジン/ロボット学習ロボティクス
EgoInfinity: ウェブ規模の4D手と物体のインタラクションデータエンジンによる任意視点ロボット再ターゲティングとビデオから行動へのロボット学習
インターネット上の人間の操作ビデオを、ロボットの学習に使える4D手と物体のインタラクションデータに自動変換するモジュール式データエンジンを提案。手の軌跡や物体の6-DoF姿勢などを復元し、多様なロボット形態への動作再ターゲティングを可能にする。
原題: EgoInfinity: A Web-Scale 4D Hand-Object Interaction Data Engine for Any-View Robot Retargeting and Video-to-Action Robot Learning / Gaotian Wang, Kejia Ren, Andrew Morgan 他
日本語で読む → - 論文軌道予測機械学習
予測の訓練と推論の再考:Winner-Take-AllをGMMに結びつける
軌道予測モデルの訓練と推論の不一致を指摘し、テスト時の後処理でモード確率を改善する手法を提案した論文。
原題: Rethinking Training & Inference for Forecasting: Linking Winner-Take-All back to GMMs / Qiyuan Wu, Katie Z Luo, Bharath Hariharan 他
日本語で読む → - 論文シミュレーションベンチマークロボティクス
WireCraft: 産業用DLO操作のためのシミュレーションベンチマーク
産業用ワイヤーやケーブルなどの変形可能な線状物体(DLO)の操作を評価するためのシミュレーションベンチマークを提案し、コネクタ挿入、クリップ配線、チャネル配置の3つのタスク群と、RL・IL・VLAポリシーの比較を提供する。
原題: WireCraft: A Simulation Benchmark for Industrial DLO Manipulation / Chongyu Zhu, Ramy ElMallah, Hyegang Kim 他
日本語で読む → - 論文ナビゲーションロボティクス
意図を考慮したシーン表現による群衆中のロボット視覚ナビゲーション学習
群衆中のロボットナビゲーションにおいて、人間の意図と環境構造を考慮した視覚表現を用いた強化学習手法を提案し、シミュレーションと実環境で優れた性能を示した。
原題: Learning Robot Visual Navigation in Crowds via Intention-Aware Scene Representations / Han Bao, Bingyi Xia, Hanjing Ye 他
日本語で読む → - 論文VIOロボティクス
Sphere-VIO: 統一球面表現による異種マルチカメラシステム向けの高速で堅牢な視覚慣性オドメトリ
異なるカメラ構成のマルチカメラシステムに対応するため、統一球面パノラマモデルと並列加速された深度誘導トラッキングを備えた、軽量なフィルタベースのVIOフレームワークを提案した。
原題: Sphere-VIO: Fast and Robust Visual-Inertial Odometry via Unified Spherical Representation for Heterogeneous Multi-Camera Systems / Yueteng Yang, Yusen Xie, Hao Wei 他
日本語で読む → - 論文自動運転ロボティクス
単一トラックモデルの短時間位置精度:自動運転車の動作計画への影響
自動運転車の動作計画に用いる3種類の単一トラック車両モデルの短時間位置精度を実測データと比較し、モデル選択のためのトレードオフを明らかにした。
原題: Short-Horizon Position Accuracy of Single-Track Models: Implications for Motion Planning of Autonomous Vehicles / Aron J. Aertssen, Lars A. T. H. van Alen, Igo J. M. Besselink 他
日本語で読む → - 論文自動実験/プロトコル変換ロボティクス
自然言語プロトコルをロボット実験プラットフォームへ変換するためのクロスモデル検証付きデュアルエージェントフレームワーク
生物実験プロトコルを自然言語からロボット制御コマンドへ変換するエージェントベースのフレームワークを提案し、パーサーと検証エージェントの連携により精度を向上させた。
原題: Dual-Agent Framework for Cross-Model Verified Translation of Natural-Language Protocols into Robotic Laboratory Platform / Hyeonna Choi, Jung Yup Kim, Hyuneui Lim 他
日本語で読む → - 論文放射線源位置推定ロボティクス
物理ガイドによる非構造環境での任意測定経路に沿ったロボット放射線源位置推定
未知環境で測定経路に依存せず、物理情報機械学習モデルを用いて放射線源の位置を高精度に推定するロボット自動化フレームワークを提案。シミュレーションと実機実験で有効性を検証した。
原題: Physics-Guided Robotic Radiation Source Localization along Arbitrary Measurement Paths in Unstructured Environments / Hojoon Son, Kai Tan, Fan Zhang
日本語で読む → - 論文行動クローニングロボティクス
オープンデータ・訓練・評価によるスケーラブルな行動クローニング
大規模な遠隔操作データセットABC-130K(3500時間、13万エピソード)とオープンソースのハードウェア・訓練・シミュレーション基盤を公開し、行動クローニングの再現可能な研究基盤を提供した。
原題: Scalable Behavior Cloning with Open Data, Training, and Evaluation / Arthur Allshire, Himanshu Gaurav Singh, Ritvik Singh 他
日本語で読む → - 論文VLAロボティクス
Vesta: 汎用身体化推論モデル
ロボットのための単一の基盤モデルで、位置推定・空間推論・ナビゲーション・長期計画を統合し、専門モデル群を上回る性能を示した。
原題: Vesta: A Generalist Embodied Reasoning Model / Johan Bjorck, Zhiqi Li, Yunze Man 他
日本語で読む → - 論文脚ロボット/協調設計/進化計算ロボティクス
SurGE: サロゲート勾配誘導進化による並列弾性を備えた脚ロボットの協調設計
脚ロボットの弾性要素を含む協調設計を、微分可能なパイプラインから得たサロゲート勾配をCMA-ESに注入して効率化するフレームワークを提案し、シミュレーションと実機で性能を実証した。
原題: SurGE: Surrogate Gradient-guided Evolution for Co-design of Legged Robots with Parallel Elasticity / Yulun Zhuang, Yue Qin, Justin Lu 他
日本語で読む → - 論文VLAロボティクス
Hy-Embodied-0.5-VLA:視覚言語行動モデルから実世界ロボット学習スタックへ
データ収集からモデル設計、事前学習、微調整、強化学習、実機展開までを含むロボット学習の全スタックを備えたエンドツーエンドシステムを提案した論文。
原題: Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack / He Zhang, Lingzhu Xiang, Haitao Lin 他
日本語で読む → - 論文状態推定ロボティクス
スマートスケジュール型ハイブリッド(SSH)EKF-FGO状態推定
EKFによる状態伝播と定期的なバッチ最適化を組み合わせたハイブリッド状態推定において、最適化のスケジューリングが精度と計算コストのトレードオフに与える影響を実験的に評価した論文。
原題: A Smart-Scheduled Hybrid (SSH) EKF-FGO State Estimation / Eric Levy, Soosan Beheshti
日本語で読む → - 論文自動運転・人間行動モデル制御
応答マップによる自動運転車とのドライバー相互作用の特性評価
人間ドライバーの自動運転車(AV)への反応をゲーム理論に基づく応答マップでモデル化し、運転シミュレータ実験データから線形表現を用いてドライバー行動を特徴付けた。その結果、応答マップが加速行動を捉えられ、AVの譲る・譲らない・反応的という行動によってドライバー応答が有意に異なることを示した。
原題: Characterizing Driver Interactions with Autonomous Vehicles via Response Maps / Dave Broaddus, Rachel DiPirro, Chishang 他
日本語で読む → - 論文群制御ロボティクス
物理情報に基づくロボット群の創発行動のモデリングと制御
ロボット群の多段階創発行動を、物理制約付き密度場の進化として表現するマイクロ・マクロ枠組み「PhySwarm」を提案し、強化学習とPINNを組み合わせた制御器で統一的に生成する。
原題: Physics-Informed Modeling and Control of Emergent Behaviors in Robot Swarms / Zixuan Jin, Wenzhuo Zhang, Shuxian Quan 他
日本語で読む → - 論文世界モデル画像認識
ATM: 行動整合性転移行列による潜在世界モデルの診断と改善
潜在世界モデルの表現が計画に有用かどうかを、シミュレータ評価なしで軽量なプローブにより診断する行列ATMを提案し、さらにその診断信号を訓練に用いて計画性能を改善する手法も示した。
原題: ATM: Action-Consistency Transfer Matrix for Diagnosing and Improving Latent World Models / Jiaheng Chen
日本語で読む → - 論文オドメトリロボティクス
SA-LIVO: 部分空間認識による縮退処理を備えた高効率LiDAR-慣性-視覚オドメトリ
LiDARと視覚の情報を固有値分解して方向ごとにゲインを調整し、劣化環境でも頑健な自己位置推定を実現するオドメトリ手法を提案した。
原題: SA-LIVO: Efficient LiDAR-Inertial-Visual Odometry with Subspace-Aware Degeneracy Handling / Yinong Cao, Xin He, Shouzheng Zhu 他
日本語で読む → - 論文触覚/操作ロボティクス
Dream-Tac: 接触を伴うロボット操作のための統合触覚世界行動モデル
視覚と触覚を統合した世界行動モデルを提案し、接触を伴う操作タスクでの行動予測精度を向上させた。
原題: Dream-Tac: A Unified Tactile World Action Model for Contact-Rich Robot Manipulation / Yunfan Lou, Yifan Ye, Yankai Fu 他
日本語で読む → - 論文模倣学習ロボティクス
ヒューマン・アズ・ヒューマノイド:人間に合わせた身体を持つエゴ・エクソ人間ビデオからのゼロショット人型ロボット学習
人間のデモ動画を高自由度ヒューマノイドのVLA学習に使えるように、身体・センシング・行動ラベルを揃えるフレームワークを提案し、実機で検証した。
原題: Human-as-Humanoid: Enabling Zero-Shot Humanoid Learning from Ego-Exo Human Videos with Human-Aligned Embodiments / Xiaopeng Lin, Ruoqi Yang, Shijie Lian 他
日本語で読む →