論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/16 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御AI
AeroWeaver: 空中スキルを分散適応型群実行に織り込む身体性エージェントハーネス
LLMエージェントの意味的判断を個々のUAVスキルに接地し、役割条件付きローカルエージェントで分散協調とオンライン適応を実現するハーネスを提案。
原題: AeroWeaver: An Embodied-Agent Harness for Weaving Aerial Skills into Distributed, Adaptive Swarm Execution / Jiabin Lou, Yirong Yang, Haopeng Wang 他
日本語で読む → - 論文直列弾性アクチュエータロボティクス
3Dプリントねじり直列弾性アクチュエータの設計と実験的検証:安全な人間-ロボットインタラクションに向けて
3DプリントTPU製の低剛性ねじりバネを直列弾性アクチュエータに用い、トルク閾値切替式ハイブリッド位置制御で安全な人間-ロボットインタラクションを実現した。
原題: Design and Experimental Validation of a 3D Printed Torsional Series Elastic Actuator for Safe Human Robot Interaction / Joel Hidalgo Pisco, Melissa Cobos Condo, Luigi Miranda 他
日本語で読む → - 論文sim2real画像認識
日常動画から関節物体を再構成し操作を再現する実-to-シミュレーション手法
単眼RGB動画から、ドアや引き出しなどの関節物体のリンク分割・関節推定・3D再構成を行い、手の動きと合わせてシミュレーション上で操作を再現するフレームワークを提案。
原題: Track, Articulate, Act: Generating Articulation from Casual Human Videos / Jiaming Zhang, Homanga Bharadhwaj
日本語で読む → - 論文VLA画像認識
CSWAM: 世界行動モデルの分布外汎化のための因果意味表現の改善
V-JEPA 2.1をベースにした因果意味エキスパートをFastWAMに追加し、見たことのない環境や物体でもロボット行動を汎化させる手法を提案。
原題: CSWAM: Better Causal Semantic Representations for Out-of-Distribution Generalization in World Action Models / Tianbin Liu, Jian Zhu, Taiyi Su 他
日本語で読む → - 論文移動ロボット設計ロボティクス
A3P5 NEMESIS:環境偵察とロボットサンプリングのための統合ローバー設計と再現可能な移動解析・外部データ機械学習キャリブレーションベンチマーク
4輪ローバーA3P5 NEMESISの設計を写真から再構築し、サブシステム構成と移動性能を解析的に評価するとともに、公開データを用いた機械学習キャリブレーションのベンチマークを提示した。
原題: A3P5 NEMESIS Integrated Rover Design for Environmental Reconnaissance and Robotic Sampling with Reproducible Mobility Analysis and an External Data Machine Learning Calibration Benchmark / Shafi Bin Sultan, Sabik Bin Sultan, Safwan Sadad
日本語で読む → - 論文VLAロボティクス
M²Tok: 視覚言語行動モデルのためのマルチヘッド・マルチコードブック離散行動トークン化
連続的な行動信号を複数のヘッドと独立したコードブックで離散トークン化し、再構成誤差を抑えつつVLAモデルの性能を向上させる手法を提案。
原題: ${M}^2$Tok: Multi-head Multi-codebook Discrete Action Tokenization for Vision-Language-Action Models / Chunpu Xu, Zhixuan Liang, Yuhao Zhang 他
日本語で読む → - 論文VLAロボティクス
GR00T N1.7向けワンステップドリフティングアクションヘッドの技術報告
VLAポリシーの拡散トランスフォーマーアクションヘッドをワンステップのドリフティングヘッドに置き換え、推論速度が大幅に向上する一方でタスク成功率が系統的に低下する速度と成功率のトレードオフを報告した。
原題: Technical Report: One-Step Drifting Action Heads for GR00T N1.7 / Xihe Shao
日本語で読む → - 論文物理的ヒューマンロボットインタラクションロボティクス
柔軟要素を組み込んだロボットアームによる人間とロボットの握手における安全性と快適性の知覚向上
ロボットアームの関節に直列弾性アクチュエータ(SEA)を導入し、剛体関節と比較して握手時の安全性・快適性の知覚が向上することを実験的に示した研究。
原題: Enhancing the Perception of Safety and Comfort during Physical Human-Robot Handshake Interactions by Integrating Flexible Elements into a Robotic Arm / Joel Hidalgo, Dennys Paillacho, Melissa Cobos 他
日本語で読む → - 論文物性推定画像認識
PhysVGGT: 単一画像からのフィードフォワード高密度物性推定
1枚のRGB画像から摩擦係数・硬さ・ヤング率・密度の高密度マップと物体質量を1回の順伝播で予測するモデルを提案し、擬似ラベル生成により大規模弱教師学習を可能にした。
原題: PhysVGGT: Feed-Forward Dense Physical Property Estimation from A Single Image / Sneha Paul, Guile Wu, Bingbing Liu 他
日本語で読む → - 論文SLAMロボティクス
SOL-SLAM: ソナーのみで高速な局所SLAMを実現する逆合成ガウス・ニュートン直接位置合わせ
前方監視ソナー(FLS)の音響強度スキャンを密に直接位置合わせし、逆合成ガウス・ニュートン法でリアルタイムに局所地図を更新するソナーのみの局所SLAMを提案。AUV実機実験でサブメートル精度を達成。
原題: SOL-SLAM: Inverse Compositional Gauss-Newton Direct Registration for Fast Sonar-Only Local SLAM / Kalvik Jakkala, Jason O'Kane
日本語で読む → - 論文マニピュレーションロボティクス
RAFAIL: ロボットマニピュレーションにおける関係性に着目した失敗検出
VLMで成功デモを注釈付けし、タスクに関連するエンティティ間の関係性の異常を検出することで、失敗データなしにロボット操作の実行失敗を検出するフレームワークを提案。
原題: RAFAIL: Relationship-Aware Failure Detection for Robotic Manipulation / Loris Schneider, Edgar Welte, Rania Rayyes
日本語で読む → - 論文強化学習ロボティクス
FIERCE: 進捗-失敗フィードバックによる汎用ロボット方策から高速専門家への変換
汎用ロボット方策を初期値とし、進捗と失敗を評価する統一評価器を用いた強化学習で、シミュレータや手動報酬設計なしに接触の多い実タスク向けの小型専門家方策を効率的に学習する手法を提案。
原題: FIERCE: From Generalist Robot Policies to Fast Specialists via Progress-Failure Feedback / Runjia Tan, Yuang Tu, Yujie Yan 他
日本語で読む → - 論文マニピュレーションロボティクス
GraphPoint: 意味的実体グラフと点軌道による組合せ的ロボットマニピュレーション
言語指示に応じて物体と動作を組み合わせて汎化するため、意味的実体グラフと把持点の未来軌道予測を組み合わせた操作方策GraphPointを提案し、新ベンチマークCoManiで検証した。
原題: GraphPoint: Semantic Entity Graphs and Point Trajectories for Compositional Robot Manipulation / Kang Luo, Hesheng Wang
日本語で読む → - 論文VLA画像認識
Finder: 身体性グラウンディングのためのエージェント型閉ループ物体探索
言語で指定された物体を部分的に観測された3Dシーンから見つけるため、計画・証拠収集・検証・制御を閉ループで回すエージェント型手法を提案し、物体検索や質問応答で精度を向上させた。
原題: Finder: Agentic Closed-Loop Object Finding for Embodied Grounding / Shixiong Xu, Zhiyuan Chen, Song Ding 他
日本語で読む → - 論文sim2realロボティクス
ビールを取ってきて:スムーズなピックアンドプレースのための合成から実への階層型ポリシー
液体入り容器をこぼさずに運ぶため、流体シミュレーションで検証した合成データと、言語・視覚からSE(3)目標を生成する高レベルモジュール+潜在拡散コントローラの階層型ポリシーを組み合わせた合成→実機フレームワークを提案。
原題: Fetch My Beer: Synthetic-to-real Hierarchical Policy for Smooth Pick-and-place / Yingyue Li, Chenyangguang Zhang, Ruida Zhang 他
日本語で読む → - 論文3D表現学習画像認識
ParticleSplat: 自己教師ありオブジェクト中心潜在粒子スプラッティング
複数視点の画像から3Dガウシアンスプラッティングを用いてシーンを物体ごとの潜在粒子に分解し、教師なしで物体マスクを獲得しロボット操作タスクの性能を向上させる手法を提案。
原題: ParticleSplat: Self-supervised Object-centric Latent Particle Splatting / Lyuxing He, Daniel Guo, Elizabeth Terveen 他
日本語で読む → - 論文VLAロボティクス
UAVと身体性知能の融合:物理デジタルAIエージェントによる人間意図と飛行力学の橋渡し
UAVの身体性知能(UAV EI)を5つの能力次元と5つのアーキテクチャ層からなる枠組みで整理し、基盤モデルや世界モデル、AIエージェントによる最近の進展を体系的にレビューしたサーベイ論文。
原題: UAVs Meet Embodied Intelligence: Bridging Human Intents and Flying Dynamics Via Harnessing Physical-Digital AI Agents / Yonglin Tian, Weiyi Wang, Houhua Lu 他
日本語で読む → - 論文VIOロボティクス
地下環境における視覚慣性オドメトリの劣化・誤較正・動的遮蔽下でのベンチマーク
CERBERUSデータセットを用い、地下環境でのVIOシステム4種を9つの実用的な摂動条件下で評価し、故障パターンとロバスト性限界を分析したベンチマーク研究。
原題: Benchmarking Visual-Inertial Odometry in Subterranean Environments Under Sensor Degradation, Miscalibration, and Dynamic Occlusion / Yueying Zhu, Xiang Li, Thien-Minh Nguyen 他
日本語で読む → - 論文3Dダイナミクス/事前学習画像認識
PointZero: 転移可能な3Dダイナミクス学習のための3D点追跡補完
ロボットの行動ラベルなしで、RGB-D観測と部分的な3D軌跡から全点の未来軌跡を予測する事前学習手法を提案し、下流のダイナミクス予測や模倣学習で有効性を示した。
原題: PointZero: 3D Point Track Completion for Learning Transferable 3D Dynamics / Bardienus P. Duisterhof, Kaifeng Zhang, Adam Hung 他
日本語で読む → - 論文sim2realロボティクス
ピクセル類似度を超えて:ロボット知覚のためのGANベース合成ソナー画像のタスク指向評価
GANで生成した合成ソナー画像を、画質指標ではなく物体検出性能で評価し、画質が良くても検出性能が高いとは限らないことを示した研究。
原題: Beyond Pixel Similarity: Task-Aware Evaluation of GAN-Based Synthetic Sonar Data for Robotic Perception / Hannan Ejaz Keen, Muhammad Moazam Fraz, Karsten Berns
日本語で読む → - 論文形式検証AI
MAGS: マルチエージェント自動形式化によるエージェント出力の安全性保証
LLMコーディングエージェントが生成するプログラムに対し、Dafnyを中間表現として用いたマルチエージェント自動形式化フレームワークMAGSを提案し、CUDAカーネル・端末スクリプト・ロボットアームタスクの計220例で安全性保証付きプログラム生成に成功した。
原題: MAGS: Multi-agent Auto-formalization Guarantees Safety for Agentic Outputs / Albert Wu, Nicholas Roberts, Tzu-Heng Huang 他
日本語で読む → - 論文群制御ロボティクス
一人称視点からの身体動作による飛行群ロボットの制御
胴体の傾き・手の位置・頭の回転を5次元の連続コマンドに変換する上半身インターフェースを開発し、15機のシミュレーション群をFPV操作する実験で従来送信機より完了時間を19.4%短縮した。
原題: Body-Motion Control of a Simulated Aerial Swarm from a First-Person View / Yang Chen, Darius Giannoli, Dario Floreano
日本語で読む → - 論文群制御ロボティクス
TRACER: 人間応答予測とインタラクションを考慮した再計画による適応型マルチロボット社会ナビゲーション
複数ロボットが人間と共存する空間で、ロボットの動きに対する人間の応答を予測し、その結果をオンラインで学習しながら再計画する双方向フレームワークを提案。
原題: TRACER: Adaptive Multi-Robot Social Navigation via Joint Human-Response Prediction and Interaction-Aware Replanning / Lan Hu, Minghui Liwang, Wenbo Zhu 他
日本語で読む → - 論文歩行ロボティクス
GLAMDRING: 強化学習によるCPGの歩容学習と形態の共設計
歩行タスクに最適な四足ロボットの形態とCPG歩容制御器を強化学習で同時に設計するフレームワークを提案。
原題: GLAMDRING: Gait Learning And Morphology co-Design via Reinforcement LearnING of CPGs / Amogh Joshi, Kaushik Roy
日本語で読む → - 論文宇宙ロボティクスロボティクス
AIによる宇宙ロボット運用:技術・課題・展望
宇宙ロボットの自律性と適応性を高めるAI技術を、能力構築の観点から3層フレームワークで整理し、今後の研究方向を提示したレビュー論文。
原題: Artificial Intelligence-Enabled Space Robot Operations: Technologies, Challenges and Prospects / Zeyuan Huang, Gang Chen, Zixuan Hao 他
日本語で読む → - 論文VLA機械学習
ENCP: 視覚言語ナビゲーションのためのエピソード正規化共形予測
視覚言語ナビゲーション(VLN)において、エピソード単位で正規化した共形予測を提案し、可変長で依存関係のあるナビゲーション系列でも各ステップで信頼できる不確実性推定を可能にした。
原題: ENCP: Episode-Normalized Conformal Prediction for Vision-and-Language Navigation / Vicky Feliren, A. Taufiq Asyhari, Muhamad Risqi U. Saputra
日本語で読む → - 論文VLAロボティクス
密なVLAポリシーをMoE化して軽量化する適応手法
VLAポリシーのFFN層をMoEに変換し、ルータ統計に基づく動的なエキスパート無効化でLLMパラメータを40%削減しつつ性能を維持する手法を提案。
原題: Dense to MoE Adaptation for Compact Vision Language Action Policies / Muchun Niu, Shuang Chen, Yuzhou Wu 他
日本語で読む → - 論文VLA画像認識
GeoLAM: ラベルなし人間動画から幾何学的潜在行動を学習
人間の動画から幾何学的な手がかりを活用して潜在行動を学習し、ロボット操作タスクに転移するフレームワークを提案。
原題: GeoLAM: Learning Geometry-Grounded Latent Actions from Unlabeled Human Videos / Yifan Xie, Hekun Tian, Jinkun Liu 他
日本語で読む → - 論文走行可能性予測/継続学習ロボティクス
不確実性を考慮した適応による走行可能性予測の継続学習
生成的な経験リプレイモデルを用いて、過去データを保存せずに新しい地形へ継続的に適応し、不確実性を考慮した走行可能性予測を実現するフレームワークを提案。
原題: Continual Learning for Traversability Prediction with Uncertainty-Aware Adaptation / Hojin Lee, Yunho Lee, Daniel A Duecker 他
日本語で読む → - 論文全身移動操作ロボティクス
Weave: 人間-物体インタラクションから全身巧みな移動操作を学習する
人間の物体操作デモを接触を考慮してロボット用に変換し、29体関節と12指関節を協調制御する全身移動操作ポリシーを学習するフレームワーク。
原題: Weave: Learning Whole-Body Dexterous Loco-Manipulation from Human-Object Interactions / Liu Cao, Xingze Wu, Jingzhi Cui 他
日本語で読む →