論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ソフトロボティクスロボティクス
建築材料のダメージ適応を数秒で実現
ソフトアクチュエータシステムの破損に自己受容感覚で適応する手法を提案し、6自由度ソフトリストのトレーシングタスクで切断や焼損、修理への適応を実証した。
原題: Damage Adaptation in Seconds for Architected Materials / James Avtges, Jake Ketchum, Helena Young 他
日本語で読む → - 論文ロボットミドルウェアロボティクス
物理AIのためのハーネス工学:ロボットミドルウェアはハーネス層である
ロボットミドルウェアが物理AI時代のハーネス(制御・計算・通信を仲介する層)としての役割を提案し、AIモデルに必要な3つの機能(投影、隔離、転送)を定義した論文。
原題: Harness Engineering for Physical AI: Robot Middleware Is the Harness Layer / Sanghoon Lee, Jiyeong Chae, Kyung-Joon Park
日本語で読む → - 論文農業ロボティクス/計測画像認識
曲率を考慮したRGB-D画像と3次スプライン弧長積分による温室キュウリの3次元長さ推定
温室キュウリの長さを非接触で測るため、RGB-Dカメラとセグメンテーション、3次スプライン弧長積分を用いた新しい手法を提案し、従来法より高精度であることを示した。
原題: Curvature-aware 3D length estimation of greenhouse cucumbers using RGB-D imaging and cubic spline arc-length integration / Manveen Kaur, Rajmeet Singh, Saeed Mozaffri 他
日本語で読む → - 論文触覚表現学習ロボティクス
HT-Bench: 器用な全手触覚表現のベンチマークと学習 - 自己中心視覚との統合
触覚センサの多様性を超え、自己中心視覚と全手触覚データを組み合わせた大規模ベンチマークHT-Benchを構築し、触覚表現学習の評価手法とHandTouchエンコーダを提案した。
原題: HT-Bench: Benchmarking and Learning Dexterous Full-Hand Tactile Representations with Egocentric Vision / Yuzhe Huang, Jiaping Wu, Jiaming Jiang 他
日本語で読む → - 論文ナビゲーションロボティクス
信頼性のあるナビゲーションのためのタスク認識環境拡張:遮蔽付き条件付き拡散モデル
部分観測下での軌道計画の信頼性を高めるため、環境に視覚マーカーを配置する問題を扱い、条件付き拡散モデルを用いてマーカー配置を生成する手法を提案した。
原題: Task-Aware Environment Augmentation for Reliable Navigation via Shielded Conditional Diffusion / Bharawee Phoompho, Gokul Puthumanaillam, Yan Miao 他
日本語で読む → - 論文世界モデル/ポリシー評価画像認識
StressDream: ビデオ世界モデルを操縦して堅牢なポリシー評価と改善を実現
拡散ベースのビデオ世界モデルにおいて、推論時に指定された高影響かつ妥当な未来(例:タスク失敗)へ想像を誘導する手法を提案し、ポリシーの堅牢な評価と改善を可能にした。
原題: StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement / Junwon Seo, Sushant Veer, Ran Tian 他
日本語で読む → - 論文触覚/sim2realロボティクス
TactSpace: 触覚のシミュレーションから実世界への転移のための物理強化共有潜在空間の学習
触覚センサのシミュレーションと実データの差異を埋めるため、異なる触覚モダリティを共通の潜在空間に整列させる表現学習フレームワークを提案し、シミュレーションのみで訓練したモデルを実センサに直接適用するゼロショット転移を実現した。
原題: TactSpace: Learning a Physics-enriched Shared Latent Space for Tactile Sim-to-Real Transfer / Arunim Joarder, Arjun Bhardwaj, René Zurbrügg 他
日本語で読む → - 論文群制御ロボティクス
進化的マルチロボットシステムにおけるタスク特化の評価コスト
マルチロボットシステムでタスク特化型の行動を進化させる際の評価予算のコストと利点を、採餌シナリオのシミュレーションで分析した論文。
原題: The Evaluation Cost of Task Specialization in Evolutionary Multi-Robot Systems / Paolo Leopardi, Heiko Hamann, Jonas Kuckling 他
日本語で読む → - 論文模倣学習/データ拡張ロボティクス
MinInter: 模倣学習のデータ拡張における軌道補間の最小化
模倣学習のデータ拡張で、初期状態ごとに補間が最小となる実演を選ぶ手法MinInterを提案し、生成データの質とポリシー成功率を向上させた。
原題: MinInter: Minimizing Trajectory Interpolation During Data Augmentation for Imitation Learning / Qingyang Wang, Xingang Liu, Changwei Yao 他
日本語で読む → - 論文評価ロボティクス
SC3-Eval: 自己整合的なビデオ生成によるロボット基盤モデルの評価
ロボット操作ポリシーの実世界評価を、アクション条件付きビデオ世界モデルを用いてスケーラブルに代替する手法を提案。前方・逆方向ダイナミクス整合性、クロスビュー整合性、テスト時整合性の3つの整合性を課すことで、正確なポリシー評価を実現する。
原題: SC3-Eval: Evaluating Robot Foundation Models via Self-Consistent Video Generation / Wei-Cheng Tseng, Gashon Hussein, Yuzhu Dong 他
日本語で読む → - 論文SLAMロボティクス
MoPe: 動的環境における堅牢な単眼ガウス写像のための運動永続性
動的物体の「動き」は瞬間的な見た目ではなく時間的な性質であると捉え、過去の動的推定を幾何学的に伝播させて現在の観測と融合する「運動永続性」の原理を導入し、単眼ガウス写像SLAMの動的領域の誤吸収によるゴーストアーティファクトを低減する手法を提案した。
原題: MoPe: Motion Permanence for Robust Monocular Gaussian Mapping in Dynamic Environments / Qixin Xiao
日本語で読む → - 論文異常検出ロボティクス
教師なしメモリ強化ビデオトランスフォーマー:自律農業ローバーの障害物検出
動的農業環境でのリアルタイム障害物検出のための、メモリモジュールを備えた完全教師なしトランスフォーマーモデルを提案し、菜種データセットで最先端性能を達成した。
原題: Unsupervised Memory-Enhanced Video Transformers: Obstacle Detection for Autonomous Agricultural Rover / Théo Biardeau, Anne-Sophie Capelle-Laizé, Salwan Alwan 他
日本語で読む → - 論文VLAロボティクス
UniFS: 視覚言語行動モデルのための統合高速-低速階層アーキテクチャ
人間の脳の多時間スケール処理に着想を得て、VLM層を更新頻度の異なるグループに階層化し、潜在ベクトル反転機構と多レベル監視戦略を導入することで、高速-低速の周波数ジレンマを解決する新しいVLAアーキテクチャを提案した。
原題: UniFS: Unified Fast-to-Slow Hierarchical Architecture for Vision-Language-Action Models / Lin Sun, Zhiwei Guan, Conglin Wang 他
日本語で読む → - 論文データセット/知覚ロボティクス
バイキングヒルデータセット:森林シーンにおける検出とセグメンテーションのためのLiDAR・レーダー・カメラデータセット
森林環境で動作するロボットの知覚研究用に、4Dイメージングレーダー、LiDAR、カメラを搭載した移動ロボットで収集したマルチセンサーデータセットを構築し、樹木の3Dバウンディングボックス注釈とセグメンテーションのベースライン結果を提供した。
原題: Viking Hill Dataset: A Lidar-Radar-Camera Dataset for Detection and Segmentation in Forest Scenes / Vladimír Kubelka, Oleksandr Kotlyar, Unal Artan 他
日本語で読む → - 論文自動駐車/軌道計画/LLMロボティクス
ParkingTransformer: LLM強化による自動駐車のためのエンドツーエンド軌道計画
本論文は、マルチビュー知覚と大規模言語モデル(LLM)のシーン理解能力を組み合わせ、軌道クエリとLLMの暗黙状態特徴を利用して、高密度BEV表現を必要とせずに計画軌道を直接出力する自動駐車フレームワークを提案する。3D位置エンコーディングと固定ウィンドウストリーミング機構を導入し、空間認識と時間処理効率を向上させ、粗密デコード戦略で軌道精度を高める。CARLAシミュレータと実車実験で有効性を検証した。
原題: ParkingTransformer: LLM-Enhanced End-to-End Trajectory Planning for Autonomous Parking / Hauteng Wu, Xu Li, Dong Kong 他
日本語で読む → - 論文物体再配置ロボティクス
不確実性ガイドによるLLM支援を活用した棄権対応の個人化物体再配置
家庭環境での物体再配置において、置くべき場所の予測だけでなく、置くべきでない場合の判断も重要です。本研究では、軽量な個人化埋め込みモデルと選択的な大規模言語モデル支援を組み合わせたハイブリッドフレームワークAPOLLOを提案し、不確実性推定に基づいて曖昧な決定のみLLMを呼び出すことで、効率性・プライバシー・推論能力のバランスを実現しました。
原題: Abstention-Aware Personalized Object Rearrangement via Uncertainty-Guided LLM Assistance / Sam Collin, Ali Ayub
日本語で読む → - 論文自動運転評価画像認識
DriveJudge: 視覚言語モデルによる自動運転評価の再考
自動運転の評価を、ルールベースの物理的根拠と視覚言語モデルの文脈理解を組み合わせたエージェントDriveJudgeを提案し、大規模データセットで人間の判断と高い一致を示した。
原題: DriveJudge: Rethinking Autonomous Driving Evaluation with Vision-Language Models / Xinglong Sun, Kevin Xie, Jenny Schmalfuss 他
日本語で読む → - 論文触覚/言語条件付けロボティクス
TacStyle: 構造化行動表現を用いた触覚ロボットポリシーの個人化
言語で好みを伝え、ロボットの動作スタイルを調整する手法を提案。行動の潜在表現を学習し、基盤モデルで解釈して所望の動作を選択する。
原題: TacStyle: Personalizing Tactile Robot Policies using Structured Behavior Representations / Kevin Robledo, Matías I. Torres Galaz, Kumar Dixhant Rai 他
日本語で読む → - 論文交通シミュレーションロボティクス
多交差点都市交通のためのコリドースケールCARLA-VISSIM共シミュレーションフレームワーク
都市部の連続交差点を含むコリドーを対象に、CARLAとVISSIMを双方向に同期させる共シミュレーションフレームワークを構築し、実証実験を行った。
原題: A Corridor-Scale CARLA-VISSIM Co-Simulation Framework for Multi-Intersection Urban Traffic / Sima Ashayer, Austin Haris, Mina Sartipi
日本語で読む → - 論文安全性解析ロボティクス
λ-Reachability: ヒューマノイド安全性のための幾何学的ホライズン安全ベルマン方程式
高次元ロボットシステムの安全性解析をスケーラブルに行うため、割引なしの到達可能性目標を学習できる新しい安全価値推定法λ-Reachabilityを提案し、実機ヒューマノイドで有効性を示した。
原題: $\lambda$-Reachability: Geometric-Horizon Safety Bellman Equations for Humanoid Safety / Rui Chen, Shangtao Li, Yifan Sun 他
日本語で読む → - 論文強化学習/人型ロボット/省エネルギーロボティクス
電力モデル同定に基づく深層強化学習による人型ロボットの省エネルギー腕到達動作
人型ロボットの腕到達動作を省エネルギー化するため、実測電力モデルとSAC強化学習を組み合わせた枠組みを提案し、シミュレーションと実機で検証した。
原題: Energy-Efficient Arm Reaching for a Humanoid Robot via Deep Reinforcement Learning with Identified Power Models / Nestor N. Deniz, Simon Parsons, Fernando Auat Cheein
日本語で読む → - 論文製造/デジタルツインロボティクス
ロボット衣料自動化における導入事例研究:デジタルツイン統合、相互運用性、労働力の有効活用
デニム製造におけるロボット縫製システムの導入事例を報告し、デジタルツインや相互運用性レイヤーによるシステム統合が実用化に重要であることを示した論文。
原題: A Deployment Case Study in Robotic Apparel Automation: Digital Twin Integration, Interoperability, and Workforce Enablement / Gokul Narayanan, Abhiroop Ajith, Jonathan Zornow 他
日本語で読む → - 論文自動運転/対向訓練ロボティクス
攻撃からカリキュラムへ:安全な自動運転のための学習可能性ガイド付き対向訓練
自動運転の安全性向上のため、対向シナリオ生成を解決可能かつポリシーの能力に合わせたカリキュラムに変換する学習可能性ガイド付きフレームワークAlignADVを提案した。
原題: From Attacks to Curricula: Learnability-Guided Adversarial Training for Safe Autonomous Driving / Yuewen Mei, Tong Nie, Jie Sun 他
日本語で読む → - 論文手術ロボティクスロボティクス
腹腔鏡下胆嚢摘出術における自動クリップ配置のための点群セグメンテーション(ファントム実験)
腹腔鏡手術のファントム上で、単一カメラの点群をセグメンテーションし、スプライン補間でクリップ配置目標を抽出して自動配置する初のロボットシステムを提案。少数の実データと合成データの事前学習、新規データ拡張で精度を達成した。
原題: Point Cloud Segmentation for Autonomous Clip Positioning in Laparoscopic Cholecystectomy on a Phantom / Balázs Gyenes, Nikolai Franke, Paul Maria Scheikl 他
日本語で読む → - 論文ナビゲーションロボティクス
模倣からアライメントへ:長距離歩道ナビゲーションのための人間の好みに基づくフローポリシー
単眼RGBカメラのみを用いた長距離歩道ナビゲーションのためのポリシーFlowPilotを提案し、模倣学習と人間の介入による選好学習を組み合わせて、複雑な歩道環境での成功率を向上させた。
原題: From Imitation to Alignment: Human-Preference Flow Policies for Long-Horizon Sidewalk Navigation / Honglin He, Zhizheng Liu, Yukai Ma 他
日本語で読む → - 論文サーベイロボティクス
ロボット操作のためのワールドモデル:サーベイ
ロボット操作におけるワールドモデルの研究を、予測する未来表現、行動との接続、使用タイミングの3つの観点から体系的に整理し、5つの表現ファミリーと機能的分類を提案したサーベイ論文。
原題: World Models for Robotic Manipulation: A Survey / Fangyuan Wang, Ziyuan Wang, Guorui Pei 他
日本語で読む → - 論文センサ評価ロボティクス
医療用途向け市販深度センサの精度比較
豚骨・豚腹・シリコン腎臓ファントムを用いて、4種類の市販深度センサの精度を比較した論文。Zivid 2M+ 60が全対象で最良の性能を示した。
原題: Comparing Commercial Depth Sensor Accuracy for Medical Applications / Pit Henrich, Maximilian Weiherer, Franziska Hansen 他
日本語で読む → - 論文歩行ロボティクス
Stubborn: 堅牢なモーション追従と転倒回復のための合理化・統合強化学習フレームワーク
ヒューマノイドのモーション追従と転倒回復を単一の強化学習フレームワークで統合し、確率的終了機構とサンプリング分布の動的再形成により、転倒状態からの回復探索を促進する手法を提案した。
原題: Stubborn: A Streamlined and Unified Reinforcement Learning Framework for Robust Motion Tracking and Fall Recovery for Humanoids / Xiao Ren, Yuhui Yang, Zongbiao Weng 他
日本語で読む → - 論文自動運転/協調自律性ロボティクス
CADET: 協調型自動運転における分散協調自律性を評価するモジュール型プラットフォーム
自動運転車の協調自律性を現実的な条件下で評価するためのモジュール型プラットフォームCADETを提案し、分散配置が安全性に与える影響を実験で示した。
原題: CADET: A Modular Platform for Evaluating Distributed Cooperative Autonomy in Connected Autonomous Vehicles / Pragya Sharma, Brian Wang, Mani Srivastava
日本語で読む → - 論文マニピュレーションロボティクス
Sparse2Act: クロスドメインロボット操作のための行動整合スパース3D表現の学習
点群エンコーダを事前学習する際に、エンドエフェクタの動作を幾何学的監督として用いることで、観測と行動を整合させたスパース3D表現を獲得し、下流のポリシーに転用可能にする手法を提案した。
原題: Sparse2Act: Learning Action-Aligned Sparse 3D Representations for Cross-Domain Robot Manipulation / Yu Guo, Chang Yu, Siyu Ma 他
日本語で読む →