論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文3D物体検出/センサ融合画像認識
低重なり構成における頑健な3D物体検出のための幾何認識型魚眼-LiDAR融合
魚眼カメラとLiDARの融合において、魚眼の幾何特性を考慮したハイブリッド融合フレームワークを提案し、極端な歪みや低重なり条件下での3D物体検出性能を向上させた。
原題: Geometry-Aware Fisheye-LiDAR Fusion for Robust 3D Object Detection in Low-Overlap Setups / Xiangzhong Liu, Xihao Wang, Hao Shen
日本語で読む → - 論文LiDARオドメトリロボティクス
セマンティック重み付きICPによるLiDARオドメトリ:クラス認識型残差再重み付けによるロバストなスキャン位置合わせ
LiDARオドメトリの位置合わせにおいて、点群のセマンティッククラスに基づいて残差に重みを付けるICPを提案し、動的物体や不安定な構造の影響を抑えつつ、オフロード環境などでの精度を向上させた。
原題: Semantic-weighted ICP for LiDAR Odometry: Class-Aware Residual Reweighting for Robust Scan Registration / Vasco Carvalho, Tiago Barros, Urbano J. Nunes
日本語で読む → - 論文VLA/操作ロボティクス
ProbeAct: プローブ誘導による訓練不要の視覚言語行動モデル障害回復
視覚言語行動モデル(VLA)の失敗を検出・回復する訓練不要の介入フレームワークを提案。隠れ状態プローブと運動状態機械、制御障壁関数フィルタを組み合わせ、追加学習なしで成功率を向上させる。
原題: ProbeAct: Probe-Guided Training-Free Failure Recovery in Vision-Language-Action Models / Fan Zhang, Seongbin Park, Baharan Mirzasoleiman 他
日本語で読む → - 論文世界モデル画像認識
ATM: 行動整合性転移行列による潜在世界モデルの診断と改善
潜在世界モデルの表現が計画に有用かどうかを、シミュレータ評価なしで軽量なプローブにより診断する行列ATMを提案し、さらにその診断信号を訓練に用いて計画性能を改善する手法も示した。
原題: ATM: Action-Consistency Transfer Matrix for Diagnosing and Improving Latent World Models / Jiaheng Chen
日本語で読む → - 論文自動運転・人間行動モデル制御
応答マップによる自動運転車とのドライバー相互作用の特性評価
人間ドライバーの自動運転車(AV)への反応をゲーム理論に基づく応答マップでモデル化し、運転シミュレータ実験データから線形表現を用いてドライバー行動を特徴付けた。その結果、応答マップが加速行動を捉えられ、AVの譲る・譲らない・反応的という行動によってドライバー応答が有意に異なることを示した。
原題: Characterizing Driver Interactions with Autonomous Vehicles via Response Maps / Dave Broaddus, Rachel DiPirro, Chishang 他
日本語で読む → - 論文群制御/位置推定ロボティクス
単一ハイドロフォンペイロードを搭載した複数AUVによる隠れマルコフモデル付き粒子フィルタを用いた海洋生物追跡
複数のAUVに単一の小型ハイドロフォンを搭載し、隠れマルコフモデルに基づく粒子フィルタで音響タグの位置を推定する海洋生物追跡手法を提案した。実データとシミュレーションで約10〜15mの精度を確認した。
原題: Multi-AUV Marine Life Tracking with Single Hydrophone Payloads via a Hidden Markov Model Equipped Particle Filter / Christopher Herrera, Kehlani Fay, Christopher Clark 他
日本語で読む → - 論文VLAロボティクス
Vesta: 汎用身体化推論モデル
ロボットのための単一の基盤モデルで、位置推定・空間推論・ナビゲーション・長期計画を統合し、専門モデル群を上回る性能を示した。
原題: Vesta: A Generalist Embodied Reasoning Model / Johan Bjorck, Zhiqi Li, Yunze Man 他
日本語で読む → - 論文触覚ロボティクス
TacVerse: クロスセンサー視覚ベース触覚認識のためのマルチセンサーデータセットとベンチマーク
7種類の視覚ベース触覚センサーから10万枚以上の画像を収集し、形状分類・格子分類・力推定の3タスクでセンサー間の汎化性能を評価するデータセットとベンチマークを構築した。
原題: TacVerse: A Multi-Sensor Dataset and Benchmark for Cross-Sensor Vision-Based Tactile Perception / Lan Wei, Gurmeher Khurana, Sirine Bhouri 他
日本語で読む → - 論文VLA/強化学習ロボティクス
FORCE: 価値校正ウォームアップと自己蒸留による効率的なVLA強化学習ファインチューニング
VLAモデルの強化学習ファインチューニングを安定化・高速化する3段階フレームワークFORCEを提案。価値校正ウォームアップと自己蒸留でサンプル効率を改善し、シミュレーションと実機で成功率を大幅に向上させた。
原題: FORCE: Efficient VLA Reinforcement Fine-Tuning via Value-Calibrated Warm-up and Self-Distillation / Shuyi Zhang, Yunfan Lou, Hongyang Cheng 他
日本語で読む → - 論文マニピュレーションロボティクス
GRAFT: グラフベースのアフォーダンス転移と部品対応付け
物体を部品ベースのグラフで表現し、幾何学的類似性に基づいてデモンストレーションから未見物体への操作転移を行う、ゼロショット操作転移手法を提案した。
原題: GRAFT: Graph-Based Affordance Transfer via Part Correspondence / Mengying Lin, Utkarsh Mishra, Ajay Mandlekar 他
日本語で読む → - 論文モデル予測制御ロボティクス
TurboMPC: GPU上での高速・スケーラブル・微分可能なモデル予測制御
GPU上で動作する微分可能なMPCソルバーを提案し、制約付きプランニングや模倣学習、強化学習などでCPU/GPU既存ソルバーより最大58倍高速化し、実車のタイムレースにも適用した。
原題: TurboMPC: Fast, Scalable, and Differentiable Model Predictive Control on the GPU / Gabriel Bravo-Palacios, Jianghan Zhang, Zachary Pestrikov 他
日本語で読む → - 論文VLAロボティクス
長期的ロボット制御のための視覚運動ポリシーにおける記憶検索
部分観測環境での長期タスクを可能にするため、注意機構を用いた記憶検索を備えた視覚運動ポリシーHALOを提案。VLMの事前知識を活用して誤相関を抑え、記憶誤差の蓄積を軽減する。
原題: Memory Retrieval in Visuomotor Policies for Long-Horizon Robot Control / Rutav Shah, Yisu Li, Femi Bello 他
日本語で読む → - 論文ナビゲーションロボティクス
SurveilNav: ロボットと監視システムの協調による物体目標ナビゲーション
監視カメラとロボットを協調させ、大規模環境での物体探索ナビゲーションを効率化するフレームワークを提案した論文。
原題: SurveilNav: Collaborative Object Goal Navigation with Robot and Surveillance System / Ming-Ming Yu, Qunbo Wang, Rongtao Xu 他
日本語で読む → - 論文軌道予測ロボティクス
AeroCast: Transformer-MDNアーキテクチャによる非協調航空障害物の確率的3次元軌道予測
非協調な航空障害物(鳥やドローンなど)の将来位置を確率的に予測するため、Transformerエンコーダと混合密度ネットワークを組み合わせたフレームワークAeroCastを提案し、5秒先までの予測誤差を約50%削減した。
原題: AeroCast: Probabilistic 3D Trajectory Prediction for Non-Cooperative Aerial Obstacles via Transformer-MDN Architecture / Syed Izzat Ullah, Jose Baca
日本語で読む → - 論文VLAロボティクス
自己中心視覚理解における二重正解予測を備えた低遅延視覚言語モデルに向けて
人間とロボットの協調作業で重要となる自己中心視覚理解向けVLMの枝刈りを研究し、予測精度と根拠の両方が正しい「二重正解」を保つ新しい枝刈り戦略を提案した。
原題: Toward Low-Latency Vision-Language Models with Doubly-Correct Predictions in Egocentric Visual Understanding / Qitong Wang, Fan Du, Pranav Maneriker 他
日本語で読む → - 論文オドメトリロボティクス
ISOPoT: 点追跡によるイメージングソナーオドメトリ
水中環境でのナビゲーションのために、前方視ソナー画像の点追跡を用いたオドメトリ手法を提案し、実データで従来法を上回る性能を示した。
原題: ISOPoT: Imaging Sonar Odometry by Point Tracking / Jaša Samec, Vid Rijavec, Marko Peljhan 他
日本語で読む → - 論文自動運転/マルチエージェントロボティクス
マルチエージェント具現化自動運転:V2X情報交換から共有世界モデルへ
自動運転を単独車両の知能から、車両・インフラ・他交通参加者が知覚を共有し意図を推論し協調行動するマルチエージェント具現化システムへの移行として捉え、約400件の文献をレビューし、共有世界モデル(SWM)の観点から課題と研究優先事項を整理したサーベイ論文。
原題: Multi-Agent Embodied Autonomous Driving: From V2X Information Exchange to Shared World Models / Senkang Hu, Zhengru Fang, Yihang Tao 他
日本語で読む → - 論文VLAロボティクス
SA-VLA: 状態認識トークナイザによる視覚言語行動モデルの性能向上
ロボットの現在状態を考慮して離散アクショントークンを連続値に復号する状態認識アクショントークナイザを提案し、操作タスクの成功率を大幅に向上させた。
原題: SA-VLA: State-aware tokenizer for improving Vision-Language-Action Models' performance / Tengyue Jiang, Chunpu Xu, Jiayue Kang 他
日本語で読む → - 論文安全強化学習ロボティクス
PPO-EAL: 安全なロボット制御のための正確な拡張ラグランジュ近位ポリシー最適化
安全制約を満たす強化学習のための新しい制約付きポリシー最適化フレームワークを提案し、正確な拡張ラグランジュ法をPPOに統合して、理論的に保証された制約充足と高いタスク性能を実現した。
原題: PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control / Jiatao Ding, Songqun Gao, Andrea Del Prete 他
日本語で読む → - 論文SLAMロボティクス
LiDAR SLAMのための自己教師あり幾何推論
LiDAR SLAMの局所幾何推定を自己教師ありで学習し、推定した幾何情報をSLAMに再帰的にフィードバックして精度を向上させるフレームワークを提案した。
原題: Self-supervised Geometry Reasoning for LiDAR Simultaneous Localization and Mapping / Jiwoo Kim, Jinwoo Lee, Woojae Shin 他
日本語で読む → - 論文操作ロボティクス
Chronos: 非マルコフ的長期間操作のための物理情報を活用した全履歴フレームワーク
ロボットポリシーを力学系として捉え、観察履歴を状態として扱うことで、記憶依存の長期間操作を可能にするフレームワークを提案した。
原題: Chronos: A Physics-Informed Full-History Framework for Non-Markovian Long-Horizon Manipulation / Yulin Zhou, Yimeng Wang, Nengyu Wang 他
日本語で読む → - 論文VLA/実機展開ロボティクス
視覚-言語-行動モデル:実機UR5プラットフォームでの実験的洞察
実機UR5eマニピュレータ上でVLAモデル(OpenVLA等)を微調整・展開し、データ収集から制御までの再現可能なフレームワークを構築。オフライン指標と実機の閉ループ挙動の乖離が、行動表現や座標系、時間整合、画像前処理、データ品質に起因することを実験的に示した。
原題: Vision-Language-Action Models: Experimental Insights from a Real-World UR5 Platform / Mathilde Hochedel, Marc Lalonde
日本語で読む → - 論文シーン理解ロボティクス
3Dシーングラフ:未解決の課題と今後の方向性
3Dシーングラフ(3DSG)の研究分野を統一的にレビューし、定義の整理、構築手法、応用、評価方法を解説するとともに、今後の課題と方向性を提示したサーベイ論文。
原題: 3D Scene Graphs: Open Challenges and Future Directions / Dennis Rotondi, Francesco Argenziano, Sebastian Koch 他
日本語で読む → - 論文群制御ロボティクス
強化学習による模擬毛細血管内での自律マイクロロボットのナビゲーションと介入
血流の物理シミュレーション環境で強化学習エージェントを訓練し、マイクロロボットが毛細血管網を自律航行して血流の遮断・再開などの介入を行えることを示した論文。
原題: Reinforcement Learning Enables Autonomous Microrobot Navigation and Intervention in Simulated Blood Capillaries / Jannik Drotleff, Samuel Tovey, Paul Hohenberger 他
日本語で読む → - 論文ロボット制御ロボティクス
物理的整合性を考慮したタスク構造再構成による推論時ロボット行動制御
学習済みロボットポリシーを再学習せずに、テスト時にユーザーの好みへ行動を誘導する手法ReStructを提案。ニューラルオートマトンでタスク構造を再構成し、物理的に実現可能な制御を実現する。
原題: Inference-Time Robot Behavior Steering through Physically-Aware Reconfiguration of Task-Structure / Yiyuan Pan, Hanjiang Hu, Shangtao Li 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
ロボット人形劇による物語表現システム
低コストのロボット人形劇システムを開発し、バクスターロボットで自律的に物語を演じることで、ジェスチャーだけの場合より高い関与と物語理解が得られることを示した。
原題: RoboTales: ROBOTic Anthropomorphic LEarning Systems / Andrew Chen, Ju-Hung Chen, Phurinat Pinyomit 他
日本語で読む → - 論文触覚ロボティクス
受動的で柔軟な音響導波路によるスケーラブルな動的触覚センシング
深いサブ波長の音響導波路を用いた受動的分布型触覚センシング手法を提案し、柔軟性を保ちながら高精度な位置検出と波形再構成を実現した。
原題: Scalable Dynamic Tactile Sensing Enabled by Passive and Flexible Acoustic Waveguides / Guimin Long, Changhong Linghu, Chuanping Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
手持ち型と遠隔操作型の監督を橋渡しする状態ゲート専門家による接触リッチ操作
手持ち型データ収集と遠隔操作データを組み合わせ、接触を伴う操作タスクを効率的に学習する手法を提案。状態に応じて専門家を切り替える拡散ポリシーにより、少量の遠隔操作デモで性能を向上させる。
原題: Bridging Handheld and Teleoperated Supervision for Contact-Rich Manipulation via State-Gated Experts / Vidullan Surendran, Neehar Peri, David Watkins
日本語で読む → - 論文マニピュレーションAI
AEGIS: 物理AIのためのバックアップ反射
ロボット操作の長期的な失敗を防ぐため、弱いポリシーの活性化を監視して危険なステップを検出し、必要な時だけ強いポリシーに切り替える手法を提案した。
原題: AEGIS: A Backup Reflex for Physical AI / Josef Chen
日本語で読む → - 論文移動操作ロボティクス
Humanoid-DART: 拡散ガイドによるリラベリングと追跡を用いたヒューマノイド移動操作
少数のデモから自己教師ありで行動レパートリーを拡張し、拡散モデルによる軌道生成と強化学習を組み合わせてヒューマノイドの移動操作ポリシーを学習する手法を提案した。
原題: Humanoid-DART: Humanoid Loco-Manipulation using Diffusion-guided Augmentation through Relabeling and Tracking / Pranav Debbad, Kanish Thiagarajan, Victor Dhédin 他
日本語で読む →