論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文自動運転ロボティクス
DriveSafer: 安全ガイダンスを備えたエンドツーエンド自動運転
エンドツーエンド自動運転モデルの安全性能を向上させるため、訓練時と推論時の両方で安全制約を組み込むフレームワークDriveSaferを提案し、破滅的な失敗を大幅に削減した。
原題: DriveSafer: End-to-End Autonomous Driving with Safety Guidance / Shounak Sural, Raj Rajkumar
日本語で読む → - 論文マルチロボットSLAMロボティクス
水上と水中:水面・水中領域を横断する異種マルチロボットSLAM
水上の無人艇(USV)と水中の自律型潜水機(AUV)の間で、音響測距に頼らず、水上と水中で観測可能な構造物を利用したループクロージャにより、集中型マルチロボットSLAMを実現する手法を提案した。実データを用いた検証でAUVの位置誤差が改善することを示した。
原題: Above and Below: Heterogeneous Multi-robot SLAM Across Surface and Underwater Domains / John McConnell, Armon Shariati, Paul Szenher 他
日本語で読む → - 論文VLAロボティクス
BlockVLA: ブロック拡散ファインチューニングによる自己回帰VLAの高速化
自己回帰型VLAモデルの推論遅延を減らすため、ブロック拡散パラダイムを導入し、ブロック内で並列生成しつつブロック間の因果性を保つことで、推論を高速化する手法を提案した。
原題: BlockVLA: Accelerating Autoregressive VLA via Block Diffusion Finetuning / Ruiheng Wang, Shuanghao Bai, Haoran Zhang 他
日本語で読む → - 論文VLAロボティクス
代数的一貫性を持つ潜在アクションモデル:視覚・言語・行動モデルのためのALAM
アクションラベルなしの動画から潜在アクションを学習し、代数的一貫性(合成・可逆性)を課すことで、VLAモデルの生成に適した構造化された潜在遷移を獲得する手法を提案した。
原題: ALAM: Algebraically Consistent Latent Action Model for Vision-Language-Action Models / Zuojin Tang, Haoyun Liu, Xinyuan Chang 他
日本語で読む → - 論文SLAMロボティクス
Dr-PoGO: 直接レーダーポーズグラフ最適化
2Dスピニングレーダーを用いたSLAM手法を提案し、直接レジストレーションによるオドメトリとループ閉じ込みを行い、ポーズグラフ最適化で軌道を改善する。
原題: Dr-PoGO: Direct Radar Pose-Graph Optimization / Cedric Le Gentil, Weican Li, Leonardo Brizi 他
日本語で読む → - 論文運動制御ロボティクス
MyoChallenge 2025: 人間の運動知能のための新しいベンチマーク
NeurIPS 2025で開催されたMyoChallengeは、高忠実度の筋骨格モデルと物理シミュレーションを用いて、卓球ラリーとサッカーペナルティキックの2つのタスクで運動制御の知能を競うベンチマークを確立した。
原題: MyoChallenge 2025: A New Benchmark for Human Athletic Intelligence / Cheryl Wang, Chun Kwang Tan, Balint K. Hodossy 他
日本語で読む → - 論文sim2real画像認識
産業用ビジュアルsim-to-realにおける事前情報の利用可能性:CADガイド型とCAD非利用型のレビュー
産業用の視覚的sim-to-realを、CADモデルの有無などの事前情報の利用可能性に基づいて整理し、CADベースの検出・6D姿勢推定と産業用異常検知・表面検査の文献を統合的にレビューした論文。
原題: Prior Availability in Industrial Visual Sim-to-Real: A Review of CAD-Guided and CAD-Unavailable Regimes / Chenxi Tao, Seung-Kyum Choi
日本語で読む → - 論文データセット画像認識
CM-EVS: 完全なシーンカバレッジのためのスパースなパノラマRGB-D-ポーズデータ
3Dアセットを、冗長性が低く完全なシーンカバレッジを持つスパースなパノラマRGB-D-ポーズデータに変換する手法COVERを提案し、大規模データセットCM-EVSを構築した。
原題: CM-EVS: Sparse Panoramic RGB-D-Pose Data for Complete Scene Coverage / Jiale Liu, Jungang Li, Jieming Yu 他
日本語で読む → - 論文操作ロボティクス
DISC: 指示を状態条件付き制御から分離するポリシー生成
言語条件付き操作ポリシーにおいて、指示と観測を共有パラメータで処理することで生じる観測リークを、ハイパーネットワークで指示からポリシー全体を生成することで構造的に排除し、性能を向上させた。
原題: DISC: Decoupling Instruction from State-Conditioned Control via Policy Generation / Hanxiang Ren, Pei Zhou, Xunzhe Zhou 他
日本語で読む → - 論文触覚ロボティクス
TacO: 物体操作のための触覚センサのベンチマーク
物体操作における4種類の触覚センサ(視覚、音響、磁気、抵抗)の性能を、3つの操作タスクで系統的に評価し、タスクに適したセンサ選択の枠組みを提案した論文。
原題: TacO: Benchmarking Tactile Sensors for Object Manipulation / Anya Zorin, Zilin Si, Myungsun Park 他
日本語で読む → - 論文水中ロボットロボティクス
HyDRA Scorpion: 低コストでモジュール式の水中点検・介入・物体検出用ROV
低コストで現地製造可能なROVにAI認識スタックと計測機能を統合し、4自由度操縦、双腕マニピュレータ、耐圧ハウジングを備えたシステムを開発・実験検証した。
原題: HyDRA Scorpion: A Cost-effective and Modular ROV for Real-Time Underwater Inspection, Intervention, and Object Detection / Anika Tabassum Orchi, Md Farhan Zaman, Md Darain Khan 他
日本語で読む → - 論文空中ロボティクス/森林管理AI
超低影響・封包型伐採法(URIEL):空中ロボティクスを用いた熱帯林の選択的持続可能伐採と伐採後育林処理の新手法の提案
熱帯林の持続可能な選択伐採と伐採後の育林処理を、ヘリコプター伐採とドローンによるロボティクス・AI技術を組み合わせた新手法URIELを提案し、デジタルシミュレーションと経済性分析でその実現可能性を示した論文。
原題: Ultra-Reduced-Impact-Encased-Logging (URIEL): propose a new method for selective sustainable logging and post-harvest silvicultural treatment in tropical forest using airborne robotics systems / Daniel Albiero, Gelton Fernando de Morais, Daniela Han 他
日本語で読む → - 論文探索ロボティクス
重要情報の学習:適応的情報理論に基づくロボット探索の目的関数
ロボット探索における情報理論的目的関数の設計課題に対し、フィッシャー情報行列の固有空間解析で観測可能なパラメータ方向を特定し、重要方向を強調する適応的目的関数Q-OEDを提案した。シミュレーションと実機のナビゲーション・操作タスクで有効性を検証した。
原題: Learning What Matters: Adaptive Information-Theoretic Objectives for Robot Exploration / Youwei Yu, Jionghao Wang, Zhengming Yu 他
日本語で読む → - 論文触覚/サーベイロボティクス
身体化知能における触覚ベースのマルチモーダル融合:視覚・言語・接触駆動パラダイムのサーベイ
触覚と視覚・言語を統合するマルチモーダル触覚融合の研究を包括的に調査し、データセットと手法の階層的分類法を提案した論文。
原題: Tactile-based Multimodal Fusion in Embodied Intelligence: A Survey of Vision, Language, and Contact-Driven Paradigms / Zhixiang Cao, Di Tian, Runwei Guan 他
日本語で読む → - 論文VLA/操作ロボティクス
Dexora: 高自由度両腕巧緻操作のためのオープンソースVLA
両腕・両手の高自由度操作を対象とした初のオープンソースVLAシステムDexoraを提案し、ハイブリッド遠隔操作とデータ品質を考慮した学習手法により、巧緻操作の成功率を大幅に向上させた。
原題: Dexora: Open-source VLA for High-DoF Bimanual Dexterity / Zongzheng Zhang, Jingrui Pang, Zhuo Yang 他
日本語で読む → - 論文セキュリティ/マニピュレーションロボティクス
ロボットマニピュレータにおける偽データ注入攻撃に対する能動的防御
ロボットマニピュレータへの偽データ注入攻撃(FDIA)に対する防御手法を提案し、異常検知を考慮した仮想減衰と可操作度低減の2つの方法を確率的保証付きで定式化した。7自由度冗長マニピュレータのシミュレーションで有効性を検証した。
原題: Active Defense Against False Data Injection Attacks in Robotic Manipulators / Gabriele Gualandi, Carl Mikael Larsson, Alessandro V. Papadopoulos
日本語で読む → - 論文強化学習機械学習
数分でレースを学習:Mini WheelbotにおけるInfoprop Dyna
実機のMini Wheelbot(一輪車ロボット)が、モデルベース強化学習フレームワークInfoprop Dynaを用いて、実世界でのインタラクションのみから11分でトラックを周回するレースを学習できることを実証した論文。
原題: Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot / Devdutt Subhasish, Henrik Hose, Sebastian Trimpe
日本語で読む → - 論文遠隔操作/強化学習ロボティクス
確率的遅延下でのロボット遠隔操作のための残差強化学習
確率的通信遅延による信号不連続性に対処するため、LSTMによる状態推定と残差強化学習を組み合わせたハイブリッド制御フレームワークを提案し、遅延下でも安定した遠隔操作を実現した。
原題: Residual Reinforcement Learning for Robot Teleoperation under Stochastic Delays / Kaize Deng, Zewen Yang
日本語で読む → - 論文視線推定画像認識
Gaze4HRI: 人間ロボット相互作用のための視線推定ニューラルネットワークのゼロショットベンチマーク
人間ロボット相互作用における視線推定の頑健性を評価する大規模データセットとベンチマークを提案し、既存手法が特定条件下で失敗することを明らかにした。
原題: Gaze4HRI: Zero-shot Benchmarking Gaze Estimation Neural-Networks for Human-Robot Interaction / Berk Sezer, Ali Görkem Küçük, Erol Şahin 他
日本語で読む → - 論文ソフトロボティクスロボティクス
トポロジー最適化による空気圧ソフトアクチュエータの設計と実験的検証
非線形トポロジー最適化を用いて空気圧駆動のソフトアクチュエータを3D設計し、造形・実験で性能を検証した論文。
原題: Topology-Optimized Pneumatic Soft Actuator: Design and Experimental Validation / Sumit Mehta, Konstantinos Poulios
日本語で読む → - 論文ナビゲーションロボティクス
CLUE: 統一セマンティックマップによる適応的優先コンテキスト手がかりを用いたゼロショット物体目標ナビゲーション
ゼロショット物体目標ナビゲーションにおいて、LLMを用いて物体と部屋の関連性を推定し、部屋と物体のコンテキスト手がかりを適応的に重み付けして探索するフレームワークを提案。シミュレーションと実世界で成功率と経路効率を向上させた。
原題: CLUE: Adaptively Prioritized Contextual Cues by Leveraging a Unified Semantic Map for Effective Zero-Shot Object-Goal Navigation / Taeyun Kim, Alvin Jinsung Choi, Dasol Hong 他
日本語で読む → - 論文エッジAI/教育ロボットロボティクス
エッジデバイスを用いたソーシャルロボット向けローカル言語モデルのベンチマーキング
ソーシャル教育ロボット向けに、エッジハードウェア上で動作する25種類のオープンソース言語モデルを、推論効率・一般知識・教育効果の3次元で評価し、最適なモデル選択と3層推論アーキテクチャを提案した論文。
原題: Benchmarking Local Language Models for Social Robots using Edge Devices / Dorian Lamouille, Matevž B. Zorec, Farnaz Baksh 他
日本語で読む → - 論文VLAロボティクス
適応を資産へ変える:オンライン視覚言語ナビゲーションのためのクロスドメインブリッジング
非定常な環境変化に直面する視覚言語ナビゲーションエージェントのオンライン適応において、適応を一時的な更新ではなく資産の蓄積と合成として捉える新しいTTAフレームワークIDEAを提案し、忘却や負の転移を防ぎつつ、学習不要の適応を実現する。
原題: Turning Adaptation into Assets: Cross-Domain Bridging for Online Vision-Language Navigation / Zixuan Hu, Xuantuo Huang, Yancheng Li 他
日本語で読む → - 論文自動運転データ統合ロボティクス
123D: 大規模マルチモーダル自動運転データの統合
自動運転の多様なデータセットを単一APIで統合するオープンソースフレームワークを提案し、8つの実データセットと合成データを統合して、クロスデータセットでの3D物体検出や強化学習などの応用を実証した。
原題: 123D: Unifying Multi-Modal Autonomous Driving Data at Scale / Daniel Dauner, Valentin Charraut, Bastian Berle 他
日本語で読む → - 論文ナビゲーションロボティクス
LiDARで教え、レーダーで繰り返す:劣化・変動環境における頑健なクロスモーダルナビゲーション
教示・反復ナビゲーションにおいて、教示時はLiDAR、実行時は4Dミリ波レーダーを用いることで、悪天候や環境変化に頑健なナビゲーションを実現するシステムを提案した。
原題: LiDAR Teach, Radar Repeat: Robust Cross-Modal Navigation in Degenerate and Varying Environments / Renxiang Xiao, Yichen Chen, Yuanfan Zhang 他
日本語で読む → - 論文ヒューマノイド操作ロボティクス
Imagine2Real: ビデオ生成事前知識によるヒューマノイドと物体のゼロショット対話の実現
3Dデータ不足を補うため、ビデオ生成モデルから得た4D点軌跡と少数の重要点追跡を用いて、幾何モデル不要でヒューマノイドと物体の対話動作をゼロショットで生成するフレームワークを提案した。
原題: Imagine2Real: Towards Zero-shot Humanoid-Object Interaction via Video Generative Priors / Jiahe Chen, ZiRui Wang, Feiyu Jia 他
日本語で読む → - 論文アフォーダンス接地ロボティクス
アフォーダンスエージェントハーネス:検証ゲートによるスキルオーケストレーション
オープンワールドでのアフォーダンス接地を改善するため、検証ゲート付きのクローズドループランタイムを提案し、適応的なスキル選択とエビデンス蓄積により精度とコストのトレードオフを向上させた。
原題: Affordance Agent Harness: Verification-Gated Skill Orchestration / Haojian Huang, Jiahao Shi, Yinchuan Li 他
日本語で読む → - 論文ナビゲーションロボティクス
SAGA: 安全なUAV自律ナビゲーションのためのロバストな自己注意と目標認識アンカーベースプランナー
本論文は、UAVの安全な自律ナビゲーションのための新しいプランナーSAGAを提案する。深度画像と運動状態から、固定アンカー格子に対する終端状態と計画スコアを単一のフォワードパスで予測し、自己注意と極座標位置エンコーディングを用いてクロスアンカー推論を行う。
原題: SAGA: A Robust Self-Attention and Goal-Aware Anchor-based Planner for Safe UAV Autonomous Navigation / Junhao Wei, Yanxiao Li, Dexing Yao 他
日本語で読む → - 論文エージェント推論AI
自己制御型シミュレーション計画による効率的なエージェント推論
エージェントの推論を、シミュレーション推論・自己制御・反応実行の3システムに分解し、必要な時だけ計画を呼び出す自己制御機構を導入したLLMエージェントSR^2^AMを提案。大規模モデルに匹敵する性能を少ないトークンで達成した。
原題: Efficient Agentic Reasoning Through Self-Regulated Simulative Planning / Mingkai Deng, Jinyu Hou, Lara Sá Neves 他
日本語で読む → - 論文3Dシーングラフ/能動探索ロボティクス
固定外部カメラを共通事前地図として用いた能動的3Dシーングラフ生成
ロボットの移動前に固定外部RGBカメラの観測を事前地図として活用し、ロボット搭載カメラと統合して能動的に3Dシーングラフを生成するフレームワークを提案した。
原題: Fixed External Cameras as Common Prior Maps for Active 3D Scene Graph Generation / Giorgia Modi, Davide Buoso, Giuseppe Averta 他
日本語で読む →