論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文航法/制御ロボティクス
トラクタートレーラー航法のためのニューラル距離誘導パス積分制御
トラクタートレーラーシステムの安全な自律航法のために、LiDAR点群から車両全体の距離を推定するニューラルエンコーダをMPPIコントローラに統合し、地図不要で複雑な農業環境での衝突回避を実現した。
原題: Neural Distance-Guided Path Integral Control for Tractor-Trailer Navigation / Peng Wei, Chen Peng, Stavros Vougioukas
日本語で読む → - 論文3Dビジュアルグラウンディング画像認識
SceneGraphGrounder: 構造化シーングラフマッチングによるゼロショット3Dビジュアルグラウンディング
3Dシーングラフを構築し、クエリをグラフとして照合することで、ゼロショットで3D物体を言語指示により特定する手法を提案した。
原題: SceneGraphGrounder: Zero-Shot 3D Visual Grounding via Structured Scene Graph Matching / Xuefei Sun, Xujia Zhang, Brendan Crowe 他
日本語で読む → - 論文群制御ロボティクス
三次元不均一環境におけるソフト人工ヘビの学習・移動・ナビゲーション
生物に着想を得た駆動・センシングモデルを強化学習に統合し、ソフト人工ヘビが複雑な三次元地形を自律的にナビゲートする枠組みを提案した。
原題: Learning, locomotion, and navigation of soft synthetic snakes in three-dimensional, heterogeneous environments / Xiaotian Zhang, Ali Albazroun, Tixian Wang 他
日本語で読む → - 論文操作ロボティクス
LLMによる将来仮説の生成を用いた多段階ロボット操作における地平線認識探索
多段階ロボット操作において、LLMとビデオ拡散モデルを用いて短期的な未来ビデオを生成し、それを条件としてポリシーを学習することで、探索と適応を改善する手法を提案した。
原題: LLM-Guided Future Hypotheses for Horizon-Aware Exploration in Multi-Step Robot Manipulation / Mohammad Khoshnazar, Andrew Melnik, Michael Beetz
日本語で読む → - 論文sim2realロボティクス
浮遊廃棄物回収用ASVにおける統合認識を備えた強化学習制御のSim-to-Real転移とロバスト性評価
浮遊ゴミ回収用の自律水上艇(ASV)に対し、カメラベースの偏光認識と軽量DRL制御を組み合わせ、シミュレーションのみで訓練した制御器を実機に直接適用するシステムを構築し、sim-to-real転移の評価手法と実地試験結果を示した。
原題: Sim-to-Real Transfer and Robustness Evaluation of Reinforcement Learning Control with Integrated Perception on an ASV for Floating Waste Capture / Luis F. W. Batista, Stéphanie Aravecchia, Cédric Pradalier
日本語で読む → - 論文経路計画ロボティクス
凸ニューラルRRT*:高品質なロボット経路計画のための高速かつ信頼性の高い学習誘導サンプリング
ニューラルネットワークで高品質経路の近傍領域を予測し、その凸包領域にサンプリングを集中させることで、計算時間を大幅に削減しつつ経路長も改善するRRT*の拡張手法を提案した。
原題: Convex-Neural RRT*: Fast and Reliable Learning-Guided Sampling for High-Quality Robot Path Planning / Hichem Cheriet, Badra Khellat Kihel, Samira Chouraqui 他
日本語で読む → - 論文安全制御ロボティクス
平滑化された陰的接触ダイナミクスのための安全制御
接触を伴うタスクの安全制御を実現するため、平滑化パラメータの影響を解析し、接触力の近似誤差を考慮した離散時間制御バリア関数を提案した。
原題: Safety-Critical Control for Smoothed Implicit Contact Dynamics / Haegu Lee, Yitaek Kim, Christoffer Sloth
日本語で読む → - 論文3D再構成画像認識
良いトークンの狩り方:視覚幾何学トランスフォーマーにおけるトークン選択の手引き
視覚幾何学トランスフォーマーの計算コストを削減するため、フレーム間・フレーム内の2段階でトークンを選択する手法を提案し、精度を保ちつつ85%以上の高速化を実現した。
原題: Good Token Hunting: A Hitchhiker's Guide to Token Selection for Visual Geometry Transformers / Shuhong Zheng, Michael Oechsle, Erik Sandström 他
日本語で読む → - 論文VLAロボティクス
X-DiffVLA: クロスエンボディ拡散行動ヘッドを備えた視覚言語行動モデル
異なるエンドエフェクタを持つロボット間で知識を転移できる拡散ベースのVLAモデルを提案し、エンボディフォーシングと形態学的ツリー拡散により性能を向上させた。
原題: X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models / Boyu Li, Chaoyi Xu, Haoqi Yuan 他
日本語で読む → - 論文ナビゲーションロボティクス
MASt3R-Nav: 相対3DマップにおけるWayPixelナビゲーション
画像ペア間の相対3D座標系でのピクセル対応に基づくピクセル相対接続性マップを提案し、これをコストマップとして用いて制御器を訓練することで、高精度な視覚ナビゲーションを実現した。
原題: MASt3R-Nav: WayPixel Navigation in Relative 3D Maps / Vansh Garg, Rohit Jayanti, Krish Pandya 他
日本語で読む → - 論文制御ロボティクス
多様体制約付きMPPI:ハード制約下でのリアルタイムサンプリングベース制御
標準MPPIのソフトペナルティでは保証できないハード制約を満たすため、VAEで制約多様体の潜在表現を学習し、実行レベルでQPにより残差を補正するMC-MPPIを提案した。閉連鎖双腕システムで100Hz動作を実証した。
原題: Manifold-Constrained MPPI: Real-Time Sampling-Based Control Under Hard Constraints / Seulchan Lee, Sanghyun Kim
日本語で読む → - 論文マニピュレーションロボティクス
TapSampling: タスク進捗理解型検証器を用いた推論時サンプリングによるロボット操作
ロボット操作の汎用ポリシーに対して、推論時に複数の行動候補をサンプリングし、タスク進捗を予測する検証器で最適な行動を選ぶプラグアンドプレイなフレームワークを提案した。
原題: TapSampling: Inference-Time Sampling with a Task-Progress-Understanding Verifier for Robotic Manipulation / Sizhe Zhao, Shengping Zhang, Shuo Yang 他
日本語で読む → - 論文操作学習ロボティクス
Tabero: 視覚・触覚・言語からの閉ループ力フィードバックによる優しい操作の学習
触覚フィードバックを活用した優しいロボット操作を実現するため、データ効率的なパイプラインで視覚・触覚・言語データを生成し、力と位置を分離した指令インターフェースを持つモデルを提案。優しい指示下で把持力を70%以上削減しつつ高い成功率を維持した。
原題: Tabero: Learning Gentle Manipulation with Closed-Loop Force Feedback from Vision, Touch, and Language / Qiwei Wu, Rui Zhang, Xin Xiang 他
日本語で読む → - 論文強化学習機械学習
FLAG: 潜在拡張ガイダンスによるフローポリシーMaxEnt-RL
最大エントロピー強化学習において、重要度重みの崩壊を避けるためサンプリング領域を局所化し、フロー潜在変数で状態空間を拡張して代理目的を最適化する手法FLAGを提案。高次元制御タスクでSOTA性能を達成。
原題: FLAG: Flow Policy MaxEnt-RL by Latent Augmented Guidance / Sungha Kim, Gawon Lee, Jusuk Lee 他
日本語で読む → - 論文群制御ロボティクス
REACT: 車輪型移動ロボットの連続隊列ナビゲーションのための環境適応型アーキテクチャ
車輪型移動ロボットの隊列制御において、環境に応じて隊列を動的に生成・維持する階層型アーキテクチャREACTを提案し、衝突のない割り当てと時空間軌道計画により障害物環境での連続ナビゲーションを実現した。
原題: REACT: Environment-Adaptive Architecture for Continuous Formation Navigation of Wheeled Mobile Robots / Jianghong Dong, Yifeng Zhang, Jiawei Wang 他
日本語で読む → - 論文触覚/強化学習/sim2realロボティクス
触覚スキンを用いた2本指間での小物体の制御分離の学習
多目的ロボットハンドの2本指で小物体を掴み、触覚のみを用いて所望の個数だけ指間に残す制御分離タスクを提案・解決した。強化学習をシミュレーションで訓練し、実機への転送も成功させた。
原題: Learning Controlled Separation of Small Objects Between Two Fingers with a Tactile Skin / Ulf Kasolowsky, Berthold Bäuml
日本語で読む → - 論文オドメトリロボティクス
惑星探査のためのリアルタイム非同期単眼オドメトリの設計
イベントカメラと誤差状態カルマンフィルタを用いて、惑星探査ローバーのリアルタイム自己位置推定を行う単眼オドメトリの設計を提案した論文。
原題: Design of a Real-time Asynchronous Monocular Odometry for Planetary Exploration / Benat Inigo, Florian Steidle, Wolfgang Stuerzl
日本語で読む → - 論文ロボット学習/動作生成ロボティクス
スムーズなリアルタイムチャンキングのためのアクション事前分布デノイジング
リアルタイムチャンキングの訓練時シミュレーションを拡張し、前のチャンクとの整合性を保つソフトな制約を導入。Kinetixベンチマークで高遅延時の動作の滑らかさを改善した。
原題: Action-Prior Denoising for Smooth Real-Time Chunking / Dongyang Liu, Zhaowen Zheng, Yu Sun 他
日本語で読む → - 論文ロボット学習機械学習
OGPO: 生成制御ポリシーのサンプル効率的な完全ファインチューニング
拡散やフローベースの生成制御ポリシーを、オフポリシーな批判ネットワークとPPO目的関数を用いて効率的にファインチューニングする手法OGPOを提案し、操作タスクで最先端の性能を達成した。
原題: OGPO: Sample Efficient Full-Finetuning of Generative Control Policies / Sarvesh Patil, Mitsuhiko Nakamoto, Manan Agarwal 他
日本語で読む → - 論文強化学習ロボティクス
照明変化に頑健な人間参加型ロボット強化学習
照明変化による視覚分布のずれで性能が落ちる問題に対し、追加の実ロボット操作なしで、画像の再照明と忘却防止機構を組み合わせたオフライン微調整フレームワークRoHILを提案した。
原題: RoHIL: Robust Human-in-the-Loop Robotic Reinforcement Learning Against Illumination Variations / Shuoqin Zhang, Yixin Xiong, Xiru Gao 他
日本語で読む → - 論文VLA/展開ロボティクス
工場フロアでのVLAパイプライン展開事例研究:産業用包装タスクにおけるワークフロー、失敗、教訓
産業用包装タスクで事前学習済みVLAポリシーを工場現場に適応させる実践的な取り組みを報告し、反復的な微調整と展開駆動の改善を通じて得られた失敗モードと教訓をまとめた。
原題: A Factory-Floor Deployment Case Study of VLA Pipelines for Industrial Packaging Task: Workflow, Failures, and Lessons / Brian Zhu, Philipp Schmitt, Philine Meister 他
日本語で読む → - 論文VLAロボティクス
DEFLECT: 遅延ロバストな非同期VLAのための時間的反実在選好学習
非同期VLAの遅延による予測と実行のミスマッチを、反実在選好学習で修正するオフライン後訓練フレームワークを提案。
原題: DEFLECT: Temporal Counterfactual Preference Learning for Delay-Robust Asynchronous VLAs / Yixiang Zhu, Yonghao Chen, Zijie Yang 他
日本語で読む → - 論文移動機構ロボティクス
惑星探査のための地形適応型グルーサホイール:設計と実験的検証
惑星探査ローバーの車輪のグルーサ高さを連続的に調整できる機構を提案し、様々な地形での実験により滑りやエネルギー消費を大幅に改善できることを示した論文。
原題: Terrain-Adaptive Grouser Wheel for Optimal Planetary Exploration: Design and Experimental Investigation / Vincent Griffo, Yashwanth Kumar Nakka
日本語で読む → - 論文自動運転ロボティクス
模倣を超えて:ハードネガティブから学ぶ安全なエンドツーエンド自動運転
成功事例だけでなく失敗事例も学習に取り入れることで、軌道の安全性を向上させる自動運転の模倣学習フレームワーク「BeyondDrive」を提案した論文。
原題: Beyond Imitation: Learning Safe End-to-End Autonomous Driving from Hard Negatives / Junli Wang, Zhihua Hua, Xueyi Liu 他
日本語で読む → - 論文協調認識/不確実性推定画像認識
Hyper-V2X: 協調型鳥瞰図セマンティックセグメンテーションにおける認識論的不確実性と偶然的不確実性を推定するハイパーネットワーク
V2X協調認識における不確実性推定を可能にするハイパーネットワークベースのフレームワークを提案し、既存の決定論的モデルに比べ低コストで正確な不確実性を提供する。
原題: Hyper-V2X: Hypernetworks for Estimating Epistemic and Aleatoric Uncertainty in Cooperative Bird's-Eye-View Semantic Segmentation / Abhishek Dinkar Jagtap, Sanath Tiptur Sadashivaiah, Andreas Festag
日本語で読む → - 論文教示学習ロボティクス
ロボットへの教示方法の比較:運動感覚、ジョイスティック、ジェスチャーによる教示
8人の参加者によるユーザー研究で、運動感覚ガイダンス、ジョイスティック遠隔操作、手のジェスチャーの3つの教示方法を比較し、再現成功率、作業負荷、教示エラーを評価した。
原題: How Should We Teach Robots? A Comparison of Kinesthetic, Joystick, and Gesture-Based Teaching / Petr Vanc, Jan Kristof Behrens, Václav Hlaváč 他
日本語で読む → - 論文物理特性推定ロボティクス
PhyPush: 物理誘導トランスフォーマーによるセンサレス物理特性推定は1回の押し動作で十分
ロボットアームのエンドエフェクタの速度情報のみを用いて、物体の質量と摩擦係数を1回の押し動作から推定する物理誘導トランスフォーマーを提案した。
原題: PhyPush: One Push is All You Need for Sensorless Physical Property Estimation with Physics-Guided Transformers / Koyo Fujii, Luis Figueredo, Praminda Caleb-Solly 他
日本語で読む → - 論文自動運転ロボティクス
自動運転における遅延と精度のトレードオフ最適化のための多解像度エンドツーエンド深層ニューラルネットワーク
自動運転のリアルタイム性と精度の両立を目指し、シーンや計算資源に応じて入力解像度を動的に切り替えられる多解像度CNNを提案し、CARLA環境で安全性指標の改善を実証した。
原題: Multi-Resolution End-to-End Deep Neural Network for Optimizing Latency-Accuracy Tradeoff in Autonomous Driving / Qitao Weng, Heechul Yun
日本語で読む → - 論文状態推定ロボティクス
GNSS由来の加速度計測を用いたINS/GNSS状態推定の強化
GNSS位置情報と運動モデルから加速度を推定し、INS/GNSSフィルタに統合することで、特に低ダイナミクス時の姿勢・センサ誤差の可観測性を改善し、位置精度を向上させた。実データ2種で平均位置誤差を11.40%と20.74%削減した。
原題: Enhanced INS/GNSS State Estimation using GNSS-Based Acceleration Measurements / Gal Versano, Itzik Klein
日本語で読む → - 論文ナビゲーションロボティクス
屋内移動ロボットのための学習ベースナビゲーション
屋内移動ロボット向けに、コスト考慮型A*の教師データで学習したグローバルプランナーと、強化学習で洗練したローカルプランナーを組み合わせたナビゲーションフレームワークを提案・評価した論文。
原題: Learning-Based Navigation for Indoor Mobile Robots / Tri-Tin Nguyen, Tien-Dat Nguyen, Gia-Uy Le 他
日本語で読む →