論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文物体位置推定ロボティクス
地図より記憶を:再構成なしの3D物体位置推定
3Dシーン再構成を行わず、姿勢付きRGB-Dキーフレームのみを記憶して視覚言語モデルで候補を絞り、必要時に奥行き逆投影と多視点融合で対象の3D位置を推定する手法を提案。
原題: Memory Over Maps: 3D Object Localization Without Reconstruction / Rui Zhou, Xander Yap, Jianwen Cao 他
日本語で読む → - 論文自動運転テストロボティクス
コードから道路へ:自動運転における中央車載サーバテストのための車両インザループとデジタルツインに基づくフレームワーク
実車と仮想環境を同期させる車両インザループとデジタルツイン技術を用いて、集中型E/Eアーキテクチャの自動運転ソフトウェアを安全かつ再現可能にテストするフレームワークを提案した。
原題: From Code to Road: A Vehicle-in-the-Loop and Digital Twin-Based Framework for Central Car Server Testing in Autonomous Driving / Chengdong Wu, Sven Kirchner, Nils Purschke 他
日本語で読む → - 論文sim2realロボティクス
ROBOGATE:二段階境界サンプリングによるロボット方策の安全展開のための適応的失敗発見
物理シミュレーションと二段階の適応的サンプリングで操作方策の失敗境界を効率的に探索し、VLA方策のシミュレータ間ギャップなど展開リスクを検証する枠組みを提案。
原題: ROBOGATE: Adaptive Failure Discovery for Safe Robot Policy Deployment via Two-Stage Boundary-Focused Sampling / Azuki Kim
日本語で読む → - 論文VIO/SLAMロボティクス
ROFT-VINS: 過酷な環境向けの頑健な特徴追跡に基づく視覚慣性状態推定
深層学習を用いて単眼カメラ画像の視覚特徴を頑健に追跡し、テクスチャのない環境や急激な照明変化でも安定して動作するVIOシステムを提案した。
原題: ROFT-VINS: Robust Feature Tracking-based Visual-Inertial State Estimation for Harsh Environment / Sanghyun Park, Soohee Han
日本語で読む → - 論文単眼深度推定ロボティクス
AsyncMDE: 非同期空間メモリによるリアルタイム単眼深度推定
凍結した基盤モデルと軽量な高速パスを非同期に組み合わせ、フレーム間の冗長性を活用してエッジ上でリアルタイムに単眼深度推定を行う手法を提案。
原題: AsyncMDE: Real-Time Monocular Depth Estimation via Asynchronous Spatial Memory / Lianjie Ma, Yuquan Li, Bingzheng Jiang 他
日本語で読む → - 論文衝突回避ロボティクス
U-OBCA: Wasserstein分布ロバスト確率制約による不確実性を考慮した最適化ベース衝突回避
ロボットの安全なナビゲーションのため、多角形ロボットと障害物の衝突リスクを確率制約として定式化し、分布の不確実性をWasserstein距離でロバスト化した衝突回避手法を提案した。
原題: U-OBCA: Uncertainty-Aware Optimization-Based Collision Avoidance via Wasserstein Distributionally Robust Chance Constraints / Zehao Wang, Yuxuan Tang, Han Zhang 他
日本語で読む → - 論文3D占有予測画像認識
O3N: 都市自律エージェントのための全方位オープンボキャブラリ占有予測
単一の全方位RGB画像から360度の3D占有を予測する初のオープンボキャブラリ手法を提案し、極座標スパイラルMambaと視覚・ボクセル・テキストの整合機構で高精度かつ汎化性能を実現した。
原題: O3N: Omnidirectional Open-Vocabulary Occupancy Prediction for Urban Autonomous Agents / Mengfei Duan, Hao Shi, Fei Teng 他
日本語で読む → - 論文強化学習機械学習
強化学習の解釈のための損失ランドスケープ可視化フレームワーク:ADHDPケーススタディ
強化学習の学習過程を可視化するフレームワークを提案し、ADHDPアルゴリズムを宇宙機の姿勢制御に適用して、損失曲面や状態TDマップなど4つの視点から学習ダイナミクスを解釈する。
原題: A Loss Landscape Visualization Framework for Interpreting Reinforcement Learning: An ADHDP Case Study / Jingyi Liu, Jian Guo, Eberhard Gill
日本語で読む → - 論文手術ロボティクス/3D再構成ロボティクス
Instrument-Splatting++: ガウススプラッティングによる制御可能な手術器具デジタルツインの実現
単眼ビデオから手術器具を高忠実度で再構成し、姿勢や関節角度を制御可能な3Dガウスアセットとして表現するフレームワークを提案した。CAD事前情報と意味的セグメンテーションを活用し、未ポーズ動画からでも高精度な姿勢推定とテクスチャ学習を実現する。
原題: Instrument-Splatting++: Towards Controllable Surgical Instrument Digital Twin Using Gaussian Splatting / Shuojue Yang, Zijian Wu, Chengjiaao Liao 他
日本語で読む → - 論文ナビゲーションロボティクス
DRIVE-Nav: 方向推論・検査・検証による効率的なオープンボキャブラリナビゲーション
未知環境で言語指定の物体を探す際、生のフロンティアではなく持続的な「方向」単位で探索を構造化し、240度前方視野内の関連方向のみを再検討することで冗長な再訪を抑え、経路効率と接地信頼性を高めるゼロショット物体ナビゲーション手法。
原題: DRIVE-Nav: Directional Reasoning, Inspection, and Verification for Efficient Open-Vocabulary Navigation / Maoguo Gao, Zejun Zhu, Zhiming Sun 他
日本語で読む → - 論文強化学習・計画ロボティクス
強化学習と動的計画法に基づく計画の関係
強化学習と計画の違いを整理し、非確率化した強化学習と価値反復法やダイクストラ法を比較して、コスト最小化と報酬最大化の等価条件などを解析した。
原題: Relating Reinforcement Learning to Dynamic Programming-Based Planning / Filip V. Georgiev, Kalle G. Timperi, Başak Sakçak 他
日本語で読む → - 論文運動学・モデリングcs.GR
MineRobot: 鉱山用ロボットのアクチュエータ中心運動学モデリング・求解フレームワーク
鉱山ロボットの閉リンク機構をアクチュエータ中心にモデリングし、順運動学と逆運動学を効率的に解くフレームワークを提案。
原題: MineRobot: An Actuator-Centered Kinematic Modeling and Solving Framework for Underground Mining Robots / Shengzhe Hou, Xinming Lu, Tianyu Zhang 他
日本語で読む → - 論文自動運転/プランニングロボティクス
自動運転のための時間的に分離された拡散プランニング
自動運転の軌道生成を時間的に分離し、近い将来と遠い将来の異なる依存関係を扱う拡散モデルを提案。ノイズをマスクとして用いる手法と新しい正規化層により、nuPlanベンチマークで高い性能を達成した。
原題: Temporally Decoupled Diffusion Planning for Autonomous Driving / Xiang Li, Bikun Wang, John Zhang 他
日本語で読む → - 論文状態推定ロボティクス
学習ダイナミクスの集合被覆計測を用いた脚式ロボットの固有受容感覚のみによる状態推定
脚式ロボットの状態推定を、関節計測から学習したダイナミクスモデルを集合被覆計測として用いて行い、ガウス性を仮定せずに一貫性を保つ手法を提案した。
原題: Proprioceptive-only State Estimation for Legged Robots with Set-Coverage Measurements of Learned Dynamics / Abhijeet M. Kulkarni, Ioannis Poulakakis, Guoquan Huang
日本語で読む → - 論文ナビゲーションAI
身体性を伴う意味シーングラフ生成のための強化学習ナビゲーションの現代化
限られた行動予算内で意味シーングラフを構築するため、ナビゲーション方策の最適化手法と離散行動設計を見直し、シーングラフ完全性や衝突回避性能を評価した。
原題: Modernising Reinforcement Learning-Based Navigation for Embodied Semantic Scene Graph Generation / Roman Küble, Marco Hüller, Mrunmai Phatak 他
日本語で読む → - 論文触覚ロボティクス
MuxGel:空間多重化と深層再構成による視覚・触覚の同時デュアルモーダルセンシング
チェッカーボード状の被膜で触覚領域と透明窓を交互に配置し、単一カメラで外部視覚と接触触覚を同時取得するGelSight型センサを提案。U-Net再構成で密な視覚・触覚信号を復元する。
原題: MuxGel: Simultaneous Dual-Modal Visuo-Tactile Sensing via Spatially Multiplexing and Deep Reconstruction / Zhixian Hu, Zhengtong Xu, Sheeraz Athar 他
日本語で読む → - 論文マニピュレーションロボティクス
RMBench:記憶依存型ロボットマニピュレーションのベンチマークと政策設計への洞察
記憶を必要とするロボット操作タスクを体系的に評価する9タスクのシミュレーションベンチマークRMBenchと、明示的記憶モジュールを持つ操作政策Mem-0を提案し、既存政策の記憶限界と設計指針を明らかにした。
原題: RMBench: Memory-Dependent Robotic Manipulation Benchmark with Insights into Policy Design / Tianxing Chen, Yuran Wang, Mingleyang Li 他
日本語で読む → - 論文群制御ロボティクス
太陽熱発電所の日射量予測精度向上のための非類似度に基づくマルチロボット持続的カバレッジ制御
クリギングモデルから導出した非類似度マップを用いて、予測精度向上に必要な領域へ移動センサを誘導する持続的カバレッジ制御アルゴリズムを提案し、移動ロボット実験で有効性を実証した。
原題: Dissimilarity-Based Persistent Coverage Control of Multi-Robot Systems for Improving Solar Irradiance Prediction Accuracy in Solar Thermal Power Plants / Haruki Kawase, Taiga Sugawara, A. Daniel Carnerero
日本語で読む → - 論文VLAロボティクス
形態情報をTransformerに埋め込むクロスロボット方策学習
ロボットの関節構造やトポロジーをTransformerに組み込み、複数の機体にまたがって動作する方策を学習する手法を提案した論文。
原題: Embedding Morphology into Transformers for Cross-Robot Policy Learning / Kei Suzuki, Jing Liu, Ye Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
Saranga: 手のひらサイズの空中ロボットによる視覚劣化環境でのナビゲーションのためのミリワット超音波センシング
手のひらサイズのドローン向けに、低消費電力の超音波センサーと深層学習によるノイズ除去を組み合わせ、霧や暗闇などの視界不良環境での障害物回避を可能にするシステムを提案した。
原題: Saranga: MilliWatt Ultrasound for Navigation in Visually Degraded Environments on Palm-Sized Aerial Robots / Manoj Velmurugan, Phillip Brush, Colin Balfour 他
日本語で読む → - 論文模倣学習/マニピュレーションロボティクス
見て切り替える:視覚に基づく分岐による対話型ロボットスキルプログラミング
タスクをスキル部品のグラフとして表現し、視覚入力で条件分岐を選ぶ対話型の教示・実行フレームワークを提案。初心者8名による3つの器用な操作タスクで最大90.6%の分岐選択精度を達成した。
原題: See and Switch: Vision-Based Branching for Interactive Robot-Skill Programming / Petr Vanc, Jan Kristof Behrens, Václav Hlaváč 他
日本語で読む → - 論文軟体ロボット/遊泳ロボティクス
軟体ロボット遊泳体の急速加速のための受動的位相指向インピーダンス整形
軟体ロボットの遊泳において、制約層ダンピング(CLD)を受動的機構として用い、周波数選択的にインピーダンスを整形することで、推力と加速を大幅に向上させる手法を提案した。
原題: Passive Phase-Oriented Impedance Shaping for Rapid Acceleration in Soft Robotic Swimmers / Qimin Feng, Orion A. Roberts, Qiang Zhong
日本語で読む → - 論文HRI/ROS 2/生理センサHCI
Sense4HRI: ROS 2対応の生理センサ統合と同期ログ記録を備えたHRIフレームワーク
ROS 2ベースのHRIシステムで生理信号を標準化して統合・同期記録するための拡張可能なフレームワークを提案した論文。
原題: Sense4HRI: A ROS 2 HRI Framework for Physiological Sensor Integration and Synchronized Logging / Manuel Scheibl, Julian Leichert, Sinem Görmez 他
日本語で読む → - 論文遠隔操作ロボティクス
基本操作タスクにおける遠隔操作インターフェースの適合性に関するユーザー調査
3DマウスとVRコントローラの2つの遠隔操作インターフェースを、6自由度ロボットアームでのボタン押しとノブ回しという基本タスクで比較し、タスク特性に応じて適したインターフェースが異なることを示した。
原題: A User Study on the Suitability of Teleoperation Interfaces for Primitive Manipulation Tasks / Jun Aoki, Shunki Itadera
日本語で読む → - 論文リハビリテーション/ユーザ参加HCI
ロボット車いす開発におけるユーザー参加:10年間の限定的進展
過去10年間のロボット車いす研究におけるエンドユーザー参加の実態をレビューし、参加が限定的で評価段階に偏っていることを明らかにした論文。
原題: User Involvement in Robotic Wheelchair Development: A Decade of Limited Progress / Mario Andres Chavarria, Santiago Price Torrendell, Aude Billard 他
日本語で読む → - 論文3D再構築画像認識
ドライブスルーでの車両外観3D再構築:動的シーンSfMと歪み対応ガウシアンスプラッティング
ディーラーのドライブスルーで動く車両を、動的背景やレンズ歪み、反射に対応したパイプラインで高精細に3D再構築する手法を提案した。
原題: Drive-Through 3D Vehicle Exterior Reconstruction via Dynamic-Scene SfM and Distortion-Aware Gaussian Splatting / Nitin Kulkarni, Akhil Devarashetti, Charlie Cluss 他
日本語で読む → - 論文VLA/ナビゲーション/マニピュレーションロボティクス
DiffusionAnything: 統一ナビゲーションと把持前動作のためのエンドツーエンド・インコンテキスト拡散学習
RGB画像のみから、メートル規模のナビゲーションとセンチメートル規模のマニピュレーションを単一モデルで計画する拡散ポリシーを提案。タスクごとに5分の自己教師ありデータで学習し、未知シーンへのゼロショット汎化を実現する。
原題: DiffusionAnything: End-to-End In-context Diffusion Learning for Unified Navigation and Pre-Grasp Motion / Iana Zhura, Yara Mahmoud, Jeffrin Sam 他
日本語で読む → - 論文自律着陸ロボティクス
SafeLand: ベイズ意味マッピングによる未知環境での安全な自律着陸
カメラと軽量高度センサのみで未知環境の安全な着陸地点をオンラインで意味マッピングし、動的障害物にリアルタイム対応するUAV着陸システムを提案・実証した。
原題: SafeLand: Safe Autonomous Landing in Unknown Environments with Bayesian Semantic Mapping / Markus Gross, Andreas Greiner, Sai Bharadhwaj Matha 他
日本語で読む → - 論文ナビゲーションロボティクス
言語条件付き視覚ナビゲーションのためのポリシー誘導型ワールドモデルプランニング
学習済みナビゲーションポリシーと潜在ワールドモデルプランニングを組み合わせた二段階フレームワークPiJEPAを提案し、言語指示に基づく視覚ナビゲーションの性能を向上させた。
原題: Policy-Guided World Model Planning for Language-Conditioned Visual Navigation / Amirhosein Chahe, Lifeng Zhou
日本語で読む → - 論文VLA/自動運転ロボティクス
ETA-VLA: 時間融合とLLM内スパース化による視覚言語行動モデルの効率的トークン適応
自動運転向けVLAモデルの計算負荷を減らすため、過去フレームの冗長な視覚トークンをテキストガイドと時間的一貫性で間引くフレームワークを提案し、精度を保ちつつ推論FLOPsを大幅削減した。
原題: ETA-VLA: Efficient Token Adaptation via Temporal Fusion and Intra-LLM Sparsification for Vision-Language-Action Models / Yiru Wang, Anqing Jiang, Shuo Wang 他
日本語で読む →