論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文経路計画ロボティクス
OmniPlanner: ロボット形態を横断する汎用探索・点検経路計画
空中・地上・水中ロボットに共通して使える、探索と点検のための統合経路計画フレームワークを提案した論文。
原題: OmniPlanner: Universal Exploration and Inspection Path Planning across Robot Morphologies / Angelos Zacharia, Mihir Dharmadhikari, Mohit Singh 他
日本語で読む → - 論文ナビゲーションロボティクス
車いす向け社会的認識と透明性を備えた自律移動ナビゲーションフレームワーク
車いす利用者のための自律移動システムに、大規模言語モデルを用いて他者の意図を予測し社会的状況を認識する意思決定機構と、各経由点での判断理由をテキストで提示する透明性機能を統合したフレームワークを提案し、シミュレーションで評価した。
原題: SAATT Nav: a Socially Aware Autonomous Transparent Transportation Navigation Framework for Wheelchairs / Yutong Zhang, Shaiv Y. Mehra, Bradley S. Duerstock 他
日本語で読む → - 論文位置推定ロボティクス
ブドウ園におけるロボット位置推定のための意味的ランドマーク粒子フィルタ
ブドウ園の平行な列による見た目の類似性で位置推定が失敗する問題に対し、幹や柱の検出を意味的な壁として計測モデルに組み込んだ粒子フィルタを提案し、実地実験で精度を向上させた。
原題: Semantic Landmark Particle Filter for Robot Localisation in Vineyards / Rajitha de Silva, Jonathan Cox, James R. Heselden 他
日本語で読む → - 論文強化学習ロボティクス
解析的力学正則化による物理情報を活用した方策最適化
ロボット制御の強化学習に、シミュレータから得られる微分可能なラグランジュ残差を正則化項として導入し、物理的に一貫した方策学習を効率化する手法PIPERを提案した。
原題: Physics-Informed Policy Optimization via Analytic Dynamics Regularization / Namai Chandra, Liu Mohan, Zhihao Gu 他
日本語で読む → - 論文ナビゲーションロボティクス
月面自律チャレンジのためのフルスタックナビゲーション・マッピング・プランニング
GNSSが使えない月面環境で、セマンティックセグメンテーション、ステレオ視覚オドメトリ、SLAM、階層的プランニングを統合した自律航法システムを構築し、競技で1位を獲得した。
原題: Full Stack Navigation, Mapping, and Planning for the Lunar Autonomy Challenge / Adam Dai, Asta Wu, Keidai Iiyama 他
日本語で読む → - 論文イベントカメラ画像認識
効率的なイベントカメラボリュームシステム
イベントカメラのストリームを連続時間のディラックインパルス列としてモデル化し、DCT/DTFT/DWT変換と密度適応型選択により圧縮するフレームワークを提案。圧縮アーティファクトを除去しつつ、下流タスクでの汎化性能を向上させる。
原題: Efficient Event Camera Volume System / Juan Camilo Soto, Ian Noronha, Saru Bharti 他
日本語で読む → - 論文VLAロボティクス
ReMem-VLA: 二重レベル再帰クエリによる記憶を備えた視覚言語行動モデル
視覚言語行動モデルに、フレーム単位とチャンク単位の再帰クエリを導入し、短期・長期記憶を実現。過去の観測予測を補助タスクとして追加し、記憶依存タスクで既存モデルを大幅に上回る性能を達成した。
原題: ReMem-VLA: Empowering Vision-Language-Action Model with Memory via Dual-Level Recurrent Queries / Hang Li, Fengyi Shen, Dong Chen 他
日本語で読む → - 論文VLAロボティクス
Ψ₀: 汎用人型ロコマニピュレーションに向けたオープン基盤モデル
高品質な一人称視点の人間動画でVLMを事前学習し、人型ロボットの実機データで追加学習する段階的パラダイムにより、少ないデータで人型ロコマニピュレーションを実現するオープン基盤モデルを提案した。
原題: $\Psi_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation / Songlin Wei, Hongyi Jing, Boqian Li 他
日本語で読む → - 論文自動運転/HDマップロボティクス
オンラインHDマップ構築におけるラベル品質への位置推定誤差の影響
自動運転車のHDマップをオンラインで構築する際、既存マップをラベルとして使うが、位置推定誤差がラベル品質を劣化させる。誤差の種類と距離に基づく評価指標を導入し、モデル性能への影響を分析した。
原題: Impact of Localization Errors on Label Quality for Online HD Map Construction / Alexander Blumberg, Jonas Merkert, Richard Fehler 他
日本語で読む → - 論文VLAロボティクス
FocusVLA: 視覚言語行動モデルにおける視覚情報の焦点化
VLAモデルの性能が視覚表現の質ではなく視覚情報の活用方法に制限されることを示し、注意をタスク関連領域に集中させるFocusVLAを提案した。
原題: FocusVLA: Focused Visual Utilization for Vision-Language-Action Models / Yichi Zhang, Weihao Yuan, Yizhuo Zhang 他
日本語で読む → - 論文自動運転/地図生成/動作予測ロボティクス
不確実性が重要:自動運転における動作予測のための構造化確率的オンラインマッピング
オンライン地図生成を確率的タスクとして扱い、低ランク+対角成分の共分散分解で空間的相関を捉える不確実性モデルを提案し、地図生成と動作予測の精度を向上させた。
原題: Uncertainty Matters: Structured Probabilistic Online Mapping for Motion Prediction in Autonomous Driving / Pritom Gogoi, Faris Janjoš, Bin Yang 他
日本語で読む → - 論文LiDAR/自己教師あり学習画像認識
LIORNet: 悪天候下の自動運転のための自己教師ありLiDAR除雪フレームワーク
雪などの悪天候でLiDAR点群に混入するノイズを、物理的・統計的手がかりから生成した擬似ラベルを用いた自己教師あり学習で除去するフレームワークを提案した。
原題: LIORNet: Self-Supervised LiDAR Snow Removal Framework for Autonomous Driving under Adverse Weather Conditions / Ji-il Park, Inwook Shim
日本語で読む → - 論文筋骨格ロボット/強化学習ロボティクス
Diff-Muscle: 筋骨格ロボット卓球のための効率的学習
筋骨格ロボットの制御を、微分平坦性を用いて冗長な筋活性化空間から低次元の関節空間へ再定式化し、階層的強化学習により卓球ラリーを実現する手法を提案した。
原題: Diff-Muscle: Efficient Learning for Musculoskeletal Robotic Table Tennis / Wentao Zhao, Jun Guo, Kangyao Huang 他
日本語で読む → - 論文視覚-触覚融合画像認識
視覚-触覚融合による透明破片の輪郭推定:自律的再組立に向けて
透明な破片の輪郭を視覚と触覚の融合で推定するフレームワークを提案し、データセットとネットワークを構築して実世界で検証した。
原題: Transparent Fragments Contour Estimation via Visual-Tactile Fusion for Autonomous Reassembly / Qihao Lin, Borui Chen, Yuping Zhou 他
日本語で読む → - 論文マニピュレーションロボティクス
Bi-HIL: サブタスク進行率とキーフレームメモリを用いた双方向制御に基づくマルチモーダル階層模倣学習による長時間の接触を伴うロボット操作
長時間の接触を伴うロボット操作を安定化するため、サブタスク進行率とキーフレームメモリを統合した双方向制御ベースの階層模倣学習フレームワークを提案し、実機タスクで有効性を検証した。
原題: Bi-HIL: Bilateral Control-Based Multimodal Hierarchical Imitation Learning via Subtask-Level Progress Rate and Keyframe Memory for Long-Horizon Contact-Rich Robotic Manipulation / Thanpimon Buamanee, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文UAV誘導ロボティクス
閉鎖空間点検のための幾何学的視線角整形戦略
無人航空機による閉鎖空間の点検飛行のため、視線角を双曲線正接型の整形関数で制御する新しい誘導則を提案し、安定性解析と6自由度シミュレーションで有効性を示した論文。
原題: Geometric Look-Angle Shaping Strategy for Enclosed Inspection / Amit Shivam, Manuel C. R. M. Fernandes, Sergio Vinha 他
日本語で読む → - 論文マニピュレーションロボティクス
RoboLight: 線形合成可能な照明を備えたロボットマニピュレーション用データセット
照明条件を体系的に変化させた実世界のロボット操作データセットを構築し、光の線形性を利用してHDR画像空間で補間することで合成データを大量生成した研究。
原題: RoboLight: A Dataset with Linearly Composable Illumination for Robotic Manipulation / Shutong Jin, Jin Yang, Muhammad Zahid 他
日本語で読む → - 論文ナビゲーションロボティクス
FLUX: 整流フローと静的から動的への学習によるクロス身体性生成ナビゲーションポリシーの高速化
動的ナビゲーションベンチマークDynBenchを導入し、フローベースの統一ナビゲーションポリシーFLUXを提案。直線軌道で推論を高速化し、静的から動的へのカリキュラムで社会的ナビゲーションと静的タスクの堅牢性を向上、ゼロショットで多種ロボットに転移可能。
原題: FLUX: Accelerating Cross-Embodiment Generative Navigation Policies via Rectified Flow and Static-to-Dynamic Learning / Zeying Gong, Yangyi Zhong, Yiyi Ding 他
日本語で読む → - 論文SLAMロボティクス
TRGS-SLAM: ぼやけ・ローリングシャッター・ノイズを含む熱画像のためのIMU支援ガウススプラッティングSLAM
熱カメラの劣化(モーションブラー、ローリングシャッター歪み、固定パターンノイズ)に対処するため、3Dガウススプラッティングに基づく熱慣性SLAMシステムを提案し、実世界の高速・高ノイズ熱データで正確なトラッキングを実現した。
原題: TRGS-SLAM: IMU-Aided Gaussian Splatting SLAM for Blurry, Rolling Shutter, and Noisy Thermal Images / Spencer Carmichael, Katherine A. Skinner
日本語で読む → - 論文VLA/ベンチマーク画像認識
ESPIRE: 視覚言語モデルの身体化空間推論のための診断ベンチマーク
視覚言語モデルの空間推論能力を身体化ロボットタスクで評価する診断ベンチマークを提案し、タスクを位置特定と実行に分解して生成問題として扱うことで、受動的な空間推論を超えた分析を可能にした。
原題: ESPIRE: A Diagnostic Benchmark for Embodied Spatial Reasoning of Vision-Language Models / Yanpeng Zhao, Wentao Ding, Hongtao Li 他
日本語で読む → - 論文操作ロボティクス
短期的視野を超えて:非マルコフ的シミュレーションベンチマークにおける頑健な長期操作のためのVQメモリ
非マルコフ的で長期的な操作タスクを評価する新しいベンチマーク「RuleSafe」を提案し、過去の状態を離散トークンに符号化するVQメモリ表現が、既存のVLAモデルの長期計画と汎化性能を向上させることを示した。
原題: Beyond Short-Horizon: VQ-Memory for Robust Long-Horizon Manipulation in Non-Markovian Simulation Benchmarks / Honghui Wang, Zhi Jing, Jicong Ao 他
日本語で読む → - 論文ユーザー適応/好み学習ロボティクス
相互作用による改善:CMA-ES-IGによる行動表現空間の探索
ユーザーの好みをランキングから学習する際、ユーザー体験を考慮して知覚的に異なる情報豊富な軌道を提案するCMA-ES-IGアルゴリズムを提案し、シミュレーションと実機実験で有効性を示した。
原題: Improving through Interaction: Searching Behavioral Representation Spaces with CMA-ES-IG / Nathaniel Dennler, Zhonghao Shi, Yiran Tao 他
日本語で読む → - 論文群制御ロボティクス
共有環境におけるフロー認識型マルチエージェント経路探索を用いた衝突緩和
動的な非制御エージェントと共有する環境で、その動きの学習パターンをMAPFに統合し、衝突を最大55%削減するフレームワークを提案した。
原題: Conflict Mitigation in Shared Environments using Flow-Aware Multi-Agent Path Finding / Lukas Heuer, Yufei Zhu, Luigi Palmieri 他
日本語で読む → - 論文歩行ロボティクス
不連続な足場におけるヒューマノイド歩行のための知覚型可変タイミング足踏み計画
障害物や危険な地面領域により不連続な足場環境で、足の配置と歩行タイミングを同時に計画する混合整数モデル予測制御フレームワークを提案。深度画像から凸な可踏領域を抽出し、DCMダイナミクスに基づく安全性制約を組み込むことで、実時間で動的に一貫した歩容を生成する。
原題: Perceptive Variable-Timing Footstep Planning for Humanoid Locomotion on Disconnected Footholds / Zhaoyang Xiang, Upama Pant, Ayonga Hereid
日本語で読む → - 論文社会的ナビゲーションロボティクス
社会的ナビゲーションロボットの人間の知覚を予測・改善するための因果的アプローチ
移動ロボットに対する人間の能力や意図の知覚を予測する因果ベイジアンネットワークを提案し、組み合わせ探索によりロボットの行動を改善する手法を導入した。
原題: A Causal Approach to Predicting and Improving Human Perceptions of Social Navigation Robots / Maximilian Diehl, Nathan Tsoi, Gustavo Chavez 他
日本語で読む → - 論文UAV制御ロボティクス
全方位UAVにおける作動認識型制御配分のための後退水平ヌル空間最適化
全方位UAVの制御配分に、アクチュエータの非対称ダイナミクスを考慮し、予測ホライズン内でヌル空間最適化によりモータ指令の振動を抑制する手法を提案した。
原題: Receding-Horizon Nullspace Optimization for Actuation-Aware Control Allocation in Omnidirectional UAVs / Riccardo Pretto, Mahmoud Hamandi, Abdullah Mohamed Ali 他
日本語で読む → - 論文デジタルツイン/試験ロボティクス
最適化可能から対話可能へ:車両・インフラ協調システムの混合デジタルツイン試験
車両・インフラ協調システムの試験に、人間が直接介入できるL5レベルの対話可能なデジタルツインを導入し、高品質なコーナーケースを生成するフレームワークを提案した。
原題: From Optimizable to Interactable: Mixed Digital Twin-Empowered Testing of Vehicle-Infrastructure Cooperation Systems / Jianghong Dong, Chunying Yang, Mengchi Cai 他
日本語で読む → - 論文VLA/エッジAIcs.PF
VLAモデルの特性解析:エッジAIアーキテクチャにおける行動生成ボトルネックの特定
エッジハードウェア上でVLAモデルの性能を評価し、メモリ帯域がボトルネックとなる行動生成フェーズを特定。将来の大規模モデルへの拡張に必要なハードウェア要件を予測した。
原題: Characterizing VLA Models: Identifying the Action Generation Bottleneck for Edge AI Architectures / Manoj Vishwanathan, Suvinay Subramanian, Anand Raghunathan
日本語で読む → - 論文四足歩行ロボティクス
四足ロボットの斜面歩行におけるエネルギー予測
四足ロボットの野外でのエネルギー消費を、傾斜角と進行方向に基づく簡易モデルで予測する手法を提案し、実地検証でその有効性を示した論文。
原題: Energy Prediction on Sloping Ground for Quadruped Robots / Mohamed Ounally, Cyrille Pierre, Johann Laconte
日本語で読む → - 論文強化学習/適応制御ロボティクス
世界モデルフィードバックによるオンライン連続強化学習を用いた自己適応ロボットエージェント
ロボット制御の展開中に環境変化へ自動適応するため、世界モデルの予測残差で異常を検出し、微調整を自動トリガーするオンライン連続強化学習フレームワークを提案した。
原題: Self-adapting Robotic Agents through Online Continual Reinforcement Learning with World Model Feedback / Fabian Domberg, Georg Schildbach
日本語で読む →