論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
RoboNav-Arm: エージェント型AIによる雑然環境下でのロボットマニピュレータのナビゲーションと障害物回避
動的で予期しない障害物がある環境でロボットマニピュレータが安全にタスクを実行するための、エージェント型AIを用いた障害物回避フレームワークを提案した。リアルタイムの障害物検出と3D位置推定、状況に応じたプランニングアルゴリズムの選択、軌道の分析と改良により、衝突のない安全な実行を実現する。
原題: RoboNav-Arm: Agentic AI-Driven Navigation and Obstacle Avoidance for Robotic Manipulator in Cluttered Environments / Aachal Sharma, Narendra Kumar Dhar
日本語で読む → - 論文シミュレーション環境生成ロボティクス
EmbodiedGen V2: 具身知能のためのエージェント型・シミュレーション対応3Dワールドエンジン
シミュレーション対応の3Dアセットを自動で組み立て、操作・ナビゲーションなどのタスク環境を生成できる世界エンジンを提案。生成環境での強化学習により、シミュレーション成功率と実ロボット成功率を大幅に向上させた。
原題: EmbodiedGen V2: An Agentic, Simulation-Ready 3D World Engine for Embodied AI / Xinjie Wang, Liu Liu, Taojun Ding 他
日本語で読む → - 論文模倣学習ロボティクス
AgenticFocus: 人間の一人称視点ビデオからの物体保持型MR合成による器用なヒューマノイド学習
人間の一人称視点ビデオから、隠れた物体の形状復元と手の動きの再構築を行い、ヒューマノイドロボットの学習用デモを生成するMR合成パイプラインを提案した。
原題: AgenticFocus: Object-Preserving Mixed Reality Synthesis from Human FPV Video for Dexterous Humanoid Learning / Iaroslav Kolomiets, Miguel Altamirano Cabrera, Artem Lykov 他
日本語で読む → - 論文VLA/強化学習ロボティクス
ExToken: 効率的なVision-Language-Action強化学習のための構造化探索
VLAモデルの強化学習における探索停滞問題を分析し、軌跡の多様性がサンプル効率に重要であることを示した上で、オフラインのデモから得た離散的な行動プリミティブに基づいて探索を構造化するExTokenフレームワークを提案した。
原題: ExToken: Structured Exploration for Efficient Vision-Language-Action Reinforcement Fine-tuning / Yilun Kong, Yunpeng Qing, Guozheng Ma 他
日本語で読む → - 論文医療ロボティクスeess.IV
ロボット超音波のためのスパースな手術デモ注釈からの階層的気管解剖理解の学習
気管切開の正確な切開位置特定を目的に、YOLOv8nとSAM2を組み合わせた2段階の認識パイプラインを提案し、スパースな注釈から高精度な気管解剖セグメンテーションを実現した。
原題: Learning-based Hierarchical Tracheal Anatomy Understanding from Sparse Surgical Demonstration Annotations for Ultrasound Robots / Hiu Ching Cheung, Wenchao Yue, Zhengran Han 他
日本語で読む → - 論文群制御画像認識
エッジ対応型熱赤外UAV群追跡
熱赤外画像でのUAV群追跡を、エッジデバイス向けに効率的かつ頑健に行うパイプラインを提案。適応運動学カルマンフィルタにより、動きの激しいUAVやセンサジッタに対応しつつリアルタイム性を維持する。
原題: Edge-Aware Thermal Infrared UAV Swarm Tracking / Yu-Hsi Chen
日本語で読む → - 論文モーター制御ロボティクス
PRISM: 相互作用構造を持つモーター制御のための多項式表現
ロボットポリシーに多項式相互作用を明示的に組み込む新しい表現を提案し、強化学習と模倣学習で性能を向上させた。
原題: PRISM: Polynomial Representations for Interaction-Structured Motor Control / Seung Hyun Lee, Stella X. Yu
日本語で読む → - 論文群制御ロボティクス
複雑環境におけるマルチUAV協調航法:系統的マルチエージェント深層強化学習によるアプローチ
複雑環境での複数UAVの協調航法における局所最適、疎な報酬、学習不均衡、汎化不足を解決するマルチエージェント深層強化学習フレームワークを提案した。
原題: Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning / Yu Su, Nabil Aouf
日本語で読む → - 論文VLA/操作/sim2realロボティクス
実世界からシミュレーションへ、そして再び実世界へ:AMD ROCmベースの視覚言語行動操作パイプライン
AMDのROCmソフトウェアスタックのみを用いて、視覚言語行動(VLA)モデルの訓練から実機のFrankaアームへの展開までを一貫して行うパイプラインを構築し、CUDA非依存で物理AI操作が可能であることを示した。
原題: Real2Sim2Real for Vision-Language-Action Manipulation: An AMD ROCm-Based Pipeline / Qing Yang, Xun Wang, Ziguan Wang 他
日本語で読む → - 論文プランニングロボティクス
物理空間における隣接集合からの行動選択は、世界モデルの最良予測を凌駕する
サンプリングベースの制御器で、予測誤差により実行不可能な行動列が低コストと誤評価される問題を指摘し、隣接集合から行動を再構成する手法ASARを提案して成功率を向上させた。
原題: Action from Adjacent Set in Physical Space Outperforms the Best Prediction in World Models / Liangyu Li, Qingwen Liu, Mingqing Liu
日本語で読む → - 論文VLA/触覚/操作ロボティクス
N0-VTLA:潜在触覚トークンによる視覚・触覚・言語・行動モデルのスケーリング
触覚認識と触覚フィードバック制御を備えた視覚・触覚・言語・行動基盤モデルを提案し、大規模触覚データでの事前学習とオフライン強化学習によるポリシー改善を実現した。
原題: $N_0$-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens / NeoteAI Team, Fudan TEAI Team
日本語で読む → - 論文6D姿勢追跡画像認識
RRTrack: 動的シーンにおける頑健で復元可能な物体6D姿勢追跡
動的で遮蔽のあるシーンでの物体6D姿勢追跡を高速かつ頑健に行うため、2D-6D閉ループ追跡とDINOv2ベースのテンプレートマッチングによる再検出機能を備えたトラッカーRRTrackを提案した。
原題: RRTrack: Robust and Recoverable Object 6D Pose Tracking for Dynamic Scenes / Junyue Li, Ye Zheng, Yifan Chen 他
日本語で読む → - 論文群制御ロボティクス
都市型ドローン物流ネットワークのための飛行回廊と通信インフラの同時計画
都市環境でのUAV飛行経路と基地局配置を同時最適化するフレームワークを提案し、通信品質を保ちながらインフラ投資と飛行距離を削減する。
原題: Co-planning of Flight Corridors and Communication Infrastructure for Urban Drone Logistics Networks / Yingjie He, Yikang Wang, Zhenyu Gao
日本語で読む → - 論文意思決定制御
有限信頼性表現:ノイズ校正された信念空間カバーによる信頼性の高い意思決定
センサやアクチュエータのノイズに基づいて信念空間をセルで覆い、各セル内で最適行動価値関数の変動を許容範囲に抑えることで、信頼性の高い意思決定を可能にするフレームワークを提案した。
原題: Finite Reliability Representations: Noise-Calibrated Belief-Space Covers for Reliable Decision-Making / Hyung-Jin Yoon, Hunmin Kim
日本語で読む → - 論文ナビゲーションロボティクス
インスタンス強化セマンティックマップによる視覚言語ナビゲーション
視覚言語ナビゲーションのための、インスタンスレベルの詳細情報を持つ2.5Dセマンティックマップを構築し、LLMベースのクエリ処理と融合により多様な指示に対して頑健なナビゲーションを実現するフレームワークを提案した。
原題: Instance-Enriched Semantic Maps for Visual Language Navigation / Jiho Hong, Eunae Kang, Sanghyun Kim 他
日本語で読む → - 論文UAV自律性ロボティクス
NEUROSYMLAND: 神経記号的着陸地点評価による堅牢かつエッジ展開可能なUAV自律性
本論文は、UAVの安全な着陸地点評価のために、軽量な知覚と明示的な安全推論を統合した神経記号的システムNEUROSYMLANDを提案し、シミュレーションとハードウェア実験でその堅牢性とエッジ展開可能性を示した。
原題: NEUROSYMLAND: Neuro-Symbolic Landing-Site Assessment for Robust and Edge-Deployable UAV Autonomy / Weixian Qian, Tianyi Yang, Sebastian Schroder 他
日本語で読む → - 論文世界モデル画像認識
Orbis 2: 運転のための階層的世界モデル
運転タスク向けに、高レベル予測と低レベル生成を組み合わせた階層的世界モデルを提案し、拡散強制と教師強制の2段階学習で表現力と安定性を両立させた。
原題: Orbis 2: A Hierarchical World Model for Driving / Sudhanshu Mittal, Arian Mousakhan, Silvio Galesso 他
日本語で読む → - 論文ハードウェア/触覚/マニピュレーションロボティクス
MIDAS Hand: モジュール式低インピーダンス直接駆動の人間型感覚ハンド
低コストでオープンソースな人間型ロボットハンドを開発し、触覚センサと直接駆動を統合して操作研究用に提供した。
原題: MIDAS Hand: Modular low-Impedance Direct-drive Anthropomorphic Sensing Hand / Alvin Zhu, Mingzhang Zhu, Beom Jun Kim 他
日本語で読む → - 論文VLA/操作ロボティクス
FM-VLA: 接触を伴う操作における視覚言語行動モデルのための力覚ベースメモリ
視覚言語行動モデルに力覚履歴をメモリとして組み込み、非マルコフ的で接触を伴う操作タスクの時間的文脈推論を可能にした。
原題: FM-VLA: Force-based Memory for Vision-Language-Action Models in Contact-Rich Manipulation / Ruicheng Li, Qixiu Li, Ruichun Ma 他
日本語で読む → - 論文動作計画ロボティクス
タスク空間制約付き確率軌道最適化による林業クレーンの時間最適動作計画
林業クレーンの動作計画において、終端の関節配置を固定する代わりにタスク空間制約を導入し、冗長自由度を同時最適化することで、油圧ポンプ流量制約下での動作時間を平均12〜15%短縮する手法を提案した。
原題: Task-Space Constrained Stochastic Trajectory Optimization for Time-Optimal Forestry Crane Motion Planning / Marc-Philip Ecker, Christoph Fröhlich, Bernhard Bischof 他
日本語で読む → - 論文マニピュレーションロボティクス
二腕ロボットによる高精度組立作業の性能向上
CADモデルから二腕ロボットによる組立作業を実行するエンドツーエンドの枠組みを提案し、単腕と比較して実行時間を50%以上短縮できることを示した。
原題: Leveraging Two Robotic Arms for Tight Assembly Performance Gains / Dror Livnat, Yuval Lavi, Michael M. Bilevich 他
日本語で読む → - 論文SLAMロボティクス
低照度環境におけるSLAM:プロジェクト報告
低照度環境でのRGBカメラのみを用いたSLAMの性能を、6つの代表的なシステムを5つのシーケンスでベンチマークし、慣性融合と大域最適化の両方が低照度追跡に重要であることを示した。
原題: SLAM in Low-Light Environments: Project Report / Oleh Basystyi, Anna Stasyshyn, Oleksandr Kosovan 他
日本語で読む → - 論文群制御ロボティクス
移動ロボットと歩行者のインタラクションにおける安定性と快適性
非ホロノミック移動ロボットのための社会的認識アルゴリズムを開発し、安定性を証明して実験で性能を検証、歩行者の主観的快適性を統計的に分析した。
原題: Stability and Comfort in Mobile Robot-Pedestrian Interactions / Alireza Jafari, Hong-Son Nguyen, Yen-Chen Liu
日本語で読む → - 論文飛行制御ロボティクス
狭小空間における外乱を考慮した空中ロボット飛行
狭い空間でのクアッドローター飛行を安全かつ効率的にするため、外乱推定を計画・制御ループに統合したフレームワークを提案し、実機実験で有効性を示した。
原題: Disturbance-Aware Flight for Aerial Robots in Narrow Space / Lei Qiang, Tianyu He, Chenyang Sun 他
日本語で読む → - 論文運動計画ロボティクス
非ホロノミックロボットの飽和なし運動計画のための有限時間曲率制約ベクトル場
非ホロノミックロボットの運動計画において、曲率制約を明示的に満たし、有限時間収束を保証するベクトル場と飽和なし制御則を提案した。
原題: Finite-Time Curvature-Constrained Vector Field for Saturation-Free Motion Planning of Nonholonomic Robots / Zhouru Xiao, Sha Luo, Yang Lu 他
日本語で読む → - 論文強化学習機械学習
実用的な転移制約下での強化学習アルゴリズムの適合性再考
転移指向の強化学習において、アルゴリズムの適合性をサンプル効率だけでなく、実時間効率とドメインランダム化への頑健性の観点から評価し、PPOがSACやTD-MPC2よりも実時間で高性能な方策を学習できることや、ドメインランダム化が異なるパラダイムのアルゴリズムに同様の影響を与えることを示した。
原題: Rethinking the Suitability of Reinforcement Learning Algorithms Under Practical Transfer Constraints / Hany Hamed, Abhishek Naik, Colin Bellinger 他
日本語で読む → - 論文ナビゲーションロボティクス
BIM対応エージェントベース離散事象シミュレーションプラットフォーム:グラフ理論に基づく手法
BIMの豊富な建物情報を活用し、屋内ロボットのナビゲーションと作業計画を支援するシミュレーションプラットフォームを提案。環境をグリッド化してグラフに変換し、衝突回避経路を計算する。
原題: A BIM-enabled, Agent-based Discrete-event Simulation Platform for Robotic Studies: A Method based on Graph Theory / Ping Xu, Xinghua Gao
日本語で読む → - 論文非把持操作/失敗予測ロボティクス
PREFAIL: ロボットの持ち上げ配置作業における失敗の前兆を特定し、タスク実行性能を向上させる
非把持操作の持ち上げ配置作業で、対象物とキャリアの相対運動を分析して失敗の前兆を予測する手法を提案し、介入可能な最新時刻を定義したデータセットも導入した。シミュレーションと実世界で精度と即時性を向上させた。
原題: PREFAIL: Identifying Precursors to Failures in Robotic Lift-and-Place Tasks to Improve Task Execution Performance / Zeyu Shangguan, Rajas Chitale, Rutvik Patel 他
日本語で読む → - 論文安全強化学習ロボティクス
制御アフィン動力学近似を用いた証明可能な安全モデルベース強化学習
制御アフィン構造を考慮した残差モデル不確かさを学習し、適応共形予測で不確かさを定量化して制御バリア関数による安全保証を実現する強化学習フレームワークを提案した。
原題: Certifiable Safe Model-Based Reinforcement Learning with Control-Affine Dynamics Approximation / Hao Zhou, Yanze Zhang, Cameron Reid 他
日本語で読む → - 論文全身制御ロボティクス
意味的音声駆動による動的人型全身制御の理解
音声ストリームを音楽と音声に分岐し、音楽は指紋照合と意味埋め込みで、音声は模倣学習スキルライブラリで処理して、ロボットがリアルタイムで適切な動作スキルを自律選択・実行する枠組みを提案。シミュレーションと実機で検証。
原題: Semantic Audio-driven Understanding for Dynamic Humanoid Whole Body Control / J. M. A. Marcelo, M. Brienza, E. Bugli 他
日本語で読む →