論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
AllDayNav: 実世界強化学習による生涯ナビゲーション
動的環境での生涯ナビゲーションのために、明示的な地図やシーングラフを使わず、大規模モデルに強化学習でシーン動態を暗黙的に符号化し、自己進化するマルチモーダルメモリで長期動作を実現するフレームワークを提案した。
原題: AllDayNav: Lifelong Navigation via Real-World Reinforcement Learning / Hang Yin, Yinan Liang, Jiazhao Zhang 他
日本語で読む → - 論文意味マッピングロボティクス
イントラロジスティクスにおける文脈的意味マッピングのための視覚言語モデル推論
SLAMによる幾何マップにSAMによるインスタンス分割とVLMの多視点推論を組み合わせ、物体のクラスと可動性を推定する文脈的意味マップ生成パイプラインを提案した。
原題: Vision-Language Model Reasoning for Contextual Semantic Mapping in Intralogistics / Marvin Rüdt, Hao Pang, Constantin Enke 他
日本語で読む → - 論文自動運転ロボティクス
CLEAR: エンドツーエンド自動運転のための認知と潜在評価による適応ルーティング
拡散モデルの反復処理による遅延を避け、VAE潜在空間での単一ステップ生成と大規模言語モデルによるシーン理解を組み合わせた高速な自動運転プランニング手法を提案。NAVSIMベンチマークで最高性能を達成。
原題: CLEAR: Cognition and Latent Evaluation for Adaptive Routing in End-to-End Autonomous Driving / Yining Xing, Zehong Ke, Zhiyuan Liu 他
日本語で読む → - 論文VLA/汎化ロボティクス
APT: 行動エキスパートの事前学習による視覚-言語-行動ポリシーの指示汎化の改善
視覚-言語-行動モデルにおいて、言語データの不均衡が原因で未見の指示への汎化が悪い問題を、行動エキスパートを事前学習する二段階手法APTで解決した。
原題: APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies / Kechun Xu, Zhenjie Zhu, Anzhe Chen 他
日本語で読む → - 論文VLAロボティクス
TTT-VLA: テスト時潜在プロンプト最適化による視覚言語行動モデルの適応
視覚言語行動モデル(VLA)のテスト時分布シフトに対処するため、環境からの相互作用データを用いて潜在プロンプトのみを最適化するテスト時訓練フレームワークを提案した。
原題: TTT-VLA: Test-Time Latent Prompt Optimization for Vision-Language-Action Models / Wenbo Zhang, Jianxiong Li, Shuai Yang 他
日本語で読む → - 論文オフライン強化学習機械学習
RS-Diffuser: リスク感受性拡散プランニングと分布価値ガイダンス
オフライン強化学習において、リスク中立な拡散プランナーが稀な壊滅的結果を見落とす問題に対し、分布価値クリティックと尾部リスク指標を用いたリスク感受性ガイダンスを導入し、推論時のリスクパラメータ変更だけでリスク回避・中立・追求行動を柔軟に生成できるフレームワークを提案した。
原題: RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance / Shiqiang Gong
日本語で読む → - 論文制御配分制御
過駆動航空機のための統合的で解釈可能な制御効果学習と非線形制御配分手法
過駆動航空機の非線形制御配分問題に対し、スパース同定により物理制約付きの解釈可能な制御効果モデルを学習し、オンライン適応で故障や変化に対応する手法を提案した。
原題: An integrated interpretable control effectiveness learning and nonlinear control allocation methodology for overactuated aircrafts / Umut Demir, Aamir Ahmad, Walter Fichter
日本語で読む → - 論文ナビゲーション画像認識
階層的3Dシーングラフ構築と信念に基づく計画による意味的ナビゲーション
未知環境での意味的ナビゲーションのため、オンラインで階層的3Dシーングラフを構築し、その上で信念に基づく計画を行うゼロショット手法を提案。長距離シナリオで成功率と経路効率を向上させた。
原題: Hierarchical 3D Scene Graph Construction and Belief-based Planning for Semantic Navigation / Bing Wu, Zuyao Chen, Changwen Chen
日本語で読む → - 論文マルチオブジェクト追跡画像認識
PS-MOT: 点シードからインスタンス認識を育成するマルチオブジェクト追跡
バウンディングボックスではなく点のアノテーションだけでマルチオブジェクト追跡を実現する手法を提案。データ・モデル・損失の各レベルで点からインスタンスへの階層的パイプラインを構築し、既存の点教師付き追跡手法を上回る性能を達成した。
原題: PS-MOT: Cultivating Instance Awareness from Point Seeds for Multi-Object Tracking / Kai Luo, Fei Teng, Mengfei Duan 他
日本語で読む → - 論文3Dシーングラフ生成画像認識
OP3DSG: 実世界環境のためのオープンボキャブラリ部品認識3Dシーングラフ生成
物体だけでなく部品や関係性も含む統一的な3Dシーングラフを生成するフレームワークを提案し、実世界のロボットタスクでの有効性を示した。
原題: OP3DSG: Open-Vocabulary Part-Aware 3D Scene Graph Generation for Real-World Environments / Yirum Kim, Ue-Hwan Kim
日本語で読む → - 論文制御ロボティクス
深層強化学習を用いたイベント駆動型データ駆動予測制御の3次元ケーブル駆動ソフトロボットアームへの応用
ソフトロボットの制御において、計算負荷の高いデータ駆動予測制御(DeePC)を毎回実行する代わりに、強化学習で最適化実行のタイミングを学習し、計算回数を削減する手法を提案した。シミュレーションと実機で効果を検証している。
原題: Deep Reinforcement Learning-Enhanced Event-Triggered Data-Driven Predictive Control for a 3D Cable-Driven Soft Robotic Arm / Cheng Ouyang, Moeen Ul Islam, Kaixiang Zhang 他
日本語で読む → - 論文VLA/ナビゲーションロボティクス
FutureNav: 視覚言語ナビゲーションのための統合世界行動モデリング
視覚と言語によるナビゲーション(VLN)タスクにおいて、世界状態の遷移と将来予測を明示的にモデル化する統合フレームワークを提案し、4B規模のバックボーンで複数のベンチマークで最先端性能を達成した。
原題: FutureNav: Unified World-Action Modeling for Vision-and-Language Navigation / Lingfeng Zhang, Zeying Gong, Xiaoshuai Hao 他
日本語で読む → - 論文sim2realロボティクス
接触中心の実世界-シミュレーション-実世界学習:単一デモからの学習
実世界のデモから抽出した接触イベント列を報酬信号として用いることで、シミュレーションから実世界へのポリシー転移を接触中心の忠実度で改善する手法を提案した論文。
原題: ConCent: Contact-Centric Real-to-Sim-to-Real Learning from One Demonstration / Heecheol Kim, Namiko Saito, Katsushi Ikeuchi 他
日本語で読む → - 論文群制御ロボティクス
AUSLUN: GNSS拒否環境での海上探索・航法のための固定ホバリングUAV-USVシステム
GNSSが使えない沿岸域で、UAVを固定ホバリングさせて遠方の船舶を探索・位置特定し、USVを目標へ誘導するシステムを提案・実証した論文。
原題: AUSLUN: A Fixed-Hover UAV--USV System for GNSS-Denied Maritime Search and Navigation / Siyuan Yang, Zikai Jia, Hailiang Kuang 他
日本語で読む → - 論文空中追跡ロボティクス
FalconTrack: フォトリアルな自動ラベル認識と物理認識に基づく空中追跡
フォトリアルな編集可能シミュレータを用いて自動ラベル生成を行い、マルチヘッド認識と物理認識追跡を組み合わせることで、ゼロショットのシミュレーションから実世界への転移を実現する空中追跡フレームワークを提案した。
原題: FalconTrack: Photorealistic Auto-Labeled Perception and Physics-Aware Vision-Based Aerial Tracking / Yan Miao, Karteek Gandiboyina, Noah Giles 他
日本語で読む → - 論文軌道最適化/積層造形ロボティクス
拘束勾配投影による衝突回避冗長ロボット多軸積層造形の軌道最適化
冗長ロボットによる多軸積層造形の長大経路に対して、相対ヤコビアンとSDF衝突モデルを用い、自己運動多様体への射影で堆積位置制約を満たしつつ衝突回避と平滑化を実現する軌道最適化フレームワークを提案した。
原題: Trajectory Optimization for Collision-Aware Redundant Robotic Multi-Axis Additive Manufacturing by Constrained Gradient Projection / Zhikai Shen, Jiasheng Qu, Chenyu Xu 他
日本語で読む → - 論文発達学習/模倣学習ロボティクス
ロボットの発達的運動学習における双方向チュータリング:共発達的な相互作用ダイナミクスが安定した学習を支える
ロボットの運動学習において、チューターと学習者が相互に適応する双方向の教示が、一方向の教示よりも一貫した行動パターンを形成し、安定した学習と一般化を促進することを、実機ヒューマノイドと人間およびAIチューターを用いた実験で示した論文。
原題: Bidirectional Tutoring for Developmental Motor Learning in Robots: Co-Developed Interaction Dynamics Support Stable Learning / Rui Fukushima, Jun Tani
日本語で読む → - 論文連続体ロボット制御
連続体ロボットの離散幾何モデリングと拡張状態推定
連続体ロボットの動的モデリングと状態推定を、幾何学的に正確なビームモデルとリー群変分積分器を用いた完全離散アプローチで行い、外乱オブザーバを拡張カルマンフィルタで実装して実機で検証した。
原題: Discrete Geometric Modeling and Extended State Estimation of Continuum Robots / Maximilian Herrmann, Leander Pfeiffer, Paul Kotyczka
日本語で読む → - 論文マニピュレーションロボティクス
回転認識型ポイントクラウド埋め込みによるビジョンベースの手内再配向
手内での物体再配向タスクにおいて、現在と目標のポイントクラウドを直接比較するための回転認識型埋め込みを学習し、ポーズやフローなどの構造化入力を用いずに強化学習で制御可能にした。
原題: Rotation-Aware Point-Cloud Embeddings for Vision-Based In-Hand Reorientation / Yashom Dighe, Karthik Dantu
日本語で読む → - 論文群制御ロボティクス
車両プラトゥーンのための横方向ストリング安定性
本論文は、車両プラトゥーンにおける横方向の経路追従誤差の伝播を扱う新しい枠組みを提案し、車載センサのみでは誤差減衰が不可能である一方、V2V通信により真の誤差減衰が可能になることを示した。
原題: Lateral String Stability for Vehicle Platoons / Sixu Li, Swaroop Darbha, Yang Zhou
日本語で読む → - 論文自己位置推定ロボティクス
キネマティック自転車モデルの空間表現における不確実性の解析
車両の運動学モデルにおける不確実性を扱い、タイヤ変位と操舵角の不確実性下での共分散行列の時間発展をテイラー級数を用いて閉形式で導出し、モンテカルロシミュレーションと比較してその精度を検証した。
原題: Analyzing Uncertainty in the Spatial Representation of the Kinematic Bicycle Model / Shafayat Abrar, M. Zaeem Baig, Shahir Ul Islam Anzal 他
日本語で読む → - 論文歩行ロボティクス
SCAN-Planner: 経路誘導型長距離四足歩行ナビゲーションのための空間衝突認識ローカルプランナー
四足ロボットの長距離ナビゲーション向けに、ヨー角を考慮したツインシリンダーフットプリントと投影A*探索を用いた空間衝突認識ローカルプランニングフレームワークを提案し、狭い通路や3D非構造環境での安全で効率的な移動を実現した。
原題: SCAN-Planner: Spatial Collision-Aware Local Planning for Route-Guided Long-Range Quadruped Navigation / Han Zheng, Zhe Chen, Yiwen Fu 他
日本語で読む → - 論文マニピュレーションロボティクス
DexCompose: 単一の手による多タスク操作のための巧みなポリシー再利用
既存の巧みな操作ポリシーを再利用し、指レベルのアクション所有権に基づく役割認識型残差構成フレームワークを提案。2つの事前学習済みポリシーを組み合わせて、単一の手で複数のタスクを実行する。
原題: DexCompose: Reusing Dexterous Policies for Multi-Task Manipulation with a Single Hand / Dihong Huang, Zhenyu Wei, Zhuxiu Xu 他
日本語で読む → - 論文自己教師あり学習画像認識
OctoSense: マルチモーダルロボット知覚のための自己教師あり学習
複数のセンサを搭載したロボット用データセットと、センサの特性に合わせたマスクオートエンコーダによる自己教師あり学習手法を提案。既存の画像基盤モデルより優れた性能を示す。
原題: OctoSense: Self-Supervised Learning for Multimodal Robot Perception / Anthony Bisulco, Jeremy Wang, Kostas Daniilidis 他
日本語で読む → - 論文群制御ロボティクス
SPACE: 群知能フェロモン場による適応的衝突回避探索
多数のロボット群による未知環境探索で、混雑時の衝突を減らしつつ効率的な探索を実現するため、蟻の採餌行動に着想を得た分散協調手法SPACEを提案した。実建物のフロアプランで最大256台の群れを評価し、衝突率を大幅に低減しつつ探索時間はほぼ同等であることを示した。
原題: SPACE: Swarm Pheromone Fields for Adaptive Collision-Aware Exploration / Haohua Que, Haojia Gao, Mingkai Liu 他
日本語で読む → - 論文SLAMロボティクス
PL-LIT: 点・線特徴と熱画像マッピングを用いたLiDAR-慣性-熱SLAM
熱画像の課題を解決するため、点・線特徴抽出と光度校正を組み合わせたLiDAR-慣性-熱SLAMシステムを提案し、長距離熱赤外データセットで最先端性能を達成した。
原題: PL-LIT: A LiDAR-Inertial-Thermal SLAM Using Point-Line Features and Thermographic Mapping / Jiawei Xia, Yixiao Feng, Yongliang Shi 他
日本語で読む → - 論文マニピュレーションロボティクス
頑健な6自由度把握姿勢推定のためのクロスビュー融合フレームワーク
本論文では、コーナービューでの6自由度把握姿勢推定の頑健性を高めるため、補助ビューを統合し、自己教師あり対比学習と円筒座標系での融合モジュールを用いたクロスビュー融合フレームワークを提案する。
原題: A Cross-view Fusion Framework for Robust 6-DoF Grasp Pose Estimation / Kangjian Zhu, Haobo Jiang, Jianjun Qian 他
日本語で読む → - 論文自動運転/デジタルツインロボティクス
クエリ駆動型通信効率の高い自動運転向けデジタルツイン設計
自動運転のデジタルツイン構築において、冗長なデータ同期を避けるため、シミュレーション結果に基づいて必要な環境データを能動的に要求するクエリ駆動型アーキテクチャを提案し、通信効率と位置精度を改善した。
原題: A Query-Driven Communication-Efficient Digital Twins Design for Autonomous Driving / Nuocheng Yang, Longyu Zhou, Sihua Wang 他
日本語で読む → - 論文全身制御/耐故障/脚式移動マニピュレーションロボティクス
FT-WBC: 脚式移動マニピュレーションのための耐故障全身制御の学習
脚式移動マニピュレータのアクチュエータ故障時に、全身の安定性とアームの可動域を両立する耐故障制御フレームワークFT-WBCを提案した。故障推定器と姿勢適応モジュールにより、故障を予測し姿勢計画を適応させることで、シミュレーションと実機で生存率と可動域を向上させた。
原題: FT-WBC: Learning Fault-Tolerant Whole-Body Control for Legged Loco-Manipulation / Yudong Zhong, Pengfei Mai, Sikai Guo 他
日本語で読む → - 論文群制御機械学習
グラフ力学系における群知能に触発された集団行動の生成
局所的な相互作用則を学習して所望の大域的組織化を実現するグラフ力学系フレームワークSIESを提案し、同期制御やグラフ表現学習への応用を示した。
原題: Swarm-Inspired Generation of Collective Behaviors in Graph Dynamical Systems / Ji Chen, Song Chen, Chengzhang Gong 他
日本語で読む →