論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文基盤モデルロボティクス
ロボットにはVLAと世界モデルだけでは不十分
ロボットの汎用知能はポリシースケーリングだけでは不十分で、非構造化データをロボットの教師信号に変換する仕組みが必要だと主張するポジションペーパー。
原題: Robots Need More than VLA and World Models / Elis Karcini, Faisal Mehrban, Quang Nguyen 他
日本語で読む → - 論文自動運転ロボティクス
CLEAR: エンドツーエンド自動運転のための認知と潜在評価による適応ルーティング
拡散モデルの反復処理による遅延を避け、VAE潜在空間での単一ステップ生成と大規模言語モデルによるシーン理解を組み合わせた高速な自動運転プランニング手法を提案。NAVSIMベンチマークで最高性能を達成。
原題: CLEAR: Cognition and Latent Evaluation for Adaptive Routing in End-to-End Autonomous Driving / Yining Xing, Zehong Ke, Zhiyuan Liu 他
日本語で読む → - 論文意味マッピングロボティクス
イントラロジスティクスにおける文脈的意味マッピングのための視覚言語モデル推論
SLAMによる幾何マップにSAMによるインスタンス分割とVLMの多視点推論を組み合わせ、物体のクラスと可動性を推定する文脈的意味マップ生成パイプラインを提案した。
原題: Vision-Language Model Reasoning for Contextual Semantic Mapping in Intralogistics / Marvin Rüdt, Hao Pang, Constantin Enke 他
日本語で読む → - 論文3DGS/動的シーン/マッピングロボティクス
CubifyGS: 生涯動的シーン維持のためのオブジェクト中心3Dガウススプラッティング
ロボットの長期的なシーン更新において、動く物体を再利用可能なガウス資産として管理し、再構築ではなく資産の取得・剛体変換・明示的刈り込みで地図を更新する手法を提案。編集後の領域に限定した適応的最適化でゴーストや不整合を抑える。
原題: CubifyGS: Object-Centric 3D Gaussian Splatting for Lifelong Dynamic Scene Maintenance / Bohan Ren, Dianyi Yang, Shiyang Liu 他
日本語で読む → - 論文能動視覚/認識ロボティクス
ソナー目標認識における能動的多視点最適化のためのモデルベースとモデルフリーのハイブリッドフレームワーク
前方視ソナーを用いた能動的多視点目標認識において、CNNによる観測尤度とRadon変換による方位推定を組み合わせ、情報利得報酬でPPOエージェントを訓練して視点選択ポリシーを学習するハイブリッドフレームワークを提案した。
原題: A Hybrid Model-Based and Model-Free Framework for Active Multi-View Viewpoint Optimization in Sonar Target Recognition / Yongkyoon Park, Jane Shin
日本語で読む → - 論文変形物操作/sim2realロボティクス
SimWeaver: 変形物操作のためのゼロショットRGBシミュレーションから実世界への転移
変形物操作のためのRGBシミュレーションから実世界への転移を、実世界での微調整なしで実現する手法を提案。シミュレーション上のデモンストレーションのみで訓練したVLAポリシーが、5つの多様な変形物タスクで高い成功率を達成した。
原題: SimWeaver: Zero-Shot RGB Sim-to-Real for Deformable Manipulation / Wenkang Hu, Haoran Wang, Yitong Li 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動のための連続推論
自然言語はタスクレベルの粒度であり連続制御には不向きなため、VLAポリシーに適した連続思考を導入し、共有ガウス潜在変数として自己検証目的で学習する手法を提案した。
原題: Continuous Reasoning for Vision-Language-Action / Yueh-Hua Wu, Tatsuya Matsushima, Kei Ota
日本語で読む → - 論文経路計画ロボティクス
FPAS: 大規模未知環境のための適応サンプリングを用いたフロンティアベース経路計画
大規模未知環境での効率的な目標到達を実現するため、フロンティア概念を目標指向タスクに再解釈し、適応サンプリングで計算負荷を軽減する経路計画フレームワークを提案した。
原題: FPAS: Frontier-Based Path Planning with Adaptive Sampling for Large-Scale Unknown Environments / Jinwoo Choi, Yeonkyu Lee, Jung-Taak Kim 他
日本語で読む → - 論文設計自動化AI
ハイテクシステム設計のためのAI駆動合成:イノベーションの自動化
深層学習と生成AIを用いてシステム設計を自動化するフレームワークを提案し、e-driveシステム設計と空間寸法決定問題の2つのケーススタディで実証した。
原題: AI-Driven Synthesis for High-Tech System Design: Automating Innovation / Luuk Oerlemans, Steven Westerhof, Theo Hofman
日本語で読む → - 論文VLA/強化学習ロボティクス
Z-1: 視覚言語行動モデルのための効率的強化学習
フローベースのVLAモデルに強化学習を適用し、公開データセットのみで24タスクの成功率を大幅に向上させた。
原題: Z-1: Efficient Reinforcement Learning for Vision-Language-Action Models / Lang Cao, Renhong Chen, Luyi Li 他
日本語で読む → - 論文ウェアラブルロボットロボティクス
立位外乱下での軽量セミアクティブ背中支援デバイスによる姿勢安定性の向上
軽量なセミアクティブ背中支援デバイスを開発し、立位時の外乱に対する姿勢安定性を評価した。その結果、全身の角運動量を低減し、安定余裕を増加させてバランス回復性能を向上させた。
原題: Improved Postural Stability Using a Lightweight Semi-Active Soft Back Support Device Under Standing Perturbations / Rohan Khatavkar, Jiefeng Sun, Hyunglae Lee
日本語で読む → - 論文HRIロボティクス
LLMを用いた人間フィードバックによる反復強化学習で自然で表現豊かなロボットのジェスチャを生成
ヒューマノイドロボットPepperにChatGPTを統合し、自然言語からジェスチャを生成するシステムを構築。さらに、ユーザー評価に基づく反復強化学習(RLHF)を導入して、生成される動作の自然さを改善した。
原題: Generating Natural and Expressive Robot Gestures through Iterative Reinforcement Learning with Human Feedback using LLMs / Chris Lee, Flora Salim, Benjamin Tag 他
日本語で読む → - 論文群制御cs.MA
回廊ネットワークによる分散型自律交通管理
この論文は、複数の自律航空機が高密度で飛行する際の交通管理を、中央集権的な方法ではなく分散型で行うために、マルチエージェント強化学習を用いた手法を提案し、単一の回廊で訓練したポリシーが複雑なネットワークでもゼロショットで機能することを示しています。
原題: Decentralized Autonomous Traffic Management through Corridor Networks / Jasmine Jerry Aloor, Aadarsh Govada, Hamsa Balakrishnan
日本語で読む → - 論文力覚推定/模倣学習ロボティクス
FACTR 2: コモディティロボットアームの外力センシング学習がポリシー学習を向上させる
専用の力センサーを持たないロボットアームでも、データ駆動で外力トルクを推定するNEXTと、接触前後のデータを重点的に学習するFIRSTを組み合わせることで、力覚を活用した遠隔操作とポリシー学習を可能にした論文。
原題: FACTR 2: Learning External Force Sensing for Commodity Robot Arms Improves Policy Learning / Steven Oh, Jason Jingzhou Liu, Tony Tao 他
日本語で読む → - 論文ヒューマノイド歩行ロボティクス
TACT-ful:ペイロードに頑健な知覚ヒューマノイド歩行のためのマルチチャネル地形アフォーダンスとコンプライアンス訓練
単一の高さ情報では捉えられない地形特性を考慮するため、平坦性・急峻性・速度考慮の高さ可能性を組み合わせたマルチチャネル地形コストと前進登坂報酬を提案し、GPU並列DCM足場プランナと非対称アクタークリティック方策を深度画像からPPOで訓練する。また、仮想力を受ける下半身コンプライアンス訓練を導入し、力センサなしで負荷外乱に適応するヒューマノイド歩行を実現する。
原題: TACT-ful: Multi-Channel Terrain Affordance and Compliance Training for Payload-Robust Perceptive Humanoid Locomotion / Thanh Ly, Truong-Duy Dang, Chien Le 他
日本語で読む → - 論文模倣学習ロボティクス
TSD: 物理に着想を得た軌道顕著性検出器による効率的な模倣学習
ロボット操作の模倣学習において、データ収集コスト削減のため、軌道の重要度(顕著性)を物理指標(空間エントロピーと向心加速度)で検出する訓練不要のフレームワークTSDを提案し、データ圧縮・拡張に活用した。
原題: TSD: A Physics-Inspired Trajectory Saliency Detector for Efficient Imitation Learning / Yiming Zhao, Gongrui Ma, Qingkai Li 他
日本語で読む → - 論文エージェントアーキテクチャ探索ロボティクス
具現化エージェントアーキテクチャ設計の自動化
具現化エージェントのアーキテクチャ設計を自動化する手法を提案し、視覚言語ナビゲーションや操作タスクで有効性を検証した。
原題: Automating the Design of Embodied Agent Architectures / Jian Zhou, Sihao Lin, Jin Li 他
日本語で読む → - 論文ロボット学習ロボティクス
視覚検証による推論時制御と自律的なポリシー改善
汎用ロボットポリシーに視覚検証器を組み合わせ、推論時に行動を評価・選択することで追加学習なしで性能を向上させ、さらに検証済み軌道で微調整して自律的に改善する手法を提案した。
原題: Visual Verification Enables Inference-time Steering and Autonomous Policy Improvement / Mingtong Zhang, Dhruv Shah
日本語で読む → - 論文VLA画像認識
WAM4D: 空間レジスタトークンによる高速4Dワールドアクションモデル
ロボットの行動予測と未来観測を同時に行うワールドアクションモデルにおいて、軽量な空間レジスタトークンを用いて事前学習済みの幾何学的特徴を因果的なビデオ・アクショントランスフォーマーに転送し、高コストな幾何学的デコードを避けつつ4D空間整合性を向上させる手法を提案した。
原題: WAM4D: Fast 4D World Action Model via Spatial Register Tokens / Ying Li, Xiaobao Wei, Jiajun Cao 他
日本語で読む → - 論文触覚ロボティクス
TactX: 多様なセンサにわたる共有触覚表現の学習
異なる原理の触覚センサ(抵抗、磁気、視覚)からのデータを共通の潜在空間に写像するフレームワークTactXを提案し、あるセンサで訓練した操作ポリシーを別のセンサへゼロショット転移できることを示した。
原題: TactX: Learning Shared Tactile Representations Across Diverse Sensors / Junsung Park, Sachin Bhadang, Carmelo Sferrazza 他
日本語で読む → - 論文経路追従制御ロボティクス
非線形運動学モデルを用いた連結トラクタートレーラーシステムの経路追従性能の向上
連結トラクタートレーラーシステムの非線形運動学モデルを提案し、モデル予測制御と組み合わせてトレーラーの位置追従精度を向上させた。ROSとGazeboでシミュレーション検証を行った。
原題: Improving path-tracking performance of an articulated tractor-trailer system using a non-linear kinematic model / Marina Murillo, Guido Sanchez, Nestor Deniz 他
日本語で読む → - 論文VLAロボティクス
汎用ロボット操作のための身体化チェーン・オブ・ソートの再考
大規模な身体化CoTデータセットを構築し、VLAモデルにおける効果的なCoTの形式と統合方法を検証。推論をテスト時に使わず表現整形の教師信号として用いるERVLAを提案し、高い汎化性能を達成した。
原題: Revisiting Embodied Chain-of-Thought for Generalizable Robot Manipulation / Nan Sun, Yuan Zhang, Yongkun Yang 他
日本語で読む → - 論文ナビゲーションロボティクス
GNSS遮断環境向けベイズ学習強化ディープスムージング
GNSSが使えない環境でのナビゲーション精度を高めるため、ベイズ平滑化にトランスフォーマーによる学習を組み合わせた手法を提案し、クアッドローターのデータで精度向上を実証した。
原題: BLENDS: Bayesian Learning-Enhanced Deep Smoothing for GNSS-Denied Environments / Nadav Cohen, Itzik Klein
日本語で読む → - 論文操作ロボティクス
フローをフローとして:ロボット速度場を確率速度場としてモデル化しフローベース物体操作を実現
ロボットの動作を確率フローとしてモデル化し、フローマッチングに基づいて高品質かつ高速なロボットフロー生成を実現した物体操作フレームワークを提案。
原題: Flow as Flow: Modeling Robot Velocity Fields as Probability Velocity Fields for Flow-Based Object Manipulation / Koki Seno, Daichi Yashima, Yusuke Takagi 他
日本語で読む → - 論文ワールドモデル機械学習
等変ワールドモデルのための等角軌道有効信頼地平線
既知の群対称性を持つ潜在ワールドモデルに対して、ロールアウト誤差が制御される信頼地平線を認定する手法を提案し、等変性が信頼地平線を軌道全体に輸送することを示した。
原題: Conformal Orbit-Valid Trust Horizons for Equivariant World Models / Hongbo Wang
日本語で読む → - 論文運動計画/制御ロボティクス
制御バリア関数を用いた安全なポリトープ内ポリトープ運動計画と制御
ロボットのポリトープ形状のフットプリントを、連続的に更新される凸自由空間領域内に保証する安全な局所運動計画・制御手法を提案。モデル予測制御内で離散時間制御バリア関数制約として包含条件を定式化し、障害物数に依存しない計算効率を実現。
原題: Safe Polytope-in-Polytope Motion Planning and Control with Control Barrier Functions / Alejandro Gonzalez-Garcia, Dries Dirckx, Jan Swevers 他
日本語で読む → - 論文視覚的位置認識画像認識
深度認識蒸留による森林環境での視覚的位置認識
森林環境での視覚的位置認識の課題に対し、DINOv2ベースのモデルに幾何学的手がかりを注入する軽量な深度認識蒸留フレームワークを提案し、WildCrossベンチマークで外観変動に対する頑健性を向上させた。
原題: Visual Place Recognition in Forests with Depth-Aware Distillation / Walter Nedov, Saimunur Rahman, Kavindie Katuwandeniya 他
日本語で読む → - 論文データセット/水中ロボットロボティクス
水中ロボットのクロスモーダル知覚のためのソナー・視覚データセット
水中ロボットの視覚とソナーを対応付けるための大規模データセットSOVISを構築し、魚検出タスクで単眼カメラ比7倍の精度向上を実証した。
原題: A Sonar-Visual Dataset for Cross-Modal Underwater Robot Perception / Weitung Chen, Phil Tinn, Per Gunnar Auran 他
日本語で読む → - 論文VLAロボティクス
PearlVLA: 潜在空間における段階的動作計画の洗練
視覚言語行動モデル(VLA)の推論を潜在空間で行うことで、高速な動作生成と明示的な熟考の両立を実現するフレームワークを提案した。
原題: PearlVLA: Progressive Embodied Action-Plan Refinement in Latent Space / Bochen Yang, Lianlei Shan
日本語で読む → - 論文飛行制御ロボティクス
マッピング認識型ワールドモデルによるアジャイルなクアッドローター飛行
クアッドローターの視覚ベース飛行において、生画像再構成ではなく占有・可視性グリッドマップと自己運動を再構成する幾何学認識型ワールドモデルを提案し、シミュレーションと実機で有効性を示した。
原題: MAD: Mapping-Aware World Models for Agile Quadrotor Flight / Xinhong Zhang, Runqing Wang, Yunfan Ren 他
日本語で読む →