論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
視覚運動ポリシー学習のための順序付きアクショントークン
ロボットの連続的なアクションを離散トークンに変換する際、高圧縮・完全復号可能・順序性を満たす新しいトークナイザーOATを提案し、複数のベンチマークで有効性を示した。
原題: Ordered Action Tokens for Visuomotor Policy Learning / Chaoqi Liu, Yue Zhao, Haonan Chen 他
日本語で読む → - 論文生成モデルロボティクス
GS-Agent: 生成シミュレーションによる4D物理世界の構築
自然言語の記述から、物理的に妥当で動的な4D世界を自動生成するマルチエージェントフレームワークを提案した論文。
原題: GS-Agent: Creating 4D Physical Worlds With Generative Simulation / Hongxin Zhang, Chunru Lin, Junyan Li 他
日本語で読む → - 論文認識/自動化ロボティクス
鉱山における自律型インパクトハンマーのためのリアルタイムRGB-D認識パイプライン:自己フィルタリング、岩石セグメンテーション、破砕ポーズ生成
鉱山のインパクトハンマー自動化に向け、RGB-Dカメラを用いて岩石をセグメンテーションし、破砕可能なポーズを生成するリアルタイム認識パイプラインを提案。約10Hzで動作し、実時間での自律運用に適することを実験で示した。
原題: A real-time RGB-D perception pipeline for autonomous impact hammers in mining: self-filtering, rock segmentation and rock-breaking poses generation / Martín Gallegos, Francisco Leiva, Patricio Loncomilla 他
日本語で読む → - 論文群制御ロボティクス
非剛体から剛体へ:限られたセンシング下での安全な剛体通信グラフ獲得
限られたセンシング範囲で動作するマルチロボットシステムに対し、衝突を回避しつつ剛体通信グラフを時間変化の中で獲得する分散制御手法を提案した。
原題: From Non-Rigid to Rigid: Safe Acquisition of Rigid Communication Graphs under Limited Sensing / S. Saharsh, Vedhas Talnikar, Pushpak Jagtap
日本語で読む → - 論文モバイルマニピュレーションロボティクス
FloAff-Kitchen:正準的かつ段階的な床面アフォーダンス学習によるナビゲーションと操作の橋渡し
移動マニピュレーションにおいて、操作の成功率を最大化する床面アフォーダンス(FloAff)を予測する統一フレームワークを提案。正準表現学習と段階的アフォーダンス事前学習により、異種操作スキル間の共有知識とタスク固有知識を分離し、新規ベンチマークで優位性を示した。
原題: FloAff-Kitchen: Bridging Navigation and Manipulation via Canonical and Progressive Floor Affordance Learning / Ping Zhong, Manling Teng, Tao Wu 他
日本語で読む → - 論文視覚位置推定画像認識
高精度ストリートレベル画像を活用した視覚位置推定の精度ポテンシャル
高精度な地理参照を持つストリート画像を用いた視覚位置推定パイプラインを提案し、サブセンチメートルの真値を持つ大規模データセットを構築して精度を評価した。
原題: Accuracy potential of visual localization exploiting high-end street-level imagery / Jonas Meyer, Stephan Nebiker, Pascal Theiler 他
日本語で読む → - 論文水中モニタリングcs.IR
局所マルチエージェントRAGによるエネルギー制約下の階層型水中モニタリング
超低消費電力のエッジセンシングと高性能な局所推論を組み合わせた水中モニタリングアーキテクチャを提案し、エネルギー制約下での継続的な海洋生物監視を実現する。
原題: Energy Constrained Hierarchical Underwater Monitoring via Local Multi-Agent RAG / Mohamed Amine Janati, Laurent Gautier, Stéphane Barbot
日本語で読む → - 論文UAV航法ロボティクス
非凸エアコリドーにおけるUAV航法のためのモデル予測プランナー
非凸な都市エアコリドー内でのUAV航法のための、混合整数追跡モデル予測制御に基づく運動計画フレームワークを提案。最短経路ベースのオフセットコストを組み込み、局所最小値問題を緩和しつつ、動的に有効でコリドー制約を満たす軌道を生成する。
原題: Model Predictive Planner for UAV Navigation in Non-Convex Air Corridors / Henrique Silva, Marcelo A. Santos, Guilherme V. Raffo
日本語で読む → - 論文触覚/VLA/操作ロボティクス
接触を伴うロボット操作のための表現整合型触覚グラウンディング
触覚強化型VLAポリシーにおいて、将来の触覚状態を予測する中間表現の位置を特定し、軽量な潜在触覚予測器(LTP)を導入して行動表現と接触結果を整合させる手法を提案した。実機の接触を伴う操作タスクで有効性を実証した。
原題: Representation-Aligned Tactile Grounding for Contact-Rich Robotic Manipulation / Ruilin Chen, Jingkai Jia, Tong Yang 他
日本語で読む → - 論文ロバスト計画math.OC
非線形システムのロバスト計画のための相対エントロピー有界曖昧チャンス制約
分布の曖昧さを考慮した確率制御問題において、非線形システムと未知分布に対するリスク値を相対エントロピー距離で有界化する手法を提案し、宇宙機の誘導問題で実証した。
原題: Relative Entropy-Bounded Ambiguous Chance Constraints for Robust Planning in Nonlinear Systems / Trevor N. Wolf, Jay W. McMahon
日本語で読む → - 論文ロボット学習ロボティクス
EgoRecovery: 人間の回復デモンストレーションから失敗回復能力を獲得する
ロボットの失敗回復行動を学習するために、人間の自己中心視点の回復デモを活用し、ロボットデータと共有する意図空間を介して少数のロボットデモで実行可能な行動に結びつける共学習フレームワークを提案した。
原題: EgoRecovery: Acquiring Failure Recovery Ability Through Human Recovery Demonstration / Zuhao Ge, Yuchen Zhou, Weitao Zhou 他
日本語で読む → - 論文視覚慣性オドメトリロボティクス
多解像度ボクセル地図を用いたステレオ視覚慣性オドメトリ
事前地図を多解像度ボクセル化し、円錐状のインデックス戦略で2D特徴と3D地図点を関連付けることで、データ転送量と計算負荷を抑えつつ高精度な位置推定を実現するVIOシステムを提案した。
原題: Multi-Resolution Voxelized Map-Based Stereo Visual-Inertial Odometry / Shuyi Pan, Hangtian Wang, Zhaoxing Zhang 他
日本語で読む → - 論文トラッキング画像認識
夜間高速道路認識のためのイベント-RGB適応追跡
夜間高速道路での低照度・高速移動によるRGBカメラの性能劣化を解決するため、イベントカメラとRGBを適応的に統合する追跡フレームワークを提案し、合成データセットも構築した。
原題: Event-RGB Adaptive Tracking for Nighttime Highway Perception / Haidong Wang, Hengxing Cai, Wanlei Li 他
日本語で読む → - 論文模倣学習/モーションリターゲティングロボティクス
ObjRetarget: 物体認識と人型アーム制約・多面体手モデルを統合したモーションリターゲティングフレームワーク
人間の操作ビデオからロボットの器用な操作を学習するため、アームの軌道制約と手の接触構造を明示的にモデル化したモーションリターゲティング手法を提案し、実機で成功率と接触安定性を向上させた。
原題: ObjRetarget: An Object-Aware Motion Retargeting Framework with Anthropomorphic Arm Constraints and Polyhedral Hand Modeling / Yuanchuan Lai, Qing Gao, Ziyan Liang 他
日本語で読む → - 論文VLA/ヒューマノイドロボティクス
ラボから店舗へのギャップを埋める:小売ヒューマノイド向けデータ効率的なポストトレーニングと経験駆動学習VLAフレームワーク
スーパーマーケットの棚補充タスクにおいて、データ効率的なポストトレーニングと経験駆動の学習を組み合わせたVLAフレームワークを提案し、単一GPUで実世界運用可能な性能を達成した。
原題: Closing the Lab-to-Store Gap: A Data-Efficient Post-Training and Experience-Driven Learning VLA Framework for Retail Humanoids / Roger Sala Sisó, Tiago Silvério, Jakob Sand 他
日本語で読む → - 論文ドローン/耐障害性ロボティクス
実用的な耐障害性と効率性を両立する変形型ヘキサロータ試作機
プロペラ間の角度を変えられる変形型ヘキサロータを用いて、単一プロペラ故障への耐性とエネルギー効率を両立する幾何学的領域が存在することを実験で実証した。
原題: A Morphing-Designed Hexarotor Prototype combining Practical Resilience and Efficiency / Murat Bronz, Mahmoud Hamandi, Elgiz Baskaya 他
日本語で読む → - 論文HRIロボティクス
エージェント・クライアントプロトコルによるGenAIアーキテクチャにおける人間とロボットのインタラクション
本論文は、ロボットシステムの人間とロボットのインタラクション層に、ソフトウェアエージェント用の通信標準であるAgent-Client Protocol (ACP)を採用し、MCPと組み合わせた3層アーキテクチャを提案する。これにより、異種UIの接続やロボット基盤の交換を容易にし、リアルタイム観測や人間の承認などの協調機能を実現する。
原題: Human-Robot Interaction in GenAI Architectures via the Agent-Client Protocol / Jesus Moncada-Ramirez, Jose-Raul Ruiz-Sarmiento, Javier Gonzalez-Jimenez
日本語で読む → - 論文人型ロボット制御ロボティクス
人型ロボットのためのスケーリング行動基盤モデル
人型ロボットの制御を大規模行動データで学習する行動基盤モデル(BFM)のスケーリング手法を提案し、学習パラダイム、データ、モデル構造の協調により性能が向上することを示した。
原題: Scaling Behavior Foundation Model for Humanoid Robots / Weishuai Zeng, Kangning Yin, Xiaojie Niu 他
日本語で読む → - 論文VLAロボティクス
Kepler-Encoder-v0.1: ロボットのためのマルチモーダル埋め込みモデルに向けて
ロボットの状態をモダリティとして扱い、視覚・ proprioception・力覚を共通の潜在空間に融合するエンコーダを提案。訓練時のみ状態を融合し、推論時は視覚のみで力覚などの状態を復元できることを示した。
原題: Kepler-Encoder-v0.1: Towards a Multimodal Embedding Model for Robots / Ishneet Sukhvinder Singh, Dhanoosh Pooranakumaran, Alex Nguyen 他
日本語で読む → - 論文自律飛行ロボティクス
構成誘導型パッシブ自転による認識強化自律飛行
本論文は、後部アーム構成パラメータを利用してパッシブ自転を誘導する三軸飛行体を提案し、センサ視野を拡大しつつ飛行性能とのバランスを取る自律飛行フレームワークを実証した。
原題: Configuration-Induced Passive Self-Rotation for Perception-Enhanced Autonomous Flight / Xurui Liu, Miao Wang, Tianyu He 他
日本語で読む → - 論文マルチエージェント経路探索ロボティクス
双方向情報を用いた垂直展開によるAnyTime Conflict-Based Searchの多目的ノード選択
マルチエージェント経路探索のCBSアルゴリズムにおいて、ノード選択を最適化するDIVEポリシーを提案し、探索効率とメモリ使用量のトレードオフを改善した。
原題: Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search / Willem van Osselaer, Jiarui Li, Meshal Alharbi 他
日本語で読む → - 論文マニピュレーションロボティクス
電流を触覚として使う:準拠性のある器用な操作のための固有受容的接触フィードバック
外部の触覚・力センサーを使わず、モーター電流と関節状態から接触を認識し、準拠性のある把持を実現する枠組みを提案。PDコントローラの目標位置を予測して把持力を調整する。
原題: Current as Touch: Proprioceptive Contact Feedback for Compliant Dexterous Manipulation / Chenyang Ma, Yunchao Yao, Zhenyu Wei 他
日本語で読む → - 論文水中ロボット/制御ロボティクス
ストローハル数を考慮した多フィン羽ばたき推進の効率的モデル予測制御
生物の効率的な羽ばたき推進の経験則(ストローハル数)をリアルタイム制御に組み込み、4枚の柔軟フィンを備えた水中ロボットで実証。最適なストローハル数域を維持しつつ消費電力を最大32%削減した。
原題: Strouhal-Aware Model Predictive Control for Efficient Multi-Fin Flapping Locomotion / Yuya Hamamatsu, Zixi Chen, Maarja Kruusmaa 他
日本語で読む → - 論文ロボット制御ロボティクス
ゼロショット幾何評価によるワールドアクションモデルのテスト時スケーリング
ロボット制御のためのワールドアクションモデル(WAM)において、予測未来のクロスビュー深度再投影一貫性に基づいてロールアウトを選択するトレーニング不要のテスト時スケーリング手法を提案し、成功率を向上させた。
原題: Test-Time Scaling for World Action Models via Zero-Shot Geometric Evaluation / Zesen Zhao, Minkyoung Cho, Hui shen 他
日本語で読む → - 論文ナビゲーションロボティクス
NavCMPO: 批評家誘導型MeanFlowポリシー最適化による適応的ナビゲーション
拡散ベースのナビゲーションポリシーの推論遅延と模倣学習の限界を克服するため、数ステップのMeanFlow軌道生成と批評家による軌道修正、強化学習による微調整を組み合わせた二段階適応ナビゲーションフレームワークを提案した。
原題: NavCMPO: Critic-Guided MeanFlow Policy Optimization for Adaptive Navigation / Junjie An, Yi Wu, Xiao Liu 他
日本語で読む → - 論文強化学習/ベンチマークロボティクス
強化学習による到達回避タスクの学習:ベクトル化シミュレーションとベンチマーク
ロボットアームの到達回避タスクを、現実的な複雑さを保ったまま強化学習で解くためのベンチマークを初めて構築し、MuJoCo MJXとBraxによる並列化で高成功率を達成した。
原題: Learning Reach-Avoid Task with Reinforcement Learning: Vectorized Simulation and Benchmark / Jonas Weihing, Shahram Eivazi
日本語で読む → - 論文運動計画ロボティクス
BridgeFlow: フローマッチングによる高速かつロバストなSE(2)等変運動計画
剛体変換に対して厳密に等変な生成型運動計画フレームワークを提案。軽量な正準化モジュールで等変性を実現し、ブラウン橋事前分布とミニバッチ最適輸送で推論を高速化した。
原題: BridgeFlow: Fast and Robust SE(2)-Equivariant Motion Planning with Flow Matching / Xinzhe Zhou, Xuyang Wang, Xiaoming Duan 他
日本語で読む → - 論文自動運転/トポロジカルマップ画像認識
HGeo-TopoMap: 階層的幾何事前情報によるトポロジカルマッピングの強化
自動運転のためのトポロジカルマップ生成において、逆透視マッピングによる道路構造マップと空間関係を活用し、中心線検出を階層的に強化する手法を提案した。
原題: HGeo-TopoMap: Boosting Topological Mapping with Hierarchical Geometric Priors / Siyu Li, Kunyu Peng, Di Wen 他
日本語で読む → - 論文遠隔操作ロボティクス
身体を追従させる:全身ロボット遠隔操作のための結合エゴセントリック制御
ロボットの胴体とベースを操作者の頭部と腕の動きに自動追従させる遠隔操作手法を提案し、ユーザー実験で操作性と負担の改善を実証した。
原題: Let the Body Follow: Coupled Egocentric Control for Whole-Body Robot Teleoperation / Tsung-Chi Lin, Yichen Xie, Chien-Ming Huang
日本語で読む → - 論文ロボット学習ロボティクス
レガシーデータはいつ役立ち始めるのか?クロス構成ロボット学習における創発的転移
ロボットのハードウェア更新時に、旧構成のデモデータが新構成の学習に有効となる条件を、実機実験と理論で明らかにした論文。
原題: When Does Legacy Data Start to Help? Emergent Transfer in Cross-Configuration Robot Learning / Tao Wang, Hudson Hou, Yingdong Hu 他
日本語で読む →