論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文制御・計画制御
アクチュエータを考慮した時空間チューブ合成:時間制約付き到達・回避・滞在タスク向け
アクチュエータの制約を直接チューブ合成に組み込むことで、オンライン再最適化やコントローラ再設計を不要にした時空間チューブ合成フレームワークを提案。全方向移動ロボットのシミュレーションで制御努力を約50%削減。
原題: Actuator-Aware Spatiotemporal Tube Synthesis for Temporal Reach-Avoid-Stay Tasks / Keshab Patra, K Madhava Krishna
日本語で読む → - 論文動作計画ロボティクス
エース!ロボットアームによるプロ級の卓球サーブの動作計画
卓球のサーブをロボットで実現するため、動作プリミティブ、モデル予測制御、ベイズ最適化を組み合わせて、公式ルールに適合し、プロ級のスピンと速度を持つサーブを生成する手法を提案した。
原題: Ace! Motion Planning of Professional-Level Table Tennis Serves with a Robot Arm / Guillem Torrente, Guilherme Jorge Maeda, Divij Grover 他
日本語で読む → - 論文ナビゲーションロボティクス
BioVLN: 生物医学実験室における視覚言語ナビゲーションのためのシミュレーションプラットフォーム
生物医学実験室のロボットが機器の操作可能な側面から安全に接近することを考慮した、視覚言語ナビゲーションのためのシミュレーションプラットフォームを提案した。
原題: BioVLN: A Simulation Platform for Visual Language Navigation in Biomedical Laboratories / Zhe Liu, Quan Lu, Zhaohui Du 他
日本語で読む → - 論文制御ロボティクス
連続体ロボットアームの点間運動における入力整形
ケーブル駆動の連続体ロボットアームの残留振動を抑制するため、時間遅延フィルタによる入力整形を適用し、実験でオーバーシュートと整定時間の低減を確認した。
原題: Input Shaping for Point-to-Point Motion with a Continuum Robot Arm / Rodolfo Hdz. Ibarra, Karan Baker, Parsa Molaei 他
日本語で読む → - 論文VLAロボティクス
小型VLAモデルに「どこを見るか」と「どう動くか」を教える
小型の視覚言語行動モデルに、空間的接地と行動生成の能力を効率的に教えるフレームワークXS-VLAを提案。蒸留とフローマッチングにより、実時間制御に適した小型モデルの性能を大幅に向上させた。
原題: Teaching Tiny VLA Models Where to Look and How to Move / Iok Tong Lei, Ying Jie Yap, Wei Huang 他
日本語で読む → - 論文全身制御/安全性ロボティクス
PAC-MAN: 認識を考慮したCBF-RLによる人型ロボットのドッジボール全身安全性
人型ロボットがドッジボールを避けるための、認識を考慮した制御バリア関数と強化学習を組み合わせたフレームワークを提案し、実機で95%の成功率を達成した。
原題: PAC-MAN: Perception-Aware CBF-RL for Whole-Body Safety in Humanoid Dodgeball / Lizhi Yang, Junheng Li, Aaron D. Ames
日本語で読む → - 論文VLA/クロスエンボディメント転移ロボティクス
行動整合表現によるクロスエンボディメント転移
ロボット操作の大規模模倣学習において、行動整合表現(物体のバウンディングボックスや言語動作、エンドエフェクタの軌跡など)がVLAモデルのクロスエンボディメント転移を促進するかを検証し、シミュレーションベンチマークで評価。エンドエフェクタ軌跡が特に有効で、シミュレーションから実機への転移成功率を28%向上させた。
原題: Cross-Embodiment Transfer via Behavior-Aligned Representations / Ajay Sridhar, Jensen Gao, Jonathan Yang 他
日本語で読む → - 論文VLA/計画AI
ワールドアクションプランナー:行動条件付きワールドモデルによる汎用意思決定
視覚言語モデルとマルチタスクのポーズ画像条件付きワールドモデルを組み合わせ、初期行動計画を提案し、想像上のロールアウトを最適化・探索で反復改良するロボット計画システムを提案。構成タスクや新規レイアウト、ゼロショット汎化で既存のVLAやWAMを上回る性能を示した。
原題: World Action Planner: Generalizable Decision-Making with Action-Conditioned World Models / Xiangcheng Zhang, Yilun Du
日本語で読む → - 論文ロボット縫製ロボティクス
異なる長さの伸縮性布地の自動直線縫製
短い布を伸ばして長い布に合わせて直線縫製する作業を自動化するロボット縫製システムDLRoSSを提案し、4つのフェーズで高品質な縫製を実現した。
原題: Automated Straight-line Sewing of Stretchable Fabrics with Different Lengths / Bingchen Jin, Akinari Kobayashi, Dipankar Bhattacharya 他
日本語で読む → - 論文BMI/神経デコーディングAI
自己教師あり一貫性強化による分離学習:脳機械インターフェースにおける神経デコーディングの汎化向上
脳機械インターフェースの長期使用で生じる神経ドリフトによる性能低下に対し、教師-学生の一貫性制約と神経選好理論に基づく分離学習を組み合わせ、運動パラメータ(速度・方向・速さ)ごとに頑健な神経表現を学習するフレームワークを提案した。
原題: Self-Supervised Consistency Enhanced Disentangled Learning for Neural Decoding Generalization in Brain-Machine Interface / Jiyu Wei, Di Hong, Zhanjie Zhang 他
日本語で読む → - 論文VLA/エッジ推論ロボティクス
Jetson-PI: 先読み整合非同期推論による搭載リアルタイムロボット制御の実現
低消費電力の搭載デバイス上でVLAモデルを高速に動作させるため、非同期推論の課題を解決する先読み整合補正と信頼度ベースのスケジューリングを提案した論文。
原題: Jetson-PI: Towards Onboard Real-Time Robot Control via Foresight-Aligned Asynchronous Inference / Zebin Yang, Qi Wang, Yunhe Wang 他
日本語で読む → - 論文評価ベンチマークロボティクス
ArmnetBench v0.1: 低コストアーム群での並列実世界評価による操作ポリシーのベンチマーク
低コストなロボットアーム群を用いて、複数の操作ポリシーを実世界で並列評価するベンチマークを構築し、7つのポリシーを12タスクで比較した。
原題: ArmnetBench v0.1: Parallel Real-World Evaluation of Manipulation Policies on a Low-Cost Arm Farm / Praveen Selvaraj, Lorenzo Uttini, Ville Kuosmanen
日本語で読む → - 論文群制御ロボティクス
GPS・通信が使えない環境での地上目標防護のための分散型UAV群
GPSや通信に頼らず、搭載センサのみで敵UAVを検知・包囲・迎撃する分散型UAV群による地上目標防護パイプラインを提案し、実機で検証した。
原題: Decentralized UAV Swarms for Ground Target Protection in GPS- and Communication-Denied Environments / Dimitria Silveria, Paulo Ricardo Marques de Araujo, Tiago Nascimento 他
日本語で読む → - 論文ドローン/機体制御ロボティクス
MorphQuad: 超人的機動性・マニピュレーション・耐障害性を備えた変形可能なクアッドローター
4つのローターを2軸ジンバルで独立に可動させる変形可能なクアッドローターを提案し、任意姿勢での飛行・接触作業・外乱耐性を実現するハードウェアと制御の協調設計を行った。
原題: MorphQuad: Morphable Quadrotor for Superhuman Maneuverability, Manipulation, and Resiliency / Jose Diaz Peon Gonzalez Pacheco, Jiawei Xu, Andrew Zhao 他
日本語で読む → - 論文ナビゲーションロボティクス
屋外環境における幾何学的目標定位を備えたオフライン視覚言語ナビゲーション
本論文は、屋外環境での完全オンボード視覚言語ナビゲーションを実現するため、エッジ展開可能な小型言語モデルのベンチマークと、セマンティックと幾何学的情報を組み合わせた軽量な目標定位フレームワークを提案する。
原題: Offline Vision-Language Navigation with Geometric Goal Localization for Outdoor Environments / Ali Salmasi, Xianjia Yu, Tomi Westerlund
日本語で読む → - 論文位置推定ロボティクス
セマンティックマップを活用した都市規模のクロスビュー位置推定
ロボットが未踏の環境で位置推定するために、OpenStreetMapの豊富なセマンティック情報を活用する手法を提案。VLMを用いてパノラマからランドマークを抽出し、軽量マッチャーに蒸留して大規模マップとの対応を高速化し、ベイズフィルタで時系列の姿勢推定を行う。
原題: Leveraging Semantic Maps for City-Scale Cross-View Localization / Ethan Fahnestock, Erick Fuentes, Philip R Osteen 他
日本語で読む → - 論文制御/予測制御
臨界減速によるクアッドローターの制御起因喪失予測
クアッドローターの制御起因の喪失(LOC)を、臨界減速現象に基づく早期警戒指標で予測する手法を開発し、実飛行データで評価した。
原題: Critical slowing down for predicting controller induced loss of control in quadrotors / Jasper J. van Beers, Prashant Solanki, Erik-Jan van Kampen 他
日本語で読む → - 論文経路計画ロボティクス
ハイブリッド人工ポテンシャル場と時空間トランスフォーマーによるAUVのリアルタイム経路計画
自律型水中ロボットの経路計画において、人工ポテンシャル場と時空間トランスフォーマーを組み合わせたハイブリッド手法を提案し、13種類のアルゴリズムと比較して優れた性能を示した。
原題: Hybrid Artificial Potential Fields and Spatio-Temporal Transformers for Real-Time AUV Path Planning / Khadija Rais, Abdelmadjid Benmachiche, Imene Soualmia
日本語で読む → - 論文モバイル操作/VLA/実行時検証ロボティクス
CheckVLA: アクション条件付きワールドモデルによる実行時検証で長期的モバイル操作を実現
長期的なモバイル操作において、VLAポリシーが開ループで行動チャンクを実行する際の誤差蓄積問題に対し、別途訓練したアクション条件付きワールドモデルで実行を検証し、逸脱時に介入する手法を提案した。シミュレーションで成功率と再現率が向上した。
原題: CheckVLA: Execution-Time Verification with Action-Conditioned World Model for Long-Horizon Mobile Manipulation / Yushan Liu, Peibo Sun, Xintao Chao 他
日本語で読む → - 論文ヒューマンインターフェースHCI
センサ位置非依存のソノミオグラフィ:四肢麻痺ユーザーによる連続高次元制御に向けて
超音波で筋肉の変形を計測するソノミオグラフィを用い、センサ位置に依存せず、短いキャリブレーションで連続的な1自由度および2自由度の制御を実現するシステムを提案した。頸髄損傷者を含む参加者全員が複数のセンサ位置で1自由度制御を達成し、2自由度制御の可能性も示した。
原題: Sensor-Placement-Agnostic Sonomyography: Toward Continuous High-Dimensional Control by Users with Tetraplegia / Gavin Sueltz, Vikram Athithan, Emma Ferran 他
日本語で読む → - 論文模倣学習ロボティクス
デモの数だけではない:反実仮想的行動感度カバレッジによるデータ効率的で堅牢なロボット模倣学習
視覚運動模倣学習の堅牢性を向上させるため、クリーンなデモと妨害観測をペアにして行動ドリフトを測定し、ポリシー固有の感度信号に基づいて少数の修復データを選択するオフライン手法CFNBCを提案した。
原題: It's Not Just More Demos: Counterfactual Action Sensitivity Coverage for Data-Efficient Robust Robot Imitation / Giovanni D'urso, Kaushik Roy, Nicholas Lawrance 他
日本語で読む → - 論文人型ロボット適応ロボティクス
CLIFT: 非侵襲的な閉ループ反復ファインチューニングによるGemini Roboticsオンデバイスの人型ロボット専門家化
クローズドウェイトのロボット基盤モデルを管理API経由で適応させる際、純粋な模倣学習に限定される問題を解決するため、非侵襲的な閉ループ反復ファインチューニング手法を提案し、実人型ロボットでの有効性を実証した。
原題: CLIFT: Turning Gemini Robotics On-Device into Humanoid Specialists via Non-Invasive Closed-Loop Iterative Fine-Tuning / Yuxin Chen, Hari Srikanth, Nathan Jew 他
日本語で読む → - 論文把持合成ロボティクス
FIRMGrasp: 摩擦を考慮したリスクマージンによる堅牢な把持合成
摩擦係数の不確実性を条件付きリスク価値(CVaR)で考慮した新しい把持品質指標を提案し、摩擦に敏感な把持を特定して堅牢性を向上させる。
原題: FIRMGrasp: A Friction-Informed Risk Margin for Robust Grasp Synthesis / Clinton Enwerem, John S. Baras, Calin Belta
日本語で読む → - 論文スキル発見/継続学習ロボティクス
ASPIRE: ロボットのためのエージェント的スキル発見
ロボット制御プログラムを自律的に作成・改善し、再利用可能なスキルライブラリを構築する継続学習システムASPIREを提案。シミュレーションと実世界で高い性能とゼロショット汎化を示した。
原題: ASPIRE: Agentic /Skills Discovery for Robotics / Runyu Lu, Yubo Wu, Ethan Kou 他
日本語で読む → - 論文制御理論制御
極座標における車両の運動学的自転車モデルの大域的指数安定化
駐車速度での車両モデルを極座標に変換し、人間らしい駐車軌道を生成する滑らかなフィードバック則を設計して大域的指数安定化を実現した論文。
原題: Global Exponential Stabilization of the Kinematic Bicycle Model of a Car in Polar Coordinates / Velimir Todorovski, Kwang Hak Kim, Alessandro Astolfi 他
日本語で読む → - 論文3Dシーンマップ/動作認識/不確実性ロボティクス
視覚・言語・動作マップ:3Dシーンマップのためのオープンボキャブラリで不確実性を考慮したクエリ可能な動作属性
静的環境を前提とした既存の3Dマップに、物体の動作可能性と観測された動きを融合した動作属性と不確実性を付与し、言語クエリで「動くもの」「動きうるもの」等を識別できるようにした。シミュレーションと実データで有効性を検証した。
原題: Vision-Language-Motion Maps: An Open-Vocabulary, Uncertainty-Aware, Queryable Motion Attribute for 3D Scene Maps / Dibyendu Ghosh, Ayushi Shakya
日本語で読む → - 論文群制御ロボティクス
D-CLIPSE: 共有状態交換における受動的リスニングを用いた分散コンセンサスベース位置推定
各ロボットが自身と隣接ロボットの状態を推定する分散フィルタリング手法を提案し、通信効率と一貫性を保ちつつ中央集権的処理に近い精度を実現した。
原題: D-CLIPSE: Distributed Consensus-based Localization with Passive Listening on Shared State Exchange / Kyle Biron-Gricken, James Richard Forbes
日本語で読む → - 論文自動運転計画ロボティクス
構造化シーン知識と検証可能な推論-行動整合性を備えた自動運転のための認知デュアルプロセス計画
自動運転の高次計画のため、構造化チェーン・オブ・ソート(S-CoT)スキーマと軽量なシーン複雑度推定に基づくデュアルプロセス計画フレームワークを提案し、ルーチンシーンでは高速なメタアクション予測、複雑シーンでは構造化推論とルールベース検証による報酬を用いた強化学習で計画精度を向上させた。
原題: Cognitive Dual-Process Planning for Autonomous Driving with Structured Scene Knowledge and Verifiable Reasoning-Action Consistency / Zhongyao Yang, Haoyu Li, Yu Yan 他
日本語で読む → - 論文ナビゲーションロボティクス
具現化視覚言語ナビゲーションの包括的サーベイと体系的実世界評価
視覚と言語によるナビゲーション(VLN)の研究を体系的に分類し、物理ロボットでの実世界評価を行った。シミュレーションと実世界の性能差を明らかにし、階層的フレームワークの堅牢性を示した。
原題: A Comprehensive Survey and Systematic Real-World Evaluation of Embodied Vision-and-Language Navigation / Liuyi Wang, Kai Sheng, Zongtao He 他
日本語で読む → - 論文ナビゲーションロボティクス
UWB測位とD* Lite経路計画に基づく視覚障害者向け屋内ナビゲーションシステム
UWB測位とD* Liteアルゴリズムを用いて、視覚障害者向けの屋内ナビゲーションシステムを提案し、動的障害物への迅速な経路再計画を実現した。
原題: An Indoor Navigation System for the Visually Impaired based on UWB Positioning and D* Lite Path Planning Algorithm / Thanh C. Vo, Dong LT. Tran, Huy HM. Le 他
日本語で読む →