論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/20 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文6D姿勢推定画像認識
G6D: ロボットマニピュレーションのための幾何学的学習不要RGB-D 6D姿勢ソルバ
大規模事前学習モデルを使わず、テンプレート幾何マッチングとシルエット・深度整合性でRGB-Dから6D物体姿勢を推定する学習不要手法を提案し、CPUのみでも動作する。
原題: G6D: Geometric Learning-Free RGB-D 6D Pose Solver for Robotic Manipulation / Yixuan Liang, William Chen, Yunan Wang 他
日本語で読む → - 論文ロボット探索ロボティクス
言語誘導探索のための構造化世界状態推論
地理空間事前情報と知覚を統合した永続グラフ上で並列推論を行い、マルチモーダル検証で目標を特定するロボット探索フレームワークWORLDSを提案。CityNavで51.8%のナビゲーション成功率を達成し、既存手法を15.7ポイント上回った。
原題: Structured World-State Reasoning for Agentic Robotic Search / Finley R. Holt, Luis A. Pabon, John Irvin Alora 他
日本語で読む → - 論文VLAロボティクス
見た目の変化を超えて:VLAモデルのためのタスク意味論的行動校正
凍結したVLAモデルにタスク意味論に基づく行動校正を追加し、見た目変化への不要な反応を抑えつつ、意味が変わった時のみ行動を変える手法を提案。
原題: Beyond Appearance Shifts: Task-Semantic Action Calibration for VLA Models / Shuaijun Liu, Feiyang You, Chengyu Wu 他
日本語で読む → - 論文群制御ロボティクス
FlockDiffusion: 割当条件付き拡散モデルによるマルチドローンタスク割当と完了
シーングラフエンコーダと拡散トランスフォーマを組み合わせ、複数ドローンのタスク割当と経路生成を高速かつ低コストで行う学習フレームワークを提案。
原題: FlockDiffusion: Assignment-Conditioned Diffusion for Multi-Drone Task Allocation and Completion / Iana Zhura, Satenik Akopyan, Roohan Ahmed Khan 他
日本語で読む → - 論文世界モデル画像認識
OnlineWM: 因果性を考慮した能動的オンライン学習による効果的な世界モデリング
シミュレータと能動的に対話しながら、モデルの弱点を狙ったデータを収集し、反事実学習で行動と状態遷移の因果関係を捉える世界モデルのオンライン学習フレームワークを提案。
原題: OnlineWM: Causality-Aware Active Online Learning for Effective World Modeling / Yikun Miao, Fangqi Zhu, Quanxin Shou 他
日本語で読む → - 論文水中HRIロボティクス
水中でのダイバーとロボットの信頼性高いインタラクションに向けて:ジェスチャ設計、対話ロジック、実環境評価
ダイバーが使いやすくロボットが認識しやすい7種類の水中ジェスチャと軽量な認識手法、コマンドレベルの対話ロジックを組み合わせた閉ループ型インタラクションを構築し、水槽とプールでの実験で有効性を検証した。
原題: Towards Reliable Underwater Diver-Robot Interaction: Gesture Design, Interaction Logic, and Real-World Evaluation / Yingqi Liu, Kanzhong Yao, Zimeng Peng 他
日本語で読む → - 論文群制御cs.DC
匿名・完全無向ロボット群による相反するパターン形成
2次元平面上で、互いに識別できない2群のロボットが、集合と円形成という相反するタスクを同時に解くための分散アルゴリズムを提案した。
原題: Conflicting Pattern Formation by Teams of Anonymous, Fully Disoriented Robots / Animesh Maiti, Prakhar Shukla, Subhash Bhagat
日本語で読む → - 論文VLAロボティクス
SCULPT-VLA: 段階的行動グラウンディングによる構造化制御の学習
VLAポリシーにおいて、タスク進行・シーン動態・空間グラウンディングの要素を段階的に学習させ、教師なしで連続制御を洗練する手法を提案。LIBEROや実機タスクで成功率を向上させた。
原題: SCULPT-VLA: Learning Structured Control through Staged Action Grounding / Wenbo Li, Yiteng Chen, Wei Zhang 他
日本語で読む → - 論文測位ロボティクス
スマートフォンGNSSブースター:携帯型信号再放射器によるセンチメートル級歩行者測位
スマホ内蔵GNSS受信機を使いつつ、外付けの再放射アンテナで信号品質を高め、歩行者の測位精度をセンチメートル級に向上させるシステムを提案した。
原題: Smartphone GNSS Booster: Centimeter-Level Pedestrian Positioning Using a Portable Signal Re-Radiator / Taro Suzuki
日本語で読む → - 論文運動計画ロボティクス
未知のダイナミクスとハイブリッド観測下におけるリスク対応型運動計画と制御
状態観測が一部でしか得られない未知環境でのロボット運動計画において、観測不能領域を確率的遷移系としてモデル化し、リスクを考慮した確率的短経路問題として計画する手法を提案した。
原題: Risk-Aware Motion Planning and Control under Unknown Dynamics with Hybrid Observations / Zhiquan Zhang, Melkior Ornik
日本語で読む → - 論文ナビゲーションロボティクス
離散接触プッシュを用いた可動障害物間の実行可能ナビゲーション
移動マニピュレータが大きな可動障害物を押しのけて進む階層型NAMOフレームワークを提案。LLMで補助操作依存を推論し、離散接触モードと強化学習で押し操作を実行する。
原題: Manipulation Feasible Navigation Among Movable Obstacles with Discrete Contact Pushing / Shaohu Wang, Aiguo Song, Yulong Yuan 他
日本語で読む → - 論文ヘルスケア予測機械学習
デジタルヘルスキャンペーン成果の早期予測のための患者ワールドモデル:能力と限界
患者ごとの潜在状態を保持し、曝露条件付き状態ダイナミクスと週次転換ハザードを学習して将来の転換曲線を予測するコンパクトな患者ワールドモデルを構築し、米国のキャンペーンデータで評価した。
原題: A Patient World Model for Early Forecasting of Digital Health Campaign Outcomes: Capabilities and Limits / Yunlong Wang
日本語で読む → - 論文安全制御ロボティクス
BarrierFormer: Transformerによる予測的バリア制約を用いた安全なロボット制御
モデル不要のTransformerベース安全制御フレームワークを提案し、予測ロールアウト上でCBF制約を学習してオンライン計算なしに安全な制御を実現した。
原題: BarrierFormer: Transformer-Guided Predictive Barrier Enforcement for Safe Robot Control / Anandsingh Chauhan, Kunal Garg
日本語で読む → - 論文歩行ロボティクス
PRIMO: 人間動作追従に基づく事前情報活用型オドメトリ for ヒューマノイドロボット
ヒューマノイドの自己受容感覚オドメトリにおいて、人間の動作をシミュレーションで追従させて訓練データを生成し、物理・対称性に基づく事前情報を組み込んだ推定器を提案。実機での誤差を大幅に削減した。
原題: PRIMO: Prior-Informed Odometry from Human-Motion Tracking for Humanoid Robots / Xu Han, Angsong Li, Shaopeng Zhang 他
日本語で読む → - 論文VLAロボティクス
人間中心マルチモーダル観測からの能動的ロボット行動推論
明示的な指示なしに、人間と環境のマルチモーダルな手がかりからロボットが取るべき行動を判断する「能動的ロボット行動推論」を定式化し、実世界データセットProActionと参照モデルMMC2Actを提案した。
原題: Cognitive Action Reasoning for Proactive Robots from Human-Centered Multimodal Observations / Zhihao Gu, Kechao Zhu, Yuanfeng Wu 他
日本語で読む → - 論文経路計画ロボティクス
MIRA-PRM: 移動型ガスセンシング検査のためのミッション情報を活用した再利用可能ロードマップ計画
順序付きサンプリング位置への到達信頼性を高めるため、ミッション情報を組み込んだ確率的ロードマップ計画手法を提案し、シミュレーションで高い成功率と局所修復による効率化を示した。
原題: MIRA-PRM: Mission-Informed Reusable Roadmap Planning for Mobile Gas-Sensing Inspection / Gongsen Wang, Siyuan Wang, Xinyuan Wang 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルの連合ファインチューニングに関する実証研究とオープンテストベッド
事前学習済みVLAモデルを連合学習でファインチューニングする際の設計選択を体系的に検証し、シミュレーションと実機実験を通じて知見と課題を明らかにした。
原題: An Empirical Study and Open Testbed for Federated Fine-Tuning of Vision-Language-Action Models / Zhekai Duan, Kevin Ziyang Xie, Xinyu Tan 他
日本語で読む → - 論文運動計画ロボティクス
高速反復グリッドベース準最適キノダイナミック運動計画
状態空間をグリッド分割し、ノード選択・動力学伝播・グラフ修正を定数時間で行うことで高速に反復し、高品質な解を得る準最適キノダイナミック運動計画アルゴリズムRDGを提案。
原題: Rapidly-Iterating Grid-Based Near-Optimal Kinodynamic Motion Planning / Michael Moncton, Eric Frew
日本語で読む → - 論文ソフトロボティクスロボティクス
Embodied Snap:タコに着想を得た分散型リーチ・アタッチと速度制限付きソフトアーム
タコの腕の動きに着想を得て、遅いサーボによる予備負荷と急速な弾性解放を分離する制御器を提案し、ソフトアームが腱駆動の速度限界を超えて対象に吸着できることを実機で示した。
原題: Embodied Snap: Octopus-Inspired Distributed Reach-and-Attach with a Speed-Limited Soft Arm / Linxin Hou, Zhihang Qin, Heyang Zou 他
日本語で読む → - 論文安全制御ロボティクス
多項式リフティングによる非多項式ロボット動力学のためのバリア証明合成
三角関数などを含む非多項式なロボット動力学を厳密な多項式リフティングで多項式系に変換し、制御バリア証明を合成する手法を提案。協調旋回やマルチロータで安全性カバレッジと計算効率が向上することを示した。
原題: Barrier Certificate Synthesis for Non-Polynomial Robotic Dynamics via Polynomial Lifting / Shivam Chaubey, Francesco Verdoja, Shankar Deka 他
日本語で読む → - 論文タスク・動作計画ロボティクス
探索・接地・計画:不完全なシーン知識下でのタスク・動作計画のための機能的十分性
言語と視覚からタスクに必要な機能役割を探索し、物理オブジェクトに接地して機能的十分性を確認してから計画するTAMPフレームワークGRAB-TAMPを提案し、ベースラインを大きく上回る成功率を示した。
原題: Search, Ground, Plan: Functional Sufficiency for Task and Motion Planning under Incomplete Scene Knowledge / Narendhiran Vijayakumar, Nav Singhal, Girish Varma 他
日本語で読む → - 論文自動運転/センサフュージョン画像認識
レーダー画像融合による動的物体セグメンテーションと自己運動推定
レーダーのドップラー情報をRGB画像と融合し、自己運動推定と動的物体セグメンテーションを相互に改善するフレームワークRadar-Dotを提案した。
原題: Image Frame Dynamic Object Segmentation and Ego Motion Estimation using Radar Image Fusion / Astik Srivastava, Suhani Grover, Avinash Sharma 他
日本語で読む → - 論文ソフトロボティクスロボティクス
壁面後退と展開可能な指によるソフト伸長ロボットの先端マニピュレーション
ソフト伸長ロボットの先端に、壁面後退機構と展開可能な空気圧指を組み合わせ、多様な物体の把持や積み重ね、狭所検査を可能にした研究。
原題: Tip Manipulation in Soft Everting Robots via Wall Retraction and Deployable Fingers / Nelson Badillo Perez, Niccolo Pagliarani, Matteo Cianchetti 他
日本語で読む → - 論文能動知覚/ナビゲーションロボティクス
Splat-CBF: 3Dガウススプラットマップにおける安全な次善視点制御
3Dガウススプラットマップ上で、衝突回避をハード制約としつつ情報利得の高い視点へカメラを誘導する能動知覚制御バリア関数を提案し、ロボットの安全なナビゲーションと情報収集を両立させた。
原題: Splat-CBF: Safe Next-Best-View Control in 3D Gaussian-Splat Maps / Amirhossein Mollaei Khass, Athanasios Cosse, Nader Motee
日本語で読む → - 論文マニピュレーションロボティクス
片手での組立と操作のための再構成可能な双対向アーキテクチャ
4本の独立駆動指を2つの仮想指対向に分け、再構成可能な掌で相対配置を制御することで、片手での2部品の同時把持とハンド内組立・操作を実現するハンドを提案。
原題: A Reconfigurable Dual-Opposition Architecture for Single-Hand Assembly and Manipulation / William Su, Yunosuke Nakamura, Yixiao Wang 他
日本語で読む → - 論文VLAロボティクス
閉ループ崩壊の解剖:圧縮VLAポリシーの因果的事例研究
圧縮された操作ポリシーがオフライン評価を通過しながら閉ループで崩壊する事例を因果的に分析し、失敗の構造と標準的な修復法が効かないことを示した。
原題: Anatomy of a Closed-Loop Collapse: A Causal Case Study of a Compressed VLA Policy / Fengze Jia
日本語で読む → - 論文VLAロボティクス
H-VLA:キーアクション推論と運動計画を統合行動空間で行う階層型視覚-言語-行動モデル
高レベルのキーアクション推論と低レベルの運動生成を分離し、統一されたカメラ中心行動空間でロボット操作を学習する階層型VLAフレームワークを提案。
原題: H-VLA: Hierarchical Vision-Language-Action Model with Key-Action Reasoning and Motion Planning in a Unified Action Space / Xiongfeng Peng, Lu Xu, Yandong Wang 他
日本語で読む → - 論文群制御ロボティクス
部分観測空間における移動アドホックエージェント配置の制御
未知の直交環境で移動アドホックネットワークを展開する問題を定式化し、CADENCEアルゴリズムが可視グラフの連結性を保ちつつ完全被覆を達成することを証明した。
原題: On the Control of Mobile Ad-Hoc Agent Deployments in Partially Observed Space / Edwin Meriaux, Louis-Roy Langevin, Shuo Wen 他
日本語で読む → - 論文全身マニピュレーションロボティクス
全身UMI:実時間動作生成によるヒューマノイド全身マニピュレーションへのUMIスキル転移
UMIの手先軌道データからヒューマノイドの全身協調動作を実時間生成し、拡散方策と組み合わせて4タスクで全身マニピュレーションを実現した。
原題: Whole-Body UMI: Transferring UMI Manipulation Skills to Humanoid Whole-Body Manipulation via Real-Time Motion Generation / Yuxuan Nai, Leixin Chang, Liangjing Yang 他
日本語で読む → - 論文VLAロボティクス
非同期リプレイ固定方策改善による安定かつ効率的な実世界オンラインVLA事後学習
ロールアウトと学習を並行して行い、リプレイされた行動に基づいて価値関数と方策を更新することで、実世界のVLAモデルを短時間で安定的にオンライン事後学習する手法を提案。
原題: Stable and Efficient Real-World Online VLA Post-Training via Asynchronous Replay-Anchored Policy Improvement / Jiarui Yang, Jiajin Zhang, Bin Zhu 他
日本語で読む →