論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/22 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
身体を知る:VLMによる直接的・自己改善的なロボット制御のためのハーネス
視覚言語モデルの重みを固定したまま、ロボットの身体構造に関する知識を明示化・更新可能にし、行動選択と過去の経験解釈を改善するフレームワークKnowBodyを提案。実機4タスクで成功率75%を達成。
原題: Know Your Body: A Harness for Direct and Self-Improving Robot Control with VLMs / Zeyu Lou, Yanhong Zeng, Yong Wang 他
日本語で読む → - 論文歩行ロボティクス
ハエに着想を得たリカレント制御器によるヒューマノイド歩行
ハエの神経回路を模したリカレント制御器でUnitree G1ヒューマノイドの歩行を制御し、7種類の地形・3速度・3つの初期ヨー角で評価した。
原題: Humanoid Locomotion with a Fly-Inspired Recurrent Controller / Isabel Guan, Yuntian Zhao, Dingyuan Zhang 他
日本語で読む → - 論文マルチエージェント強化学習cs.MA
MATES: 凍結した単一エージェント方策の観測変換によるマルチエージェント相互作用の学習
マルチエージェント環境の観測を、凍結した単一エージェント方策が扱える形式に変換する小さなアダプタを学習することで、方策を再学習せずに協調行動を実現する手法。
原題: MATES: Learning Multi-Agent Interactions by Transforming Observations for Frozen Single-Agent Policies / Elie Abboud, Oren Gal
日本語で読む → - 論文自動運転VLAロボティクス
走ってから歩け:VLM自動運転のためのRun-then-Walkスケジューリング戦略
VLMベースの自動運転プランナー向けに、進捗探索を優先する「Run」段階と安全性を修復する「Walk」段階を分けた2段階GRPO報酬スケジューリングを提案し、性能と収束速度を両立させた。
原題: Sometimes You Gotta Run Before You Can Walk: Run-then-Walk Scheduling Strategy for VLM Autonomous Driving / Yuqi Ye, Shangkun Sun, Junhong Lin 他
日本語で読む → - 論文姿勢推定画像認識
合成データのみで訓練した視覚基盤モデルによる宇宙機の単眼姿勢推定
DINOv3をLoRAで適応し合成データのみで訓練することで、宇宙機の単眼姿勢推定精度を従来手法より大幅に改善し、Jetson Orin NX上での組み込み推論の実現可能性も示した。
原題: Vision Foundation Models with Synthetic-Only Training for Monocular Spacecraft Pose Estimation / John Church, Vazghen Nikolian
日本語で読む → - 論文VLAロボティクス
RoboFollow:身体性エージェントにおける指示追従の幻想を暴く
視覚シーンが一つのタスクしか許さない「低シーンエントロピー」問題を指摘し、言語理解を厳密に診断する4段階ベンチマークRoboFollowを提案。9つのVLA/WAMポリシーを評価し、指示追従能力が実は脆弱であることを示した。
原題: RoboFollow: Unveiling the Instruction Following Mirage in Embodied Agents / Chang Guo, Yukun Xie, Bohan Tan 他
日本語で読む → - 論文VLAロボティクス
階層的間取り誘導型視覚言語探索による身体性質問応答
RGB-D観測から階層的シーングラフと開放語彙占有マップを構築し、間取りの事前情報とVLM計画を組み合わせて未知環境を効率的に探索するEQAフレームワークを提案した。
原題: Hierarchical Floorplan-Guided Vision-Language Exploration for Embodied Question Answering / Albert Gassol Puigjaner, Kostas Alexis
日本語で読む → - 論文手術ロボット/組織シミュレーションロボティクス
腹腔鏡手術ロボットのポリシー評価のための接触安定な変形組織シミュレーション:陰的積分とライブポーズ把持制約
手術ロボットの閉ループ評価用に、RGB-D記録から再構成した組織を陰的積分とライブポーズ把持制約で安定にシミュレートする環境を構築し、把持・持ち上げの再現性と精度を検証した。
原題: Contact-Stable Deformable Tissue Simulation Using Implicit Integration and Live-Pose Grasp Constraints for Laparoscopic Surgery Robot Policy Evaluation / Juahn Oh, Dongho Yee, Jinseok Lee 他
日本語で読む → - 論文SLAMロボティクス
ArborSplat: 果樹園のためのオンライン意味論的ガウシアンスプラッティングSLAM
LiDARオドメトリで追跡しながら3Dガウシアンマップ上で直接意味論を最適化し、果樹園の幹や棚、果実などの細い構造を保つオンライン意味論SLAMを提案。
原題: ArborSplat: Online Semantic Gaussian Splatting SLAM for Orchards / Alessandro Masini, Matteo Frosi, Mirko Usuelli 他
日本語で読む → - 論文VLAロボティクス
VisForce: 目標条件付き巧みな操作のための現在力と目標力の視覚的接地
指先位置に現在力と目標力を視覚的に重畳し、目標条件付きクロスアテンションで力認識動作を生成するVLA手法を提案し、実機で把持・操作タスクを評価した。
原題: VisForce: Visual Grounding of Current and Desired Forces for Goal-Conditioned Dexterous Manipulation / Jung-Woo Lee, Soo-Chul Lim
日本語で読む → - 論文走破性推定ロボティクス
FLINT: 走破性推定のための高速軽量推論
RGBカメラのみを用いた軽量な走破性推定器FLINTを提案し、CPU上で14.7FPSで動作しながら、既存の基盤モデルシステムより高精度なコストマップを生成できることを示した。
原題: FLINT: Fast Lightweight Inference for Traversability / William Bonilla, Maxime Boisvert, David-Alexandre Poissant 他
日本語で読む → - 論文自己位置推定ロボティクス
Dr-LiSA: レーダー・LiDARスキャンの直接位置合わせによるSE(3)自己位置推定
LiDAR地図からレーダー観測を予測する学習モデルを用い、レーダー強度画像をSE(3)で直接位置合わせする初の手法を提案し、従来の平面推定を上回る精度を実現した。
原題: Dr-LiSA: Direct Radar-Lidar Scan Alignment for $SE(3)$ Localization / Alex Zhang, Daniil Lisus, Cedric Le Gentil 他
日本語で読む → - 論文手術ロボットロボティクス
術具装着型センサによる腹腔鏡下虫垂切除の両手操作学習:ロボット実演なしでの生体適用
術者が使う腹腔鏡器具にセンサを取り付け、その動きから手術ロボットの両手操作方策を学習し、生きたウサギでの虫垂切除に成功した。
原題: From Instrument-Mounted Demonstrations to In-Vivo Execution: Learning Bimanual Laparoscopic Appendectomy Without Robot-Collected Demonstrations / Dongho Yee, Juahn Oh, Jinseok Lee 他
日本語で読む → - 論文建設機械の自動化ロボティクス
深層Koopman MPCによるホイールローダのVサイクル自動化
ホイールローダの土砂運搬作業(Vサイクル)を自動化するため、幾何学的計画とデータ駆動型Koopmanモデル予測制御を組み合わせた階層フレームワークを提案し、高忠実度シミュレーションで有効性を示した。
原題: Wheel-loader V-Cycle Automation with Deep Koopman MPC / Armin Abdolmohammadi, Navid Mojahed, Dinesh Kumar 他
日本語で読む → - 論文SLAM/オドメトリ評価ロボティクス
オドメトリ評価は共分散を考慮すべき
オドメトリの評価に共分散を組み込んだ厳密に適切なスコアリング規則を提案し、LiDAR慣性オドメトリの過信を検出した。
原題: You Should Be Properly Scoring Your Odometry / Ola Rønning, Usama Saqib, Andrzej Wąsowski
日本語で読む → - 論文教育・ヒューマノイド・強化学習ロボティクス
高校生向け強化学習とヒューマノイドロボティクスの教育:低コストオープンプラットフォームにおける専門家検証済みカリキュラム設計
低コストのオープンソースヒューマノイドロボットと強化学習シミュレーションを用いて、高校生が組み立て・シミュレーション・歩行政策学習・実機展開を体験する統合カリキュラムを設計し、専門家による形成的評価を通じて三つの設計上の緊張を明らかにした。
原題: Teaching Reinforcement Learning and Humanoid Robotics to High-School Students: An Expert-Validated Curriculum Design on a Low-Cost Open Platform / Yuanzhe Dong, Jie Cao, Shuman Wang
日本語で読む → - 論文sim2realロボティクス
AgriGen: 農業ロボティクス向け大規模フォトリアルシーン生成フレームワーク
Isaac Sim上に構築したROS統合フレームワークで、作物列・果樹園・ぶどう園などの農業環境をフォトリアルかつ大規模に手続き生成し、物理シミュレーションとドメインランダム化を可能にする。
原題: AgriGen: Large-Scale Scene Generation Framework for Photorealistic Agricultural Robotics Simulation / Utkarsh Bajpai, Serge Tleiji, Cédric Pradalier 他
日本語で読む → - 論文ジェスチャー制御ロボティクス
本人認証ゲート付きドローンジェスチャー制御の実機展開研究
顔認証で登録オペレータのみにジェスチャー操作を許可する制御スタックを構築し、DJI Tello EDU上で270回の試験を通じてオフライン・飛行中の性能を評価した。
原題: A Deployment Study of Identity-Gated Drone Gesture Control / Diyari Mohammed Salih, Ilyes Chaabeni, Naima Ait Oufroukh
日本語で読む → - 論文動的マニピュレーションロボティクス
MotionForge:動的物体の長期的操作のためのデータ生成パイプラインと大規模ベンチマーク
動的環境でのロボット操作を評価するため、11種類の運動パターンを含む40タスクと長期タスク17件を備えた大規模シミュレーションベンチマークとデータ生成パイプラインを提案し、ドメインシフト下での汎用ポリシーの限界を明らかにした。
原題: MotionForge: A Data Generation Pipeline and Large-Scale Benchmark for Long-Horizon Manipulation of Dynamic Objects with Domain Shifts / Mohan Liu, Dengchen Mei, Haotian Xian 他
日本語で読む → - 論文ベンチマーク/物理多様性ロボティクス
RoboTwin-Phys:物理条件の多様性に挑むロボット操作ベンチマーク
質量・摩擦・関節ダイナミクスなど13の物理属性を連続的に変化させるロボット操作ベンチマークを提案し、既存のWAMやVLAが物理条件の変化に対して大きなロバスト性ギャップを示すことを明らかにした。
原題: RoboTwin-Phys: Do WAMs and VLAs Understand the Physical World? / Jiaqi Zhang, Feng Ye, Mingjia Yang 他
日本語で読む → - 論文sim2realロボティクス
PhyVisGen: 物理的・視覚的に高忠実なロボットマニピュレーションデータ生成
ソフトグリッパを含む操作軌跡の物理シミュレーションと実シーン再構成によるリアルな描画を組み合わせ、実機データなしで学習した方策が実ロボット5タスクで65〜95%の成功率を達成したデータ生成フレームワーク。
原題: PhyVisGen: Physically and Visually High-Fidelity Robotic Manipulation Data Generation / Yu Zheng, Qiyu Feng, Yixin Wu 他
日本語で読む → - 論文VLAロボティクス
MachEmbodied-U0:身体知能のための統合理解・生成モデル
理解と生成の専門家をMixture-of-Transformersで統合し、視覚力学と行動生成をフローマッチングで結びつけた身体知能基盤モデルを提案。LIBEROで99.0%の成功率を達成。
原題: MachEmbodied-U0: Unified Understanding and Generation Model for Embodied Intelligence / Haoran Wen, Wenfu Wang, Kunsong Shi 他
日本語で読む → - 論文顔匿名化画像認識
HYDRO: 高忠実度ハイブリッド拡散とターゲット指向アプローチによる非可逆的な顔匿名化
ターゲット指向の顔匿名化に拡散モデルを組み合わせ、復元攻撃を防ぐ非可逆的な匿名化手法を提案。
原題: HYDRO: Towards Non-Reversible Face De-Identification Using a High-Fidelity Hybrid Diffusion and Target-Oriented Approach / Felix Rosberg, Vitomir Štruc, Cristofer Englund 他
日本語で読む → - 論文水中ナビゲーションロボティクス
単一センサユニットの計測履歴を用いた非定常流れ下の水中ナビゲーション
単一のセンサユニットが取得した計測履歴から、因果的オブザーバを用いて流れの横方向速度を推定し、水中ロボットのナビゲーション制御に利用する手法を提案した。円柱後流で訓練したオブザーバが未学習のレイノルズ数でも高い成功率を達成することを示した。
原題: Underwater Navigation in Unsteady Flows Using Measurement Histories from a Single Sensing Unit / Linhao Jin, Qimin Feng, Peter Gunnarson 他
日本語で読む → - 論文強化学習/エージェントAI
サブタスク分解による強化学習
マルチターンの軌跡報酬をサブタスクごとに分解し、各サブタスクのグループ相対アドバンテージを計算してトークン単位でクレジットを配分するRLDSを提案。エージェント系ベンチマークで有効性を示す。
原題: Reinforcement Learning with Decomposed Subtasks / Mattie Terzolo, Mikolaj Sacha, Ayan Sinha 他
日本語で読む → - 論文マルチエージェント強化学習機械学習
完全ビザンチン耐性マルチエージェント強化学習
通信層にビザンチン攻撃がある分散マルチエージェント強化学習において、2ホップメッセージの冗長性を利用して信頼できるメッセージを特定し、攻撃がない場合と同じ極限点に収束する手法を提案した。
原題: Fully Byzantine-Resilient Multi-Agent Reinforcement Learning / Haejoon Lee, Dimitra Panagou
日本語で読む → - 論文ベンチマークロボティクス
実環境で働くロボットのベンチマーク:実験室から実運用へ
公共環境で使うロボットの評価枠組みを提案し、清掃や図書館案内の3事例で3年間の実地ベンチマークを実施して、実運用に必要な要件を明らかにした。
原題: Benchmarking Robots for Everyday Environments: From Lab Experiments to Real-World Operations / Raphael Memmesheimer, Martina Overbeck, Dominik Beyer 他
日本語で読む → - 論文マニピュレーションロボティクス
SafeLoop: 視覚言語行動マニピュレーションのためのリスク認識ロールバック
VLAモデルのパラメータを変えずに外部ラッパーとして危険予測とロールバック復帰を追加し、衝突や物体落下を約70%削減しつつタスク成功率を維持する手法を提案。
原題: SafeLoop: Risk-Aware Rollback for Vision-Language-Action Manipulation / Zeyu Lou, Tianran Zhang, Xinquan Yue 他
日本語で読む → - 論文テレオペレーションロボティクス
MATE: ヒューマノイド協調データ収集のためのマルチエージェント仮想テレオペレーションプラットフォーム
地理的に分散した複数の操作者が共有物理環境でヒューマノイドを同時遠隔操作できる仮想プラットフォームを構築し、協調動作の大規模データセットを収集した。
原題: MATE: Multi-Agent Virtual Teleoperation Platform for Humanoid Collaboration Data Collection / Yichuan Yu, Youzhuo Wang, Yiming Ren 他
日本語で読む → - 論文到達可能性解析ロボティクス
モデル不確かさ下の運動予測のための方向条件付き到達可能性の高速計算
状態・入力行列が不確かな線形系に対し、指定方向への到達範囲をほぼ保ちつつ単一モデルを選んで到達集合を計算する高速手法を提案し、不確かさ全家族の計算より約3倍速いことを示した。
原題: Fast Direction-Conditioned Reachability for Motion Prediction Under Model Uncertainty / Hrishav Das, Melkior Ornik
日本語で読む →