論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文映像予測画像認識
CrossScope: 役割非対称な世界モデルによる二視野同時手術映像予測
内視鏡手術の二つの視点(母視点と子視点)の映像を、役割に応じて非対称に情報をやり取りしながら未来予測する世界モデルを提案した。
原題: CrossScope: A Role-Asymmetric World Model for Joint Dual-Scope Surgical Video Prediction / Wanhao Liu, Jinsong Lin, Rulin Zhou 他
日本語で読む → - 論文VLAロボティクス
継続か再計画か?適応的実行期間のためのベルヌーイ継続方策学習
固定長のアクションチャンクを実行するVLAモデルにおいて、再計画のタイミングをタスク進捗に応じて適応的に決める軽量フレームワークを提案し、成功率を向上させた。
原題: Continue or Replan? Bernoulli-Continuation Policy Learning for Adaptive Horizon Execution / Weichen Xu, Zhenhua Liu, Lin Luo 他
日本語で読む → - 論文群制御ロボティクス
DeRP: 情報制限環境における再帰的分岐を用いた電力供給ネットワークの自己組織化アルゴリズム
ロボット群が局所通信と方位センシングのみを用いて、電源から複数のシンクへ電力を供給するネットワークを自己組織化的に構築するアルゴリズムを提案した。
原題: DeRP: An Algorithm for Self-Assembly of Power-Delivery Networks using Recursive Branching in Information-Limited Environments / Mohammadali Rashidioun, Sangwoo Park, Petras Swissler
日本語で読む → - 論文ソフトロボティクス/リザーバーコンピューティングロボティクス
デジタルから物理へのリザーバーコンピューティング:ダイナミクスマッチングによるソフトロボットリザーバーの共最適化
ソフトロボットの物理リザーバーを、高性能なデジタルリザーバーのダイナミクスに合わせて事前学習・共最適化する手法を提案し、シミュレーションで分類・予測タスクの性能向上を実証した。
原題: From Digital to Physical Reservoir Computing: Co-Optimizing Soft Robotic Reservoirs via Dynamics Matching / Nicola Visentin, Maximilian Stölzle, Mariano Ramírez Montero 他
日本語で読む → - 論文VIO/ナビゲーションロボティクス
TANGO-VIO: 特徴点の観測可能性を保証する三角測量認識ナビゲーションによる視覚慣性オドメトリ
視覚慣性オドメトリにおいて、カメラの並進が小さく視差が不足すると特徴点の三角測量が不安定になる問題に対し、制御バリア関数を用いて三角測量情報量の下限を保証するナビゲーションフレームワークを提案した。シミュレーションと実機実験で有効性を確認した。
原題: TANGO-VIO: Triangulation-Aware Navigation with Guaranteed Feature-Observability for Visual-Inertial Odometry / Abdülbaki Şanlan, Ege C. Altunkaya, Hasan T. Bağci 他
日本語で読む → - 論文自動運転/物体認識画像認識
オープンワールド階層的知覚:語彙外道路物体の安全な扱いのためのクラス非依存提案に対する分類学的抽象化
閉集合検出器では扱えない未知の道路物体を、階層的タクソノミーとクラス非依存の提案を用いて安全に分類・フラグ付けする手法を提案し、実データで評価した。
原題: Open-World Hierarchical Perception: Taxonomic Abstraction over Class-Agnostic Proposals for the Safe Handling of Out-of-Vocabulary Road Objects / Felix Schaller
日本語で読む → - 論文VLAロボティクス
AtlasVLA: 視覚言語行動モデルのための持続的な世界・自我状態モデリング
単眼カメラのみで長期的なタスクを遂行できるよう、視覚言語行動モデルに持続的な世界状態メモリと自我作業メモリを導入し、空間推論とタスク進行の追跡を可能にした。
原題: AtlasVLA: Persistent World-Ego State Modeling for Vision-Language-Action Models / Guiyu Zhao, Longteng Guo, Yanghong Mei 他
日本語で読む → - 論文ベンチマーク画像認識
画像空間におけるルール発見
画像編集モデルが画像内の指示を読み取り、問題解決をエンドツーエンドで行えるかを評価するベンチマークWISRDを提案し、最先端モデルの性能を分析した。
原題: Image-Space Rule Discovery / Misora Sugiyama, Toya Oyama, Hirokatsu Kataoka
日本語で読む → - 論文宇宙機制御physics.space-ph
遺伝的ファジィシステムによる宇宙機ランデブー接近運用の最終接近制御
宇宙機のランデブー最終接近フェーズにおいて、遺伝的アルゴリズムで訓練したファジィ推論コントローラを用いて、エネルギー消費を最小化しつつ目標に到達する手法を提案した。
原題: Genetic Fuzzy System-based Control for Final Approach of Spacecraft Rendezvous and Proximity Operations / Daegyun Choi, Donghoon Kim, Henzeh Leeghim
日本語で読む → - 論文ワールドモデルロボティクス
GeniWorld: 視覚的アクションによるロボット操作のための汎化可能なインタラクティブワールドモデル
事前学習済みビデオ生成モデルとURDFベースのレンダリングを組み合わせ、数値アクションを視覚的アクション表現に変換することで、未見環境へのロバストなゼロショット汎化を実現するインタラクティブワールドモデルを提案した。
原題: GeniWorld: A Generalizable Interactive World Model for Robotic Manipulation via Visual Actions / Chenghao Gu, Hanyang Yu, Jingbo Zhang 他
日本語で読む → - 論文模倣学習ロボティクス
人間のデモンストレーションからのロボット学習:手書きアルファベット軌道と人間らしさの評価
タッチスクリーンで収集した手書き軌道データを用いて、確率的軌道学習と人間らしさの評価を行うフレームワークを提案した。
原題: Robot Learning from Human Demonstrations: Handwritten Alphabet Trajectories and Human-Likeness Evaluation / Alperen Kenan, Paul Bremner, Manuel Giuliani
日本語で読む → - 論文ナビゲーションロボティクス
階層型高速・低速ReActエージェントによるゼロショット物体目標ナビゲーション
ロボットが未踏の建物内で指定された物体カテゴリを見つけるゼロショット物体目標ナビゲーションにおいて、過去の観測を記憶し、VLMによる検討を階層的に行うことで、従来手法を上回る成功率を達成した。
原題: Hierarchical Fast-Slow ReAct Agent for Zero-Shot Object-Goal Navigation / Zhaochen Lan, Zhi Yang, Yuxiang Fu 他
日本語で読む → - 論文外骨格/強化学習ロボティクス
股関節外骨格のための段階的マルチエージェント訓練(SMAT):シミュレーション訓練された共適応コントローラの代謝・生体力学的検証
シミュレーションのみで訓練した股関節外骨格の制御ポリシーを実機で検証し、受動時と比較して代謝コストを19.7%削減することを実証した論文。
原題: Staged Multi-Agent Training (SMAT) for Hip Exoskeletons: Metabolic and Biomechanical Validation of a Simulation-Trained Co-Adaptive Controller / Yifei Yuan, Jakob Wolf, Ghaith Androwis 他
日本語で読む → - 論文ナビゲーションロボティクス
LifelongCrossNav: 複数階を横断する物体ナビゲーションのための持続的3Dセマンティックメモリ
未知の複数階建て環境で、連続する複数の物体目標を探索するナビゲーション手法を提案。共有の3Dセマンティックボクセルメモリを構築し、階をまたぐ探索を可能にする。
原題: LifelongCrossNav: Persistent 3D Semantic Memory for Cross-Floor Multi-Object Navigation / Zehui Li, Zihao Sun, Jiawei Xu 他
日本語で読む → - 論文群制御ロボティクス
協調運搬のためのTDMA通信制御共設計:遅延較正とサンプリングレート最適化
マルチロボットの協調運搬において、ネットワーク遅延に応じた適応サンプリングとリーダー交代が通信負荷を公平に分散しつつ制御性能を維持できることを、物理シミュレーションと無線モデリングで示した論文。
原題: TDMA Based Communications Control Co-Design for Cooperative Carrying: Delay Calibration and Sampling-Rate Optimization / Zahra Seifaei, Maximilian Luebke, Torsten Reissland 他
日本語で読む → - 論文VLA/推論最適化ロボティクス
ニューラル内省ゲーティングによる視覚言語行動モデルの適応的KVキャッシュ再利用
視覚言語行動モデル(VLA)の推論コスト削減のため、視覚的類似性に基づくKVキャッシュ再利用に、モデル自身の不確実性(ロジットマージン)を監視してキャッシュを無効化する軽量なトレーニング不要の手法を提案した。
原題: Neural Introspection Gating for Adaptive KV-Cache Reuse in Vision-Language-Action Models / Zhijie Wu, Kento Kawaharazuka, Kei Okada
日本語で読む → - 論文教示/ハンドガイドロボティクス
オブザーバベースの能動支援ハンドガイドによるスケーラブルな運動教示の実現
ロボットのハンドガイド教示において、追加センサなしでモデルベースの外力推定を用いて操作者の意図した動作を能動的に支援する手法を提案し、疲労軽減と教示のスケーラビリティ向上を実現した。
原題: Enabling Scalable Kinesthetic Teaching via Observer-based Hand-guiding with Active Support / Anna Tuma, Giuseppe Monetti, Jochen J. Steil 他
日本語で読む → - 論文VLAロボティクス
運転用視覚言語行動モデルにおける計画トークンの深さ方向の探索と刈り込み
運転用VLAモデルで、計画トークンが各デコーダ層でどの程度の情報を持つかを調べ、初期層で意味情報が線形分離可能であることを示し、性能を保ちながら層を刈り込む手法を提案した。
原題: Depth-Wise Probing and Pruning of the Planning Token in a Driving Vision-Language-Action Model / Harisankar Babu, Benjamin Coors, Christopher Lang 他
日本語で読む → - 論文水中ロボット/計画・制御ロボティクス
閉鎖環境における水中ビークル・マニピュレータシステムの階層型トポロジー認識計画と制御
水中ロボットアーム(UVMS)が狭く障害物の多い環境で作業するための、3層の階層的計画・制御フレームワーク「MANTA」を提案。通路の接続性、操作可能性、実行の安定性を考慮し、シミュレーションで高い成功率を達成した。
原題: Hierarchical Topology-Aware Planning and Control of Underwater Vehicle-Manipulator Systems in Confined Environments / Mohamed Abdelwahab, Ruggero Carli, Damiano Varagnolo 他
日本語で読む → - 論文マニピュレーションロボティクス
CAAT: 接触認識アテンションスケーリングと触覚マスキングによるデータ効率的な接触リッチ操作
視覚と触覚を統合するTransformerベースのポリシーに、接触前後で情報の重みを切り替える接触認識アテンションスケーリングと動的触覚マスキングを導入し、デモからの学習効率と成功率を向上させた。
原題: CAAT: Contact-Aware Attention Scaling and Tactile Masking for Data-Efficient Contact-Rich Manipulation / Jiaming Jiang, Yuzhe Huang, Hao Liang 他
日本語で読む → - 論文群制御ロボティクス
スマートIoTタグを用いた緊急度認識型ロボット群倉庫内物流
倉庫内の各搬送キャリアに緊急度をブロードキャストするIoTタグを取り付け、ロボット群がその情報を直接読み取って優先度を考慮した搬送を行う分散型物流システムを提案・評価した。
原題: Enabling Urgency-aware Robot Swarm Intralogistics using Smart IoT Tags / Youssef Alboraei, Murray Groves, Shane Wen 他
日本語で読む → - 論文医療画像/深度推定eess.IV
リアルタイム腹腔鏡手術ナビゲーションのためのAIベース単一ショット構造光深度再構成
受動LED照明とバイナリマスクを用いた同期不要の単一ショット深度センシングプラットフォームを開発し、VQ-VAE事前分布とU-Net深度ヘッドで高精度な深度推定を実現した。
原題: AI-based single-shot structured-light depth reconstruction for real-time laparoscopic surgical guidance / Wayne Wonseok Rodgers, Xiangyi Le, Seonghoon Jang 他
日本語で読む → - 論文ヒューマノイドロボティクス
ω-0: 人間型ロボットの同時移動操作のための潜在予測世界行動モデル
言語指示と視覚・状態入力から、移動と操作を同時に行う全身行動を直接予測する世界行動モデルを提案し、実機で11種類の家庭タスクを達成した。
原題: $\omega$-0: A Latent Predictive World Action Model for Concurrent Humanoid Loco-Manipulation / Zhe Li, Zhenzhe Zhang, Yangyang Wei 他
日本語で読む → - 論文位置推定制御
軌道誘発型自己校正による未知姿勢リレーを介した隠れターゲットの位置推定
未知の位置・姿勢を持つリレービーコンからの距離・方位情報を用いて、直接観測できない隠れターゲットを推定する手法を提案。車両の軌道を利用してリレーの姿勢と位置を自己校正し、高精度な位置推定を実現した。
原題: Trajectory-Induced Self-Calibration for Hidden-Target Localization Through an Unknown-Pose Range-Bearing Relay / Yash Bagla
日本語で読む → - 論文強化学習ロボティクス
EvoHIL: 自己進化型報酬とフローマッチングによるポリシー最適化を用いた堅牢な人間参加型強化学習
人間参加型強化学習において、報酬モデル・行動生成・視覚ドメインの3つの限界を同時に適応させる統一フレームワークEvoHILを提案し、照明変化下の6つの操作タスクで性能を向上させた。
原題: EvoHIL: Self-Evolving Reward and Flow-Matched Policy Optimization for Robust Human-in-the-Loop Reinforcement Learning / Shuoqin Zhang, Tongtong Cheng, Xiru Gao 他
日本語で読む → - 論文3Dレイアウト生成ロボティクス
Roomer: 反射的オブジェクト接地モデル編集と修復による3D室内レイアウト合成
既存の室内レイアウト生成器が残す局所的な違反(衝突、はみ出し、開口部の妨害、動線の遮断)を、オブジェクト単位の修復問題として捉え、視覚言語モデルによる計画と決定的検証を組み合わせて局所編集する修復フレームワークを提案した。
原題: Roomer: Reflective Object-Grounded Model Editing and Repair for 3D Indoor Layout Synthesis / Lingwei Dang, Ziyan Qiu, Jiajia Cheng 他
日本語で読む → - 論文ナビゲーションロボティクス
AeroDPO: 高忠実度知覚と自動選好最適化による軽量UAVナビゲーションの実現
UAVの視覚言語ナビゲーションにおいて、軽量な2Bモデルでも高品質な視覚入力があれば巨大な7Bモデルと同等の成功率を達成できることを示し、純粋な行動クローニングの衝突リスクを、物理シミュレーションの状態ロールバックを用いた自動選好最適化(AeroDPO)で克服する手法を提案した。
原題: AeroDPO: Unleashing Lightweight UAV Navigation with High-Fidelity Perception and Automated Preference Optimization / Peng Xu, Chengcheng Wang, Shaohua Wan
日本語で読む → - 論文群制御ロボティクス
探索支援型エージェント・環境協調強化学習による回転動作を考慮した頑健な生涯マルチエージェント経路探索
実世界の倉庫システムを模した回転制約付き生涯マルチエージェント経路探索問題に対し、探索ベースのプランナーと強化学習を組み合わせ、エージェントと環境のポリシーを同時に最適化する手法を提案した。
原題: Search-Aided Joint Agent-Environment Reinforcement Learning for Robust Lifelong Multi-Agent Path Finding with Rotations / He Jiang, Jingtian Yan, Yulun Zhang 他
日本語で読む → - 論文群制御ロボティクス
確率的拡散モデリングを用いた動的UAV捜索:海中転落者探索の最適化
海中転落事故後の行方不明者の位置を確率的に予測し、UAVによる効率的な捜索手法を提案・評価した論文。
原題: Dynamic UAV-based search operations using probabilistic diffusion modeling of Man Overboard incident victims / Dimosthenis Angelis, Evangelos Boukas
日本語で読む → - 論文モーション追跡ロボティクス
HumanTracker:人間の知覚に整合した包括的なモーション追跡ベンチマーク
ヒューマノイドのモーション追跡評価を人間の知覚に整合させ、大規模化するためのベンチマークと評価指標を提案した論文。
原題: HumanTracker: Towards Comprehensive and Human-Aligned Motion Tracking Benchmark / Dairu Liu, Zekun Qi, Jiayu Zeng 他
日本語で読む →