論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/操作ロボティクス
STARRY: ロボット操作のための時空間アクション中心世界モデル
将来の時空間予測とアクション生成を統一拡散プロセスで統合し、幾何学的注意変調により3次元制御を強化する世界モデル拡張型VLAポリシーを提案。
原題: STARRY: Spatial-Temporal Action-Centric World Modeling for Robotic Manipulation / Yuxuan Tian, Yurun Jin, Bin Yu 他
日本語で読む → - 論文操作学習ロボティクス
LaST-R1: 適応的物理潜在推論によるロボット操作の強化学習強化
ロボット操作の基盤モデルに対し、潜在推論と行動生成を共同最適化する強化学習フレームワークを提案し、LIBEROベンチマークで99.9%の成功率を達成した。
原題: LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning / Hao Chen, Jiaming Liu, Zhonghao Yan 他
日本語で読む → - 論文自律システムcs.LO
ODD耐性を持つ自律システムのための形式的保証付き制御適応
運用設計領域外の状況に対応するため、確率的システムモデルを適応させつつ定量的な保証を提供する手法を提案した。予期しない状況下でもシステムの信頼性を向上できることを示した。
原題: Formally Guaranteed Control Adaptation for ODD-Resilient Autonomous Systems / Gricel Vázquez, Calum Imrie, Sepeedeh Shahbeigi 他
日本語で読む → - 論文自動運転安全性ロボティクス
コネクテッド・ディペンダビリティ・ケージ:安全な自動運転車の開発と運用のための実行時機能・異常監視
自動運転車のAI知覚システムの安全性を高めるため、機能監視と異常監視を統合した階層的フェイルオペレーショナルアーキテクチャを提案し、異常時には安全な縮退動作やデータ記録を行う。
原題: Connected Dependability Cage: Run-Time Function and Anomaly Monitoring for the Development and Operation of Safe Automated Vehicles / Iqra Aslam, Nour Habib, Abhishek Buragohain 他
日本語で読む → - 論文アーキテクチャロボティクス
AEROS: 具現化能力モジュールを備えた単一エージェント動作アーキテクチャ
ロボットを単一の持続的な知的エージェントとしてモデル化し、能力をインストール可能なモジュール(ECM)として拡張する新しいアーキテクチャAEROSを提案。ポリシー分離ランタイムにより安全性を保証し、シミュレーションで高い成功率とモジュール交換性を実証した。
原題: AEROS: A Single-Agent Operating Architecture with Embodied Capability Modules / Xue Qin, Simin Luan, John See 他
日本語で読む → - 論文ナビゲーションロボティクス
階層的認知と文脈認識型探索を備えた実装可能な具現化視覚言語ナビゲーションシステム
実世界ロボット向けに、高速な知覚行動層と深い推論層を非同期に動作させ、共有メモリで連携するVLNシステムを提案。探索問題を重み付き巡回修理人問題として定式化し、実機でも高効率・高推論性能を実現した。
原題: A Deployable Embodied Vision-Language Navigation System with Hierarchical Cognition and Context-Aware Exploration / Kuan Xu, Ruimeng Liu, Yizhuo Yang 他
日本語で読む → - 論文モーションプランニングロボティクス
ATRS: 共有ニューラルポリシーによる適応的軌道再分割と並列最適化
ADMMによる並列軌道最適化において、停滞するセグメントを強化学習で適応的に再分割するフレームワークATRSを提案。共有ポリシーによりセグメント数変化や未知環境への一般化を実現。
原題: ATRS: Adaptive Trajectory Re-splitting via a Shared Neural Policy for Parallel Optimization / Jiajun Yu, Guodong Liu, Li Wang 他
日本語で読む → - 論文経路計画/協調制御ロボティクス
UGV-UAV協調による最短経路の分割点検と最適化
未知の道路閉塞がある環境で、地上車両(UGV)と無人航空機(UAV)が協調して最短経路を計画する問題を扱い、経路分割戦略とUAVの点検戦略の最適性を証明し、実験でUGVの移動時間を最大30%削減した。
原題: Optimal UGV-UAV Cooperative Partitioning and Inspection of Shortest Paths / Ninh Nguyen, Srinivas Akella
日本語で読む → - 論文データ収集/模倣学習ロボティクス
XRZero-G0:インターフェース、品質、比率で器用なロボット操作の最前線を押し広げる
ロボットを使わない人間のデモデータ収集システムXRZero-G0を提案し、閉ループの品質管理とデータ混合比率の最適化により、少量の実機データで大規模なロボットフリーデータと組み合わせて同等性能を達成し、コストを20分の1に削減した。
原題: XRZero-G0: Pushing the Frontier of Dexterous Robotic Manipulation with Interfaces, Quality and Ratios / James Wang, Primo Pu, Zephyr Fung 他
日本語で読む → - 論文自動運転ロボティクス
Bench2Drive-VL: 視覚言語モデルを用いたクローズドループ自動運転のベンチマーク
自動運転における視覚言語モデル(VLM)の評価を、従来のオープンループの静的QAではなく、クローズドループ環境で行うためのベンチマークを提案した論文。
原題: Bench2Drive-VL: Benchmarks for Closed-Loop Autonomous Driving with Vision-Language Models / Xiaosong Jia, Yuqian Shao, Zhenjie Yang 他
日本語で読む → - 論文自動運転/VLAロボティクス
因果的シーン叙述と実行時安全監視による視覚言語行動駆動モデルの性能向上
自動運転向けVLAモデルへのテキスト入力を因果構造で再構成し、実行時安全監視を加えることで運転性能を大幅に改善した。
原題: Causal Scene Narration with Runtime Safety Supervision for Vision-Language-Action Driving / Yun Li, Yidu Zhang, Simon Thompson 他
日本語で読む → - 論文支援ロボットロボティクス
StretchBot: 支援ロボットによる適応的ガイダンスのためのニューロシンボリックフレームワーク
ストレッチやリハビリを支援するロボットコーチ「StretchBot」を提案。知識グラフと大規模言語モデルを組み合わせ、ユーザーや環境に応じてガイダンスを適応させる。予備実験では適応的ガイダンスが文脈適合性で優れる一方、スクリプト型は滑らかさで競合した。
原題: StretchBot: A Neuro-Symbolic Framework for Adaptive Guidance with Assistive Robots / Luca Vogelgesang, Ahmed Mehdi Soltani, Mohammadhossein Khojasteh 他
日本語で読む → - 論文VLA/構造化ポリシーロボティクス
合成ニューロシンボリック監視による視覚言語モデルからの構造化ロボットポリシー学習
視覚言語モデルを用いて、視覚観察と自然言語指示から実行可能なビヘイビアツリーポリシーを自動生成するニューロシンボリック手法を提案し、合成データのみで学習したモデルが実ロボットで動作することを示した。
原題: Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision / Alessandro Adami, Tommaso Tubaldo, Marco Todescato 他
日本語で読む → - 論文VLA/タスク実行ロボティクス
オープンワールドタスク実行におけるVLAエージェントの長期記憶
化学実験自動化のための二層メモリと将来状態予測を備えたVLAベースのフレームワークChemBotを提案し、長期的なタスク成功率を向上させた。
原題: Long-Term Memory for VLA-based Agents in Open-World Task Execution / Xu Huang, Weixin Mao, Yinhao Li 他
日本語で読む → - 論文歩行ロボティクス
物理的模倣学習:制御ポリシーを受動弾性へ蒸留する
強化学習で得た制御ポリシーを能動と受動の寄与に分解し、受動部分を並列弾性関節にオフロードすることでエネルギー効率を向上させる手法を提案した。シミュレーションの四足歩行で最大95%の機械的パワーを受動ダイナミクスに移行できることを示した。
原題: Physical Imitation Learning: Distilling Control Policies into Passive Elasticity / Huyue Ma, Yurui Jin, Helmut Hauser 他
日本語で読む → - 論文跳躍/協調設計ロボティクス
アクチュエータ最適化を伴う五節単脚ロボットの高性能跳躍のための協調設計フレームワーク
五節閉リンク単脚ロボットの跳躍性能を最大化するため、機構設計・モータ/ギアボックスパラメータ・制御パラメータを同時最適化する協調設計フレームワークを提案し、シミュレーションで跳躍距離30.4%向上と消費エネルギー11.5%削減を実証した。
原題: A Co-Design Framework for High-Performance Jumping of a Five-Bar Monoped with Actuator Optimization / Aastha Mishra, Aman Singh, Shishir Kolathaya
日本語で読む → - 論文ナビゲーション制御
到達可能集合を用いたニューラル放射場による安全ナビゲーション
ロボットの安全な経路計画のために、障害物の体積表現をNeRFで計算し、到達可能集合と制約付き最適制御を用いて安全な経路を生成する手法を提案した。
原題: Safe Navigation using Neural Radiance Fields via Reachable Sets / Omanshu Thapliyal, Malarvizhi Sankaranarayanasamy, Ravigopal Vennelakanti
日本語で読む → - 論文HRI/ヘルスケアロボティクス
思いやりのある人とロボットの共存に向けて:ヘルスケアにおけるロボット設計と人間の知覚の二重空間フレームワーク
ヘルスケアロボットの14週間の共設計研究の追跡インタビューから、人間の知覚空間(分解度、証拠源、推論範囲、時間的指向)を特定し、ロボット設計空間との共進化的ループとしての共存モデルを提案した論文。
原題: Towards Considerate Human-Robot Coexistence: A Dual-Space Framework of Robot Design and Human Perception in Healthcare / Yuanchen Bai, Zijian Ding, Ruixiang Han 他
日本語で読む → - 論文物体検出/エッジAI/知識蒸留画像認識
エッジAIによる自動車の脆弱な道路利用者安全:知識蒸留による展開可能な検出
エッジハードウェア向けに、知識蒸留を用いて小型のYOLOv8-Sモデルを訓練し、INT8量子化でも精度を保つ脆弱な道路利用者(VRU)検出モデルを開発した。
原題: Edge AI for Automotive Vulnerable Road User Safety: Deployable Detection via Knowledge Distillation / Akshay Karjol, Darrin M. Hanna
日本語で読む → - 論文シミュレーションロボティクス
PhysCodeBench: 自己修正型マルチエージェントによる3Dシーンの物理認識シンボリックシミュレーションのベンチマーク
物理現象の自然言語記述を実行可能なシミュレーション環境に変換する能力を評価する初のベンチマークを構築し、専門エージェントが協調して物理的に正確なシミュレーションを生成する自己修正型マルチエージェントフレームワークを提案した。
原題: PhysCodeBench: Benchmarking Physics-Aware Symbolic Simulation of 3D Scenes via Self-Corrective Multi-Agent Refinement / Tianyidan Xie, Peiyu Wang, Yuyi Qian 他
日本語で読む → - 論文AIガバナンスcs.CY
象徴的制御を超えて:AIによる労働力置換の社会的帰結と真の人間監視アーキテクチャの必要性
AIによる労働力置換が経済・心理・政治など多領域に及ぼす影響を分析し、名目的な人間監視と実質的な人間監視の乖離がAIガバナンスの主要な欠陥であると指摘。真の人間監視のための5つの設計要件を提案する。
原題: Beyond Symbolic Control: Societal Consequences of AI-Driven Workforce Displacement and the Imperative for Genuine Human Oversight Architectures / Richard J. Mitchell
日本語で読む → - 論文VLA/操作ロボティクス
AnchorRefine: 軌道アンカーと残差補正に基づく協調操作のためのVLAモデル
VLAモデルの動作生成を大域的な軌道計画と局所的な微細補正に分解する階層フレームワークを提案し、シミュレーションと実機で成功率を向上させた。
原題: AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models / Tingzheng Jia, Kan Guo, Lanping Qian 他
日本語で読む → - 論文安全フィルタロボティクス
バックアップ型安全フィルタの比較レビュー:Backup CBF、Model Predictive Shielding、ゲートキーパーの統一的視点
バックアップ型安全フィルタの3手法(Backup CBF、MPS、ゲートキーパー)を共通の枠組みで比較し、理論的関係と保守性の原因を明らかにしたチュートリアル的レビュー論文。
原題: Backup-Based Safety Filters: A Comparative Review of Backup CBF, Model Predictive Shielding, and gatekeeper / Taekyung Kim, Aswin D. Menon, Akshunn Trivedi 他
日本語で読む → - 論文材料識別eess.SP
VLMaterial: 視覚言語モデルに基づくカメラとレーダーの融合による物理的根拠を持つ材料識別
視覚言語モデルとレーダーの物理知識を融合し、ガラスやプラスチックなどの材料を高精度に識別するトレーニング不要のフレームワークを提案した。
原題: VLMaterial: Vision-Language Model-Based Camera-Radar Fusion for Physics-Grounded Material Identification / Jiangyou Zhu, He Chen
日本語で読む → - 論文自動運転/ワールドモデル画像認識
インフラ中心のワールドモデル:路側知覚における時間的深さと空間的広がりの橋渡し
自動運転のワールドモデルを、車両視点ではなく路側インフラ視点で構築する新たなパラダイムを提案し、その利点とアーキテクチャを論じた論文。
原題: Infrastructure-Centric World Models: Bridging Temporal Depth and Spatial Breadth for Roadside Perception / Siyuan Meng, Chengbo Ai
日本語で読む → - 論文ナビゲーションロボティクス
ハミルトン・ヤコビ到達可能性に基づく探索フレームワークによる屋内平面ロボットの効率的かつ安全なナビゲーション
オフラインのHJ到達可能性計算をオンラインのグラフ探索に組み合わせ、動的環境でも効率的かつ安全なナビゲーションを実現する手法を提案した。
原題: A Hamilton-Jacobi Reachability-Guided Search Framework for Efficient and Safe Indoor Planar Robot Navigation / Hanyang Hu, Cameron Siu, Mo Chen
日本語で読む → - 論文群制御ロボティクス
軌道上宇宙AI:衛星コンステレーションのための連合・マルチエージェント・協調アルゴリズム
衛星コンステレーションの自律運用に向けたAI研究を、連合学習・マルチエージェント・協調センシングの3つのパラダイムで体系的に整理したサーベイ論文。
原題: On-Orbit Space AI: Federated, Multi-Agent, and Collaborative Algorithms for Satellite Constellations / Ziyang Wang
日本語で読む → - 論文運転注意予測画像認識
シーンから物体へ:テキスト誘導による二重視線予測
運転者の物体レベルの注意予測を実現するため、データ構築からモデル設計までの新しい枠組みを提案し、マルチモーダル大規模言語モデルとSAM3を用いて物体レベルの視線データセットを構築し、デュアルブランチの視線予測モデルを開発した。
原題: From Scene to Object: Text-Guided Dual-Gaze Prediction / Zehong Ke, Yanbo Jiang, Jinhao Li 他
日本語で読む → - 論文群制御ロボティクス
群れの中の温かさと能力:効果的な人間ロボットチームの設計
群ロボットの行動が人間の社会的知覚(温かさと能力)に与える影響を2つの研究で調査し、タスク性能よりも社会的知覚がチーム選好を強く予測することを示した。
原題: Warmth and Competence in the Swarm: Designing Effective Human-Robot Teams / Genki Miyauchi, Roderich Groß, Chaona Chen
日本語で読む → - 論文マニピュレーションロボティクス
視覚-触覚を用いたペグ穴挿入の学習:ペグ引き抜き動作からの転移
ペグ穴挿入作業を、より簡単な逆タスクであるペグ引き抜き動作の学習を利用して効率的に学習するフレームワークを提案。視覚と触覚の情報を統合し、成功率を向上させた。
原題: Visual-Tactile Peg-in-Hole Assembly Learning from Peg-out-of-Hole Disassembly / Yongqiang Zhao, Xuyang Zhang, Zhuo Chen 他
日本語で読む →