論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/18 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文モジュラーロボット/再構成計画ロボティクス
変形可能な平面モジュラーロボットのための再構成完全な動作プリミティブと構成的計画
変形可能なモジュラーロボットの再構成計画を、正方形セル抽象化と2つの基本動作(ピボットとシア)を用いて解析し、任意の非直線エッジ接続構成を固定の標準階段形状に変換可能であることを証明し、構成的な計画手法を提案した。
原題: Reconfiguration-Complete Motion Primitives with Constructive Planning for Deformable Planar Modular Robots / Jie Gu, Tingting Wang, Hongrun Gao 他
日本語で読む → - 論文VLAロボティクス
Prism-GRPO: 同一結果グループの分割による高速なVLAポリシー最適化
GRPOの強化学習において、成功/失敗が同一のグループを品質スコアで分割し、学習信号を回復することでロールアウト効率を向上させる手法を提案した。
原題: Prism-GRPO: Faster VLA Policy Optimization via Splitting Same-outcome Groups / Zeyun Deng, Yuzhe Lu, Yawei Wang 他
日本語で読む → - 論文群制御ロボティクス
VLM-LLM推論と到達可能性解析による安全なマルチロボット協調
視覚付き四足歩行ロボットとカメラなし車両の異種チームで、VLMが環境を意味解釈しLLMがタスクを割り当て、ゾノトープ到達可能性ゲートで安全性を検証して協調ナビゲーションを実現する。
原題: Safe Multi-Robot Coordination via VLM-LLM Reasoning and Reachability Analysis / Mohamed Dwedar, Ahmad Hafez, Alexander Jesser 他
日本語で読む → - 論文模倣学習ロボティクス
MatchingPolicy: 対応関係を考慮したポリシーによる物体横断的な文脈内学習の実現
デモとシーンの対応関係を明示的に分離し、密な意味的対応に基づいてロボットの動作を条件付ける拡散ポリシーを導入。未見の物体やカテゴリへの汎化性能を向上させた。
原題: MatchingPolicy: Correspondence-Aware Policy Enables Cross-Object In-Context Learning / Qijin She, Hanyang Yu, Zeming Li 他
日本語で読む → - 論文顔認識/解釈可能性画像認識
SCOUT: 顔認識テンプレートのオープンボキャブラリ編集のための意味概念発見
顔認識テンプレート内の意味概念を直接発見・操作するフレームワークを提案し、自然言語記述から潜在特徴の意味仮説を生成して安定性を検証することで、編集可能な意味方向を獲得する。
原題: SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates / Leon Todorov, Peter Rot, Peter Peer 他
日本語で読む → - 論文センサ融合ロボティクス
サイクロプス:色を夢見るカメラとしてのLiDAR
低照度や高ダイナミックレンジ環境で劣化するカメラの代わりに、照明に依存しないLiDAR強度をRGBビデオに変換するフレームワーク「Cyclops」を提案し、カメラなしで終日認識タスクを可能にする。
原題: Cyclops: LiDAR as a Camera That Dreams in Color / Wei Gao, Jian Shu, Mingle Zhao 他
日本語で読む → - 論文ナビゲーションロボティクス
実世界動画からのスケーラブル学習による都市ナビゲーションのロングテール顕在化
ウェブ上の未編集な一人称視点動画からメトリック軌跡とナビゲーション意味情報を自動アノテーションし、視覚言語行動ポリシーを訓練して都市ナビゲーションのロングテールな稀なシナリオを体系的に明らかにする枠組みを提案した。
原題: Exposing the Long-tail in Embodied Urban Navigation via Scalable Learning from In-the-Wild Videos / Bingyi Xia, Han Bao, Zhewei Chen 他
日本語で読む → - 論文世界モデル/計画機械学習
SCALE: 正しい幾何学におけるJEPA計画のための状態校正潜在埋め込み
エンドツーエンドの世界モデルLeWMの潜在表現に、タスク関連状態空間との距離整合性を持たせることで、計画性能を向上させる手法SCALEを提案した。
原題: SCALE: State-Calibrated Latent Embeddings for JEPA Planning in the Right Geometry / Jiaming Hu, Yan Zheng, Tian Wang
日本語で読む → - 論文侵入検知cs.CR
車両パワートレインCANバスシステム向けデジタルツイン型侵入検知
CANバスのペイロード改ざん攻撃を検知するため、デジタルツインで車両の物理関係を学習し、予測と実測の残差から攻撃を検出する手法を提案した。実データで評価し、従来手法より高い検出率を達成した。
原題: Digital Twin-Based Intrusion Detection for Vehicle Powertrain CAN Bus Systems / Araf Rahman, M Sabbir Salek, Mashrur Chowdhury
日本語で読む → - 論文VLA/操作ロボティクス
SparkVLA: 長期的操作のための適応アクションチャンクを備えた停止認識型階層VLA
階層型VLAシステムにおけるサブタスクの停止タイミングとアクションチャンク長の相互依存関係を単一のランキング問題として定式化し、統一候補セットから最適解を選択する新しい手法を提案した。
原題: SparkVLA: Stop-Aware Hierarchical VLA with Adaptive Action Chunking for Long-Horizon Manipulation / Xunyao Lei, Renjun Wu, Tianlin Huo 他
日本語で読む → - 論文群制御ロボティクス
プランナー条件付き拡散による協調マルチエージェント探索
複数のプランナーのデモから学習し、プランナーIDを条件として与えることで多様な軌道を生成できる拡散ポリシーを提案。局所的な再ランキングでエージェント間の重複を減らし、協調探索を実現した。
原題: Planner-Conditioned Diffusion for Coordinated Multi-Agent Exploration / Marcus Yu Siong Teo, Jeric Lew, Tanishq Duhan 他
日本語で読む → - 論文強化学習機械学習
世界モデルを用いたQ学習
Q学習に世界モデルを組み合わせ、実データのみで学習しつつ想像上の軌道で探索を行うことで、サンプル効率と性能を向上させる手法を提案した。
原題: Q-Learning With World Models / Perry Dong, Yueru Jia, Chelsea Finn 他
日本語で読む → - 論文マニピュレーションロボティクス
BATONを落とすな:エージェント的サブタスク探索と遷移認識メモリによる長期的ロボット操作
長期的なロボット操作タスクを、VLAモデルを凍結しLLMエージェントがサブタスク単位で探索・記憶することで、コストを加算的にし、遷移条件を明示して失敗を単一ステージに帰属させる手法BATONを提案。
原題: Don't Drop the BATON: Long-Horizon Robot Manipulation via Agentic Subtask Exploration and Transition-aware Memory / Bingxin Xu, Yuzhang Shang, Emilio Ferrara
日本語で読む → - 論文地理的定位画像認識
X$^2$Localizer: プログレッシブなクロスビュー動画地理的定位のためのクロス粒度アライメント
本論文は、地上視点の動画を対応する航空画像に位置づけるクロスビュー動画地理的定位(CVG)を、部分的な観測や動的な時間予算に対応できるプログレッシブな設定(PCVG)に拡張し、新しいフレームワークX$^2$Localizerを提案する。
原題: X$^2$Localizer: Cross-grained Alignment for Progressive Cross-view Video Geo-localization / Zichao Zeng, Weijia Fan, Yufan Chen 他
日本語で読む → - 論文LLM評価ロボティクス
監視・警備ロボット向けアイデンティティ依存LLM出力のベンチマーキング
LLMが生成する監視・警備ロボットの設計記述が、人口統計学的アイデンティティのラベルによって読みやすさに系統的な差が出るかを評価した論文。
原題: Benchmarking Identity-Sensitive LLM Outputs for Surveillance and Security Robots / Nneka Hyman, Jasmine Khan, Raj Korpan
日本語で読む → - 論文ハンド制御ロボティクス
H-PACハンド:劣駆動ロボットハンドの制御指向モデリングと腱弾性補償
腱駆動の劣駆動ハンドにおける腱伸びによる関節誤差を補償する制御手法を提案し、6アクチュエータ・15自由度のハンドで精度を大幅に改善した。
原題: H-PAC Hand: Control-Oriented Modeling and Tendon-Elasticity Compensation for an Underactuated Robotic Hand / Teng Yan, Jiongxu Chen, Teng Wang 他
日本語で読む → - 論文水中追跡制御
移動地平線推定によるTDoA計測を用いた水中ターゲット追跡
水中ターゲット追跡のためのTDoA計測に基づく移動地平線推定(MHE)手法を提案し、シミュレーションでEKFより頑健な追跡性能を示した。
原題: Moving Horizon Estimation for Underwater Target Tracking Based on Time-Difference-of-Arrival Measurements / Anton Tolstonogov, David Cabecinhas, Pedro Batista 他
日本語で読む → - 論文操作計画ロボティクス
PDDL-ART: デモンストレーションからの自律的シンボリック抽象化による長期的ロボット操作のための視覚言語モデル
本論文は、単一の専門家デモと自然言語タスク記述からPDDLドメインと問題記述を自動生成するVLMベースのフレームワークPDDL-ARTを提案する。構文・意味・実行レベルの多段階補正パイプラインと、幾何・時間推論のためのツール使用を導入し、長期的操作タスクで有効性を示した。
原題: PDDL-ART: Autonomous Symbolic Abstraction From Demonstration For Long-Horizon Robotic Manipulation Using Vision-Language Models / Disha Kamale, Dmitry Berenson
日本語で読む → - 論文模倣学習ロボティクス
SurgVIL: オープンソース手術動画による手術ロボット模倣学習の大規模化
手術ロボットの模倣学習において、実組織の動画データから弱い教師信号として運動学を推定し、ファントムデータと組み合わせて学習することで、実組織や分布外環境への汎化性能を向上させるフレームワークを提案した。
原題: SurgVIL: Scaling Surgical Robot Imitation Learning with Open-source Surgical Videos / Xinhao Chen, JuoTung Chen, Nigel Nelson 他
日本語で読む → - 論文制御/マルチロータロボティクス
レディネス障壁関数:過アクチュエーションマルチロータ配分の前方不変制御権限
過アクチュエーションマルチロータの配分問題で、制御権限を前方不変量として扱い、制御障壁関数を用いてトルクレベルで制約を課すことで、連続性と権限保証を両立する手法を提案した。
原題: Readiness Barrier Functions: Forward-Invariant Control Authority for Overactuated Multirotor Allocation / Giuseppe Silano
日本語で読む → - 論文経路計画ロボティクス
DEMデータ統合によるUGV自律航法のための地形認識型ローカル経路計画
低解像度のDEMデータとリアルタイムLiDARセンサを統合し、グローバル経路とローカル適応を組み合わせたUGVの経路計画フレームワークを提案。シミュレーションで障害物回避率95%と平均斜面角度の低減を達成した。
原題: Terrain-Aware Local Path Planning with Global DEM Data Integration for Autonomous UGV Navigation / Devender Singh, Issah Nazif Suleiman, Paul Mitten 他
日本語で読む → - 論文歩行AI
不整地での脚式移動のための軌跡レベル自動カリキュラム学習
不整地での脚式移動ポリシー学習において、地形マップから直接タスクを生成する軌跡レベルの自動カリキュラム学習フレームワークを提案し、成功率を大幅に向上させた。
原題: Trajectory-Level Automatic Curriculum Learning for Legged Locomotion on Unstructured Terrain / Rocky Liu, Tengyu Liu, Baoxiong Jia 他
日本語で読む → - 論文群制御ロボティクス
採餌ロボット群のための適応的反発フェロモンクラスタリング
ロボット群の採餌効率を高めるため、探索済み領域に反発フェロモンを配置して未探索領域へ誘導する適応的反発フェロモンクラスタリング(ARPC)を提案し、シミュレーションで既存手法より優れた性能を示した。
原題: Adaptive Repulsive Pheromone Clustering for Foraging Robot Swarms / Carlos Pena-Caballero, Constantine Tarawneh, Qi Lu
日本語で読む → - 論文自動運転/倫理/強化学習機械学習
倫理的判断ヘッド:人間のフィードバックからの強化学習による自動運転車の規範倫理の実装
自動運転車の倫理的判断を強化学習で実装するフレームワークを提案し、功利主義とカント主義の二つの規範を評価した。人間の好みに基づく報酬モデルを用いて訓練し、倫理フレームワークの学習可能性の非対称性を明らかにした。
原題: The Ethical Decision Head: Operationalizing Normative Ethics in Autonomous Vehicles via Reinforcement Learning from Human Feedback / Thomas Mbrice, Ammar Ali, Sami Mian 他
日本語で読む → - 論文軌道上ナビゲーションロボティクス
軌道プランナー:衛星エージェントの軌道上障害物回避のための潜在世界モデル
軌道上の衛星ナビゲーション向けに、潜在空間で将来状態を予測する2段階の世界モデルを提案し、物理状態を復元するプローブを導入。シミュレーションで91.7%の成功率を達成。
原題: Orbit-Planner: Towards Latent World Models for On-Orbit Obstacle Avoidance of Satellite Agents / Zhijian Li, Chao Ren, Peijin Wang 他
日本語で読む → - 論文リハビリテーションロボティクスロボティクス
ロボット支援上肢タスク特異的トレーニングのための可変的な理学療法士-患者間相互作用の学習
この論文は、タスク特異的トレーニング中の理学療法士と患者の相互作用を学習し、新しいタスクバリエーションで療法士のトルクを再現するフレームワークを提案しています。少数のデモンストレーションからタスクパラメータ化ガウス混合モデルを用いて個人化された相互作用を学習し、評価では従来手法と同等以上の性能を示しました。
原題: Learning Varying Physical Therapist-Patient Interactions for Robot-mediated Upper Limb Task-Specific Training / Jia Quan Loh, Vincent Crocher, Marlena Klaic 他
日本語で読む → - 論文強化学習/ベンチマークAI
クロノクックド:強化学習エージェントにおける暗黙の区間タイミングのベンチマーク
調理シナリオを通じて、強化学習エージェントの時間知覚能力を評価するベンチマークスイートを提案し、時間情報が明示されない環境での性能を検証する。
原題: Chronocooked: A Benchmark for Implicit Interval Timing in Reinforcement Learning Agents / Amrapali Pednekar, Alvaro Garrido-Perez, Yara Khaluf 他
日本語で読む → - 論文医療ロボティクスロボティクス
US-VLA: 腹部超音波検査のための視覚・言語・動作モデル
臨床的な意味目標を明示的に符号化し、リアルタイムの超音波フィードバックに基づいてプローブ操作を生成する超音波検査自動化のための視覚・言語・動作モデルを提案した。肝臓と腎臓の検査データセットを構築し、プローブ操作タスクでの有効性と汎化性を示した。
原題: US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina / Cheng Zhang, Xingzheng Wu, Guihao Yan 他
日本語で読む → - 論文マニピュレーションロボティクス
統一条件・行動モデリングによる高精度ワンステップ行動生成
条件と行動を共有トークン空間で統一的にモデリングするUCA-Flowを提案し、推論速度を大幅に向上させつつ成功率を9.3ポイント改善した。
原題: Unified Condition-Action Modeling for Accurate One-Step Action Generation / Xinyu Zhou, Zikun Cai, Kuangji Zuo 他
日本語で読む → - 論文動作計画ロボティクス
FlexWorm: 吸着式多セグメント変形ロボットのためのプリミティブ拡張ハイブリッド接触・動作計画
多セグメントの吸着式ソフトロボットが複雑な3D表面を移動するための計画フレームワークを提案し、離散的な吸着切替と連続的な変形を扱い、学習ベースのプリミティブ検索で計画時間を短縮する。
原題: FlexWorm: Primitive-augmented Hybrid Contact-motion Planning for Suction-based Multi-segment Deformable Robots / Zili Tang, Tiecheng Guo, Qinyue Zhang 他
日本語で読む →