論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/推論高速化ロボティクス
WA-SpecDec: 世界認識型投機的デコーディングによる視覚言語行動モデルの高速化
視覚言語行動モデルの推論を高速化するため、世界モデル由来の物理シーン認識を投機的デコードに組み込み、接触近傍での誤りを減らしつつ成功率を維持する手法を提案した。
原題: WA-SpecDec: World-Aware Speculative Decoding for Vision-Language-Action Models / Zikang Wen, Yuning Zhang, Dong Yuan
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルは自己受容状態をどう使うべきか
VLAモデルにおけるロボットの自己受容状態の入力方法(テキスト、プレフィックス、直接入力など)と履歴長が性能に与える影響を、制御実験で体系的に比較し、設計原則を導出した論文。
原題: How Should Vision-Language-Action Models Use Proprioceptive State? / Yiren Zhao, Ziyang Chen, Ziyang Rao 他
日本語で読む → - 論文自動運転ロボティクス
PRISM: 特権的確率的潜在監督によるエンドツーエンド自動運転の運動計画
エンドツーエンド自動運転モデルの中間潜在表現を、将来のグラウンドトゥルース経路で確率的に監督するフレームワークを提案し、計画精度と衝突率を改善した。
原題: PRISM: Privileged Probabilistic Latent Supervision for End-to-End Autonomous Driving Motion Planning / Volodymyr Havrylov, Faris Janjoš, Andreas Look 他
日本語で読む → - 論文ナビゲーションロボティクス
SAIN: 能動的対話による構造認識型インタラクティブナビゲーション
曖昧な指示に対して能動的質問で解消する移動ロボットのナビゲーション手法を提案。対話の回答を永続的な空間・物体記憶に変換し、ゼロショットで目標探索を実現。
原題: SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot / Yuhao Cao, Xiao Liu, Yang Xie 他
日本語で読む → - 論文VLAロボティクス
VANE: 将来の視覚表現予測による視覚-言語-行動モデルの信頼性の高いテスト時訓練
VLAポリシーのテスト時訓練を信頼性高く行うため、現在の文脈に基づいて適応を条件付け、実行した行動の将来の視覚的結果から学習し、将来の証拠に基づいて更新を選択的かつ可逆的に行うフレームワークを提案した。
原題: VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction / Hongjin Ji, Guoyang Xia, Luoyang Sun 他
日本語で読む → - 論文視覚的注意/ロボット学習ロボティクス
行動から注意を学ぶ:ポリシー学習のための創発的視覚ボトルネック
行動教師信号のみから注目領域(ROI)を学習するSeekerを提案し、RGBクロップやマスク拡張、点群フィルタリングの空間インターフェースとして利用。実機で成功率を大幅に向上させた。
原題: Attention from Action, for Action: Emergent Visual Bottlenecks for Policy Learning / Zheyu Zhuang, Ruiyu Wang, Nick Heppert 他
日本語で読む → - 論文ナビゲーションロボティクス
CrossTracer: VLAモデルの推論とトレース残差適応によるクロスエンボディメントナビゲーション
ロボットの種類に応じた移動制約を考慮したナビゲーション経路を生成するため、VLAモデルと適応的残差補正を組み合わせた階層的フレームワークを提案した。
原題: CrossTracer: Cross-Embodiment Navigation via VLA Model Reasoning and Trace Residuals Adapting / Yao Wang, Siyuan Wang, Zhirui Sun 他
日本語で読む → - 論文モデル予測制御math.OC
並列シナリオツリーMPCのためのレーキ・コンプレスRiccati再帰
シナリオツリー型モデル予測制御の求解を、レーキ・コンプレス法による木縮約で並列化し、O(log N)のスパンで正確に解く新しいアルゴリズムを提案した。
原題: Rake-Compress Riccati Recursions for Parallel Scenario-Tree Model Predictive Control / João Sousa-Pinto
日本語で読む → - 論文VLA/世界モデルロボティクス
JEPA-WAM: 共同埋め込み世界モデリングによる視覚-言語-行動ポリシーの学習
事前学習済みV-JEPA空間に基づく潜在世界モデルを構築し、遷移予測と行動生成を共有予測器で結合することで、効率的かつ高精度なロボット制御を実現した。
原題: JEPA-WAM: Learning Vision-Language-Action Policies with Joint-Embedding World Modeling / Yihan Lin, Jiawei He, Shifeng Bao 他
日本語で読む → - 論文群制御ロボティクス
不確実な自然を飛び越えて(FORTUNE):低空協調のための知的で人間中心の3D経路計画
都市環境での低空UAV協調センシングのため、不確実な地上関心点需要と社会的・環境的コストを考慮した3D経路計画とタスク割り当てを、階層的オフライン・オンラインフレームワークで解く手法を提案した。
原題: Flying over The Uncertain Nature (FORTUNE): Intelligent and Humanistic 3D Path Planning for Low-Altitude Collaboration / Minghui Liwang, Wenhan Jia, Xinlei Yi 他
日本語で読む → - 論文手の動き表現/トークン化ロボティクス
DigitCode: 解剖学的単位による手の動きのシンボリックトークン化
手の動きを連続値ではなく解剖学的単位(骨、指、手全体)に基づく離散シンボルで表現する手法を提案し、量子化誤差を大幅に削減。指単位のトークンが生成された手の修正やロボットへのリターゲティングに有効であることを示した。
原題: DigitCode: Symbolic Tokenization of Hand Motion by Anatomical Units / Haoyu Gu, Haotian Lu, Jingrun Du 他
日本語で読む → - 論文ナビゲーションAI
CoNav-UAV: スタッケルベルグ学習による協調的二重高度空中ナビゲーション
高高度と低高度の2台のUAVをスタッケルベルグゲームとして協調させ、視覚と言語のみで目標探索と接近を行う空中ナビゲーション手法を提案した。
原題: CoNav-UAV: Cooperative Dual-Altitude Aerial Navigation via Stackelberg Learning / Junru Song, Wenhao Zhang, Yang Yang 他
日本語で読む → - 論文ドローンロボティクス
環境アンカリングによる安定接触作業のためのグリッパ付きティルトローターUAV
環境にアンカリングして安定した作業プラットフォームに変身する、グリッパ付きティルトローターUAVを提案・試作し、実機飛行試験で位置ドリフトを95%以上削減できることを実証した。
原題: A Tilt-Rotor UAV with a Gripper for Stable Contact-Based Tasks via Environmental Anchoring / Joshua Taylor, Nursultan Imanberdiyev, Wei-Yun Yau 他
日本語で読む → - 論文群制御cs.MA
段階的更新による大規模長期計画:生涯MAPFのためのスケーラブルな手法
生涯マルチエージェント経路探索(LMAPF)において、数千エージェントを1秒未満で調整しつつ、複数ステップ先を見据えた計画を可能にする新しいプランナーPUSHを提案した。PIBT、RHCR、TPの利点を組み合わせ、一般のマップでスケーラブルな長期計画を実現する。
原題: Scalable Long-Horizon Planning with Staggered Updates for Lifelong MAPF / Vaibhav Sanjay, Jiaoyang Li
日本語で読む → - 論文物体検出画像認識
形状を考慮した回転バウンディングボックス(OBB)から水平バウンディングボックス(HBB)への変換
航空・衛星画像における船舶検出のため、回転バウンディングボックス(OBB)を水平バウンディングボックス(HBB)に変換する際に、船体の形状や充填度を考慮してより密着したHBBを生成する新しい手法を提案した。
原題: Shape-Aware Oriented Bounding Box (OBB) to Horizontal Bounding Box (HBB) Conversion / Badha Rathna Sabhapathy, Gotam Dahiya, Vishesh Vatsal
日本語で読む → - 論文状態推定ロボティクス
状態推定器が迷走したとき:スペクトル解析による推定器故障の検出
速度推定値の周波数領域パワー分布を解析することで、状態推定器の故障をセンサ非依存で検出する手法を提案。実飛行データで3種類のオドメトリの故障を51-58%の検出率で捉えた。
原題: When Your State Estimator Has Lost The Plot: Detecting Estimator Failures Via Spectral Analysis / Christian Lanegger, Helen Oleynikova, Roland Siegwart 他
日本語で読む → - 論文群制御ロボティクス
強化学習によるタスク指向のフォーメーション決定:攻撃群の追い込み
複数ロボットが攻撃群を追い込むタスクにおいて、フォーメーション形状を低次元パラメータで表現し、強化学習でそのパラメータを最適化することで、機動性の不利を補いながら未知の攻撃戦略に対応する手法を提案した。
原題: Task-Oriented Formation Decision via Reinforcement Learning: Herding an Attacking Swarm / Zhaozong Wang, Guibin Sun, Jinyong Chen 他
日本語で読む → - 論文空中ロボット/音響知覚ロボティクス
身体化された受動空力音響知覚による空中ロボット間の相対センシングと追跡
飛行音を利用して、GPSや通信を使わずにドローンが他のドローンを追跡する受動的な音響知覚フレームワーク「SonicFly」を提案し、屋外実験で有効性を実証した。
原題: Embodied Passive Aeroacoustic Perception Enables Relative Sensing and Pursuit Between Aerial Robots / Yanbaihui Liu, Ravi Prakash, Li-Yu Lo 他
日本語で読む → - 論文物体検出ロボティクス
自動車レーダーにおけるマイクロドップラー特徴を用いた衝突前物体検出のためのアンカーベースAIアプローチ
自動車レーダーの高解像度データとマイクロドップラー特徴を活用し、アンカーベースのAIモデルで衝突前の物体検出精度を向上させる手法を提案した。
原題: Anchor-Based AI Approach for Pre-Crash Object Detection Utilizing Micro-Doppler Signatures in Automotive Radar / Patrick Zaumseil, Rainer Engert, Dagmar Steinhauser 他
日本語で読む → - 論文ロボットポリシー評価ロボティクス
XPolicyLab: ロボットポリシー評価と展開のための統一標準・オープンエコシステム
ロボットポリシーの評価と展開を統一する標準規格とオープンエコシステムを提案し、N個のポリシーとM個の環境の接続コストをO(NM)からO(N+M)に削減した。
原題: XPolicyLab: A Unified Standard and Open Ecosystem for Robot Policy Evaluation and Deployment / XPolicyLab Community, Tianxing Chen, Yue Chen 他
日本語で読む → - 論文VLAロボティクス
視覚言語行動モデルにおける位置依存の盲点の発見と緩和
視覚言語行動モデルが作業空間内の特定領域で失敗しやすい「位置盲点」を発見し、その領域のデモデータで微調整することで性能を改善する手法を提案した。
原題: Uncovering and Mitigating Positional Blind Spots in Vision-Language-Action Models / Dongdong An, Pengjie Zhao, Yihao Huang 他
日本語で読む → - 論文シミュレーション評価ロボティクス
WorldSimProbe: 身体的操作のための行動条件付きワールドモデルにおけるシミュレータ忠実度の診断
行動条件付きワールドモデル(ACWM)が物理シミュレータとして忠実に機能するかを検証するための評価手法「WorldSimProbe」を提案し、複数のベンチマークで既存モデルの欠陥を明らかにした。
原題: WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for Embodied Manipulation / Peterson Co, Sicheng Hu, Chunxuan Jiao 他
日本語で読む → - 論文マニピュレーションロボティクス
フラットな方策を超えて:ロボット操作における身体化エージェントのための階層的事後学習
VLAモデルの事後学習を階層化し、高レベルのタスク計画と低レベルの行動実行を分離するフレームワークHiRoCを提案。強化学習と分布整合により長期的な操作性能を向上させる。
原題: Beyond Flat Policies: Hierarchical Post-Training for Embodied Agents in Robotic Manipulation / He Kong, Zengjue Chen, Qi Wang 他
日本語で読む → - 論文マルチエージェント協調ロボティクス
SyncPlan: 明示的同期と適応的修正による長期的LLM協調
LLMベースのマルチエージェント協調において、効率と適応性のトレードオフを解決するため、明示的な同期プリミティブとプラン陳腐化検出器を備えた計画・実行・修正フレームワークを提案した。
原題: SyncPlan: Long-Horizon LLM Coordination with Explicit Synchronization and Adaptive Correction / Shen You, Xiaoming Zhu, Weining Weng 他
日本語で読む → - 論文検証・テストcs.SE
JTA: 安全重要ソフトウェアのシナリオベース検証のための共同テスタビリティアーキテクチャ
本論文は、安全重要ソフトウェアの検証能力を、シナリオ・テストシステム・被試験システムの3要素を統合的に分析・設計するためのアーキテクチャ「JTA」を提案し、ArduPilotのフェイルセーフ検証への適用例を示している。
原題: JTA: Joint Testability Architecture for Scenario-Based Validation of Safety-Critical Software / Wenyao Xue, Jiandi Wang, Yichen Wang
日本語で読む → - 論文支援技術/ヒューマンインターフェースHCI
bFaaaP: 頭部角度でペダル操作を実現する包括的ピアノ演奏支援 -- 足を使わずにアコースティック/電子ピアノで奏者の意図を定量的に再現
足が使えない演奏者向けに、頭部の角度でサステインペダルを操作できる装置を開発。スマートフォンのAR顔追跡とBLE通信でペダルを制御し、定量的な制御則により自然な表現を実現した。
原題: bFaaaP: An Inclusive, Head-Angle Piano-Pedal Interaction that Quantitatively Reproduces a Pianist's Intended Pedalling -- Foot-Free, for Acoustic and Electronic Pianos / Tomoyuki Shishido, Masahiro Ootaki, Hiroyuki Narusawa
日本語で読む → - 論文触覚機械学習
Tactus: 低コスト圧力アレイからのオープンボキャブラリ物体認識
低コストの抵抗式圧力センサのみを用いて、テキストクエリに基づく物体認識を実現するモデルTactusを提案。少量データとマスク付きオートエンコーダ事前学習で、教師ありCNNと同等以上の精度を達成した。
原題: Tactus: Open-Vocabulary Object Recognition from Low-Cost Pressure Arrays / Abdul Basit Tonmoy
日本語で読む → - 論文器用操作ロボティクス
C2Dex: 単眼ビデオからの接触整合的な器用操作の再構築とリターゲティング
単眼ビデオから器用なロボット操作のデモを転送する際、接触の安定性と物理的妥当性を保つフレームワークC2Dexを提案。物体側の安定接触を共有表現として、軌道の再構築と異なる手の形態へのリターゲティングを改善し、シミュレーションと実機で高い成功率を達成した。
原題: C2Dex: Contact-Consistent Reconstruction and Retargeting for Dexterous Manipulation from Monocular Video / Jie Ren, Zhehao Jiang, Yinhong Yang 他
日本語で読む → - 論文システムズエンジニアリングロボティクス
SysML駆動の自律UAV設計のためのモデルベースシステムズエンジニアリングフレームワーク
自律UAVの開発をSysMLで構造化し、要件から論理アーキテクチャ、ROS 2ソフトウェア実装までを体系的にマッピングするMBSEフレームワークを提案した論文。
原題: Model-Based Systems Engineering Framework for SysML-Driven Design of Autonomous UAVs / Deekshitha Angadi, Naveena Budda, Vikas Agarwal 他
日本語で読む → - 論文自動運転ロボティクス
ニューロシンボリック安全ガードによるエンドツーエンド自動運転の群れ制御
学習済みのエンドツーエンド運転エージェントに、明示的な安全ルールでコマンドを検証・修正する軽量モジュールを追加し、安全違反を減らす手法を提案した。
原題: Herding End-to-End Autonomous Driving via Neuro-Symbolic Safety Guards / Simón Patiño Idarraga, Erick Silva, Rehana Yasmin 他
日本語で読む →