論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/操作ロボティクス
手首から世界へ:微細ロボット操作のためのタスク条件付き未来手首モデリング
VLAモデルにおいて、主視点と手首視点を並列に扱うのではなく、タスク文脈に基づいて手首の未来の動きを予測する新しいモデルW2-VLAを提案。これにより、微細で接触を伴う操作の精度が向上し、80Hz以上の高速な行動生成を維持する。
原題: World-to-Wrist: Task-Conditioned Future Wrist Modeling for Fine-Grained Robot Manipulation / Yuhao Pan, Haosong Peng, Zhengshen Zhang 他
日本語で読む → - 論文触覚ロボティクス
古琴演奏のための触覚ロボット指の設計
人間の指先と爪の形状を模倣した高精度触覚センシング指を設計し、古琴の弦接触タスク(開放弦・按音比較、調和チューニング、触覚トリガーによる両手協調)で検証した。
原題: A Haptic Robot Finger Designed for Guqin Instrument Playing / Tianwei Zhang, Hanming Yan, Yang Yang. Ziya Wang
日本語で読む → - 論文模倣学習/介入ロボティクス
AutoIntervene: アクションチャンキング模倣学習ポリシーのための較正された介入
アクションチャンキング型の視覚運動ポリシーに対し、実行中にオペレータへの介入を選択的に行うオンラインフレームワークを提案。視覚・動作のサポートメモリと較正された閾値で介入タイミングを制御し、実機の双腕操作タスクで成功率向上と介入時間削減を実証した。
原題: AutoIntervene: Calibrated Intervention for Action-Chunking Imitation Learning Policies / Jinhe Tang, Weiming Zhi
日本語で読む → - 論文歩行ロボティクス
外骨格支援歩行における運動適応の主要な生体力学的特徴の特定
外骨格支援歩行時の生体力学的変数の時間的変化を分析し、適応が個人差が大きく段階的に進行することを明らかにした。
原題: Identifying the Key Biomechanical Features of Movement Adaptation during Exoskeleton-Assisted Locomotion / Peter Seungjune Lee, Katja Mombaur
日本語で読む → - 論文VLA/アフォーダンス/操作学習ロボティクス
VLAff: 視覚・言語・アフォーダンスモデルによる統合的な実行可能アフォーダンスの獲得
人間のビデオからロボット操作スキルを学習するため、物体中心の実行可能アフォーダンス(視覚・把持・軌道)を抽出し、大規模言語モデルベースの統一基盤モデルVLAffを提案。実ロボットへのゼロショット適用も実証。
原題: VLAff: Vision-Language-Affordance Model for Unified Actionable Affordances / Jihoon Oh, Kento Kawaharazuka, Kei Okada
日本語で読む → - 論文オドメトリ/状態推定ロボティクス
KILVO: ヒューマノイドロボットのための頑健なマルチモーダル適応を備えたキネマティクス・慣性・LiDAR・視覚オドメトリ
ヒューマノイドロボット向けに、関節エンコーダ、IMU、LiDAR、カメラを非同期・逐次ハイブリッド誤差状態反復カルマンフィルタで統合し、センサ故障に頑健なマルチモーダル適応を備えたオドメトリ手法を提案した。
原題: KILVO: Kinematic-Inertial-LiDAR-Visual Odometry with Robust Multimodal Adaptation for Humanoid Robots / Jixin Gao, Fucheng Liu, Teng Zhang 他
日本語で読む → - 論文触覚ロボティクス
高速視触覚認識のためのセンサ近傍コンピューティング
視触覚センサのデータ処理をセンサ近くのハードウェアパイプラインで行い、低消費電力・低遅延で高精度な接触形状復元を実現し、ロボットの保護反射ループを大幅に高速化した。
原題: Near-sensor Computing for Rapid Visuotactile Perception / Zhengying Zhu, Ruilin Zhang, Runze Hu 他
日本語で読む → - 論文VLA/クロス身体操作ロボティクス
DyPES-VLA: 共有ダイナミクス事前知識と身体固有制御の学習によるクロス身体操作
異なるロボット身体間で共有できるダイナミクス事前知識を学習し、身体固有の行動空間で直接制御を出力するVLAモデルを提案。シミュレーションと実機で最高性能を達成した。
原題: DyPES-VLA: Learning Shared Dynamics Priors and Embodiment-Specific Control for Cross-Embodiment Manipulation / Junfeng Li, Junjie He, Zhide Zhong 他
日本語で読む → - 論文人型ロボット制御ロボティクス
GenTrack: ロボット固有動作生成のための物理的整合とゼロショット人型追跡
テキストから生成された動作をロボットが実行可能な形に整合させ、追跡性能を向上させるオンライン生成器・追跡器の共学習フレームワークを提案した。
原題: GenTrack: Physical Alignment for Robot-Native Motion Generation and Zero-Shot Humanoid Tracking / Zeyu Ling, Xinyao Yu, Renye Yan 他
日本語で読む → - 論文UAV制御ロボティクス
バウンディングボックス幾何を用いたUAV目標追跡のための解釈可能なファジィ推論
YOLOのバウンディングボックスから抽出した低次元特徴を用いて、UAVのヨー角指令を生成する解釈可能なファジィ推論フレームワークを提案。幾何モデリングや大規模データセットを必要とせず、リソース制約のあるプラットフォームでも展開可能。
原題: Interpretable Fuzzy Inference for UAV Target Tracking Using Bounding-Box Geometry / Reza Ahmari, Ahmad Mohammadi, Vahid Hemmati 他
日本語で読む → - 論文VLA/故障検出ロボティクス
SAFECAST: コントラストセット学習とキャリブレーションによるVLAポリシーの堅牢な故障検出
VLAポリシーの展開時分布シフトによる失敗を検出するため、コントラストセット摂動を用いて隠れ状態プローブの訓練とキャリブレーションを改善する手法を提案。実世界とシミュレーションで故障検出のROC-AUCを向上させた。
原題: SAFECAST: Robust Failure Detection for VLA Policies with Contrast-Set Training and Calibration / Harshitha Rajaprakash, Aditeya Prajapati, Rong Xue 他
日本語で読む → - 論文運動生成ロボティクス
GASP: GPU加速によるリアルタイム衝突回避運動生成のための安全プランナー
GPU上で並列に動作する衝突回避型の関節空間運動生成プランナーを提案。Bスプラインとニューラルネットワークを組み合わせ、高速な推論と高い成功率を実現した。
原題: GASP: GPU-Accelerated Safe Planner for Real-Time Collision-Aware Motion Generation with Latent Trajectory Sampling / Colin Merk, Stefanos Charalambous, Peter Dürr 他
日本語で読む → - 論文セキュリティ/LLMロボットロボティクス
プロンプトがロボットを操る:マルチエージェントロボットシステムにおけるプロンプトインジェクション攻撃
LLMベースのマルチエージェントロボットシステムに対するプロンプトインジェクション攻撃を体系的に評価し、攻撃がタスク遂行を妨げつつ敵対的行動を誘発し、エージェント間で伝播することを示した。
原題: When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems / Neha Nagaraja, Amisha Bagari, Hayretdin Bahsi
日本語で読む → - 論文遠隔操作/触覚ロボティクス
意味的触覚フィードバックが器用なロボット遠隔操作を向上させる
ロボット遠隔操作において、抽象的な触覚パターンでロボット状態の重要情報を伝える「意味的触覚」を提案し、二腕タスクでの性能向上と作業負荷低減を実証した。
原題: Semantic Haptic Feedback Enhances Dexterous Robotic Teleoperation / Bingjian Huang, Sahar Aseeri, Jonas Schmidtler 他
日本語で読む → - 論文手術支援ロボティクス
ロボット支援低侵襲手術における禁止領域動的アクティブ制約
呼吸による組織変形に対応するエネルギー散逸型の禁止領域アクティブ制約戦略を提案し、深度カメラと細かいメッシュ表現を用いて安全性を維持しつつ高速に動作することを示した。
原題: Forbidden Region Dynamic Active Constraints in Robot-Assisted Minimally Invasive Surgery / Zejian Cui, Ferdinando Rodriguez y Baena
日本語で読む → - 論文3D物体検出ロボティクス
Mambaベースの知識蒸留による軽量3D物体検出
教師モデルから軽量な生徒モデルへ、Mambaを用いたボクセル特徴の選択的アライメントで知識を蒸留し、計算負荷を抑えつつ精度を維持する3D物体検出手法を提案した。
原題: Lightweight 3D Object Detection via Mamba-Based Knowledge Distillation / Quoc Cuong Ninh, Huy Xuan Pham, Anh Tung Nguyen 他
日本語で読む → - 論文軌道最適化ロボティクス
確率的マルチショット軌道最適化:逐次局所方策評価による手法
本論文は、短い制御シーケンスを局所フィードバック方策で接続する確率的マルチショット軌道最適化手法を提案し、サンプル効率と終端制約への収束性を向上させた。ブラックボックスダイナミクスにも適用可能で、カートポール振り上げやVTOL機の高迎角精密着陸などで有効性を示した。
原題: Stochastic Multiple Shooting Trajectory Optimization via Sequential Local Policy Evaluation / Ashwin Gupta, Joseph Moore
日本語で読む → - 論文手書き生成画像認識
微分可能な物理レンダリングによるオンライン・オフライン手書きの橋渡し
筆跡の軌跡と見た目を結ぶ物理ブラシモデルと微分可能レンダリングを導入し、オンラインとオフラインの手書き生成を統合するフレームワークを提案した。
原題: Bridging Online and Offline Handwriting via Differentiable Physical Rendering / Seonmi Park, Seunghyun Shin, Vihaan Misra 他
日本語で読む → - 論文歩行ロボティクス
PFM-HR: 人型ロボットのためのポーズフローマッチング
大規模な非順序ポーズデータから学習した再利用可能なフローマッチング事前分布を導入し、ポーズ幾何スコアを用いて追跡報酬を調整することで、人型ロボットの動的動作追跡性能を向上させた。
原題: PFM-HR: Pose Flow Matching for Humanoid Robots / Yukang Gao, Yi Gu, Yangchen Zhou 他
日本語で読む → - 論文安全フィルタロボティクス
汎用言語条件付き潜在安全フィルタに向けて
言語で指定された安全制約を満たすように、ハミルトン-ヤコビ安全アクターと批評家を条件付けする安全フィルタを提案し、ピックアンドプレースやテーブル拭きなどのタスクで制約違反を減らし、未見の制約への部分的な転移を示した。
原題: Towards General Language-Conditioned Latent Safety Filters / Ihab Tabbara, Yuxuan Yang, Hussein Sibai
日本語で読む → - 論文HRIロボティクス
表現力豊かなロボットヘッドを用いた適応的HRIのためのハイブリッド注意推定パイプライン
InMoovベースのロボットヘッドで、幾何学的注意推定と視覚言語モデルによる意味的注意推定を組み合わせ、状態機械で適応的な対話行動を制御するパイプラインを提案・評価した。
原題: Hybrid Attention Estimation Pipeline for Adaptive HRI Using an Expressive Robotic Head / Pablo Moraes, Monica Rodriguez, Christopher Peters 他
日本語で読む → - 論文知覚ルーティングロボティクス
センサ故障と計算リソース競合の連成を考慮した信念空間知覚ルーティング
ロボットの知覚処理において、センサ故障と計算負荷の競合を同時にモデル化し、デッドラインを守るように検出器の設定を選択するルーティング手法を提案した。
原題: Belief-Space Perception Routing under Coupled Sensor Faults and Compute Contention / Sparsh Roy, Vihan Aggarwal, Davin Yin
日本語で読む → - 論文ナビゲーションロボティクス
SSTG-Nav: 再利用可能な物体ナビゲーションのための計量基盤型空間意味トポロジカルグラフ
サービスロボットが同じ環境で長期間運用される際、事前の探索情報を再利用可能な意味メモリとして構築し、物体ナビゲーションの成功率と効率を大幅に向上させる手法を提案した。
原題: SSTG-Nav: Metric-Grounded Spatial-Semantic Topological Graphs for Reusable Object Navigation / Daojie Peng, Bingtao Wang, Jun Ma
日本語で読む → - 論文VLA/ロバスト性ロボティクス
構造認識型ロバスト微調整:物理的注意ハイジャックに対する視覚言語行動ロボットの防御
物理的に実現可能な敵対的パッチがVLAロボットの注意をハイジャックする攻撃を提案し、それを防ぐための構造認識型微調整法を開発した。
原題: Structure-Aware Robust Fine-Tuning: Defending Vision-Language-Action Robots Against Physical Attention Hijacking / Jinquan Zhang, Dongfu Yin, Run Yang 他
日本語で読む → - 論文VLAロボティクス
遅延耐性を持つクラウド・エッジ協調型視覚言語行動モデル:創発的表現特化による実現
クラウド上の大規模VLAモデルとエッジの軽量ヘッドを組み合わせ、通信遅延があってもロボット制御を維持する手法を提案。遅延フレームと現在フレームを同じ行動目標で学習させ、クラウド表現にタスク情報を、エッジに状態補正を担わせる。
原題: Latency-Tolerant Cloud-Edge Collaborative Vision-Language-Action Models via Emergent Representational Specialization / Daojie Peng, Fulong Ma, Bingtao Wang 他
日本語で読む → - 論文3D再構成ロボティクス
Stipple: 視覚慣性トラッキングによるリアルタイムインクリメンタルガウシアンスプラッティング
3Dガウシアンスプラッティングの重い前処理を、視覚慣性オドメトリの情報を活用したインクリメンタル学習に置き換え、トラッキングと並行してリアルタイムに3D再構成を行う手法を提案した。
原題: Stipple: Real-Time Incremental Gaussian Splatting with Visual-Inertial Tracking / Kilian Northoff, Mateo de Mayo, Daniel Cremers
日本語で読む → - 論文群制御cs.MA
応力緩和アニーリング:自動倉庫の多項式時間・シミュレーション不要レイアウト最適化
自動倉庫のレイアウト最適化を、シミュレーションなしで多項式時間で行うアルゴリズムを提案。タスク需要から交通集中を予測する応力場を計算し、レイアウトを最適化する。
原題: Stress-Relief Annealing: Polynomial-Time Simulation-Free Layout Optimization for Automated Warehouses / Xiangjie Luo, Yulun Zhang, Miyuki Koshimura 他
日本語で読む → - 論文VLAロボティクス
文脈内VLA:文脈内ポストトレーニングとエージェント的ツール使用による視覚言語行動モデルへの言語能力の付与
視覚言語行動(VLA)モデルに、自由形式の思考連鎖ではなく、構造化された文脈情報とツール使用を通じて接地された言語を消費する能力を与えるフレームワークを提案し、シミュレーション環境でその有効性を示した。
原題: In-Context VLA: Endowing Vision-Language-Action Models with Language via In-Context Post-Training and Agentic Tool Use / Jiarui Yang, Wen Huang, Jiale Zhang 他
日本語で読む → - 論文VLAロボティクス
SG-WAM: 幾何認識ポリシー空間における自己誘導型ワールドモデリング
ポリシー由来の表現空間で幾何認識の行動条件付きダイナミクスを学習し、将来状態予測と行動生成を統合する自己誘導型フレームワークを提案。
原題: SG-WAM: Self-Guided World Modeling in Geometry-Aware Policy Space / Ruiteng Zhao, Zhengshen Zhang, Yue Su 他
日本語で読む → - 論文群制御ロボティクス
再計画がボトルネックになるとき:身体化エージェントのための予算制約付き再計画
LLMベースの再計画の遅延が増大する問題に対し、再計画を予算制御ループとして扱うBRACEと、トークン刈り込み手法E-RECAPを提案し、遅延違反率を大幅に削減した。
原題: When Replanning Becomes the Bottleneck: Budgeted Replanning for Embodied Agents / Shuaijun Liu, Feiyang You, Xingwei Chen 他
日本語で読む →