論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文対話システム画像認識
DyaPlex: 二者間対話のための全二重音声・動作モデル
二者間対話のための、音声と身体動作を同時にストリーミング生成・認識できる全二重モデルを提案し、既存の音声モデルに動作経路を統合して同期したマルチモーダル対話を実現した。
原題: DyaPlex: Full-Duplex Speech-Motion Model for Dyadic Interaction / Koki Nagano, Hongyu Liu, Seonwook Park 他
日本語で読む → - 論文ヒューマノイド学習ロボティクス
TaskNPoint: 数分でヒューマノイドにバックハンドを教える方法
動的スキルは軌道の重要な一部分に依存するという構造的性質に基づき、人間のコーチが提供する少数のデモとインタラクションウィンドウを用いて、ヒューマノイドにテニスやサッカーなどの動的タスクを短時間で学習させるプロトコルを提案した。
原題: TaskNPoint: How to Teach Your Humanoid to Hit a Backhand in Minutes / Blake Werner, Ilona Demler, Pietro Perona 他
日本語で読む → - 論文操作/ベンチマークロボティクス
WatchAct: 行動に基づくロボット操作のベンチマーク
人間の行動ビデオと言語指示を組み合わせた、ロボット操作のための新しいベンチマークを提案し、シミュレーションと実機で評価した。
原題: WatchAct: A Benchmark for Behavior-Grounded Robot Manipulation / Baiqi Li, Ce Zhang, Yu Fang 他
日本語で読む → - 論文慣性オドメトリロボティクス
デルタ位置推定に基づくIMUオドメトリ:MLPとコルモゴロフ-アーノルドネットワークの比較
EuRoCデータセットの生IMUデータから、固定50ms窓の変位を推定して軌跡を再構成する学習ベースの慣性オドメトリを提案し、MLPとKANを比較した。KANはパラメータ数が約1/7ながら累積ドリフト誤差を44%削減した。
原題: Delta-Position Estimation-Based IMU Odometry: A Comparison of MLP and Kolmogorov-Arnold Networks / Osman Tokluoglu, Emin Keresteci
日本語で読む → - 論文移動ロボットロボティクス
特異点回避を備えたユニサイクルロボットの軌道追従のための緩和二次計画法フレームワーク
動的フィードバック線形化の特異点問題を回避するため、スラック変数付き等式制約QPとして再定式化し、停止・反転動作を含む軌道追従を可能にする最適制御フレームワークを提案した。TurtleBot3でのシミュレーションで有効性を実証。
原題: A Relaxed Quadratic-Program-based Framework for Trajectory Tracking of Unicycle Robots with Singularity Avoidance / Hamza Tariq, Usman Ali, Adeel Akhtar
日本語で読む → - 論文VLAロボティクス
HoloAgent-0: 3D空間メモリを備えた統合具現化エージェントフレームワーク
言語指示を実行可能なスキルグラフに変換し、3D空間メモリとロボットスキルを統合して実ロボットで閉ループ実行を実現する統一エージェントフレームワークを提案した。
原題: HoloAgent-0: A Unified Embodied Agent Framework with 3D Spatial Memory / Xiaolin Zhou, Liu Liu, Tingyang Xiao 他
日本語で読む → - 論文sim2realロボティクス
シミュレーションから実世界への賭け:Eプロセスにおける「シミュレータ」を任意時点有効な信頼シーケンスに統合する
シミュレータを利用した性能推定と賭け手法を組み合わせ、ロボット性能テストにおいて平均推定の効率的で信頼性のある証明書を生成する方法を提案した。
原題: Sim-to-Real Betting on the E-Process: Bringing "simulators" to anytime-valid confidence sequences / Yujia Chen, Bowen Weng
日本語で読む → - 論文継続学習/力覚/ロボット操作ロボティクス
多感覚継続学習:事前学習済み視覚運動ポリシーの力覚への適応
事前学習済みの視覚のみのロボットポリシーに、力覚などの新しいモダリティを追加し、元のタスク性能を保ちながら接触を伴う新タスクへ適応させる手法を提案した。
原題: Multisensory Continual Learning: Adapting Pretrained Visuomotor Policies to Force / Jaden Clark, Changhao Wang, Yihuai Gao 他
日本語で読む → - 論文機構設計ロボティクス
Jansenリンク機構における摩耗-クリアランス-衝撃の連成:歩行耐久性最適化設計が関節緩みを遅らせる
Jansen歩行リンク機構の関節にクリアランスと摩耗のフィードバックを組み込んだ動的モデルを構築し、最適化設計が従来設計より摩耗を大幅に低減することを統計的に示した論文。
原題: Wear-Clearance-Impact Coupling in the Jansen Linkage: A Gait-Durability-Optimized Design Slows Joint Loosening / Jichao Wang
日本語で読む → - 論文VLA/シミュレーションロボティクス
生き残るものを監視せよ:合成ロボット動画からの幾何学誘導VLA適応
合成ロボット動画から幾何学情報(2Dエンドエフェクタ経路点)を抽出し、VLAモデルの視覚バックボーンを補助タスクで調整する手法を提案。制御は実デモのみで学習し、幾何学情報で表現の崩壊を防ぐ。
原題: Supervise What Survives: Geometry-Guided VLA Adaptation from Synthetic Robot Videos / Danze Chen, Yanzhe Chen, Qiming Huang 他
日本語で読む → - 論文自律システムロボティクス
信頼性の高い自律システムの構築:課題と解決策
自律システムの信頼性を高めるための課題と解決策をまとめたワークショップ報告書であり、検証・実世界応用・安全なソフトウェアアーキテクチャの3分野に焦点を当て、今後の研究と産業協力のロードマップを提示している。
原題: Engineering Reliable Autonomous Systems: Challenges and Solutions / Marie Farrell, Matt Luckcuck, Angelo Ferrando 他
日本語で読む → - 論文故障検出ロボティクス
ActProbe: 生成ロボットポリシーの早期故障検出のためのアクション空間プローブ
生成ロボットポリシーの出力するアクション列自体に故障予兆が含まれることを利用し、軽量なアクション空間のみの検出器ActProbeを提案。故障を視覚的に認識される前に検出し、F1-即時性のトレードオフを改善する。
原題: ActProbe: Action-Space Probe for Early Failure Detection of Generative Robot Policies / Bingjia Huang, Xiangyu Li, Xiang Wang 他
日本語で読む → - 論文制御ロボティクス
動的環境におけるクアッドローターのロバスト統合計画・制御:CBFペナルティ付きNMPCによる実現
制御障壁関数を指数ペナルティとして組み込んだ非線形モデル予測制御を提案し、外乱オブザーバとカルマンフィルタを併用して動的環境下での安全な障害物回避を実現した。
原題: Robust Integrated Planning and Control for Quadrotors in Dynamic Environments via NMPC with CBF Penalties / Zeinab Shayan, Mohammadreza Izadi, Reza Faieghi
日本語で読む → - 論文器用操作/sim2realロボティクス
ビデオからシミュレーション、そして実世界へ:単一の人間ビデオからの全自動器用スキル獲得
単一の人間操作ビデオから、シミュレーション環境でのデジタルツイン構築と物体中心のキーフレーム最適化によりロボット動作を獲得し、さらに実世界のノイズや不完全な知覚への頑健性を分離するsim-to-real戦略で器用な操作スキルを自律的に獲得するフレームワークを提案した。
原題: Video2Sim2Real: Full-Stack Autonomous Dexterous Skill Acquisition from a Single Human Video / Yunhai Han, Jianuo Qiu, Linhao Bai 他
日本語で読む → - 論文プロアクティブ支援ロボティクス
不確実性ガイド付きLLM推論によるパーソナライズ化された堅牢なプロアクティブロボット支援
家庭環境でのプロアクティブなロボット支援のため、n-gramマルコフモデルと不確実性ガイド付きLLM推論を組み合わせた軽量フレームワークGLOBEを提案し、ノイズを含むデータセットで堅牢性と効率性を実証した。
原題: Personalized and Robust Proactive Robot Assistance with Uncertainty-Guided LLM Reasoning / Alvaro Gonzalez, M. H. Hasan Shovo, Ali Ayub
日本語で読む → - 論文HRI/トラッキングロボティクス
人間とロボットのインタラクションにおける顔追跡と身体追跡の比較:自己中心視点データセット
社会的ロボットの対話中の人物追跡におけるIDスイッチ問題を軽減するため、Furhatロボットで収集した自己中心視点データセットを用いて、顔追跡と身体追跡の性能を比較し、メモリ拡張と外観再識別の効果を評価した。
原題: Face versus Body Tracking for Human-Robot Interaction: An Egocentric Dataset / Jessica Wenninger, Gabriel Skantze
日本語で読む → - 論文群制御画像認識
DroneShield-AI: 混雑空域におけるリアルタイム自律ドローン脅威検知・行動意図分類・群知能のためのマルチモーダルセンサ融合フレームワーク
RF信号、音響、視覚の各センサを融合し、ドローンの脅威検知と行動意図分類、群行動分析を行うオープンなフレームワークを提案した。
原題: DroneShield-AI: A Multi-Modal Sensor Fusion Framework for Real-Time Autonomous Drone Threat Detection, Behavioral Intent Classification, and Swarm Intelligence in Contested Airspace / Marius Bayizere
日本語で読む → - 論文ナビゲーションロボティクス
ImagineUAV: 世界モデルと運動力学的計画による空中視覚言語ナビゲーション
UAVの視覚言語ナビゲーションにおいて、潜在ビデオ拡散モデルで未来の観測を想像し、そこから6自由度の動作を抽出して衝突回避軌道を計画するフレームワークを提案。
原題: ImagineUAV: Aerial Vision-Language Navigation via World-Action Modeling and Kinodynamic Planning / Xuchen Liu, Jiawei Huang, Shihao Xia 他
日本語で読む → - 論文VLA/継続学習ロボティクス
RECALL: 視覚言語行動モデルにおける能動的生涯学習のための回復経験収集
この論文は、視覚言語行動モデルを能動的かつ継続的に学習させる手法を提案し、不確実性に基づくデータ収集が受動的な模倣学習よりも効率的であることを示す一方、回復データのみでの微調整が破滅的忘却を引き起こすことを明らかにし、継続学習技術の評価を行っています。
原題: RECALL: Recovery Experience Collection for Active Lifelong Learning in Vision-Language-Action Models / Ulas Berk Karli, Tesca Fitzgerald
日本語で読む → - 論文強化学習機械学習
成功訪問マッチングによるプロセス報酬学習でRLを効率化
スパースな報酬を、成功・失敗エピソードを判別する識別器を使って密なプロセス報酬に変換し、ロボット操作タスクのRL微調整を高速化する手法を提案した。
原題: Learning Process Rewards via Success Visitation Matching for Efficient RL / Raymond Tsao, Andrew Wagenmaker, Sergey Levine
日本語で読む → - 論文軌跡生成AI
TrajGenAgent: 人間の移動軌跡生成のための階層型LLMエージェント
モデルの微調整なしで、LLMエージェントの階層構造を用いて現実的な人間の移動軌跡を生成するフレームワークを提案した論文。
原題: TrajGenAgent: A Hierarchical LLM Agent for Human Mobility Trajectory Generation / Siyu Li, Toan Tran, Lingyi Zhao 他
日本語で読む → - 論文歩行ロボティクス
砂地でのロボット歩行シミュレーション:オープンソース物理エンジンにおける抵抗体力理論
砂地でのロボット歩行をシミュレートするため、抵抗体力理論を物理エンジンMuJoCoに実装し、12自由度の六脚ロボットの歩行距離と足の沈み込みを実験の20%以内で予測できることを示した。
原題: Simulating Robotic Locomotion in Sand: Resistive Force Theory in an Open-Source Physics Engine / Ryan Walker Brown, Laura K. Treers, Kathryn A. Daltorio
日本語で読む → - 論文安全性ロボティクス
ロボシャックルズ:身体化基盤モデルにおける人体傷害防止のための安全性データセット
実世界のロボット観察データから危険シナリオを合成し、人体傷害防止のための安全性評価・訓練用データセットを構築した。
原題: ROBOSHACKLES: A Safety Dataset for Human-Injury Prevention in Embodied Foundation Models / Zhuowen Yin, Chongyang Liu, Wenzhang Yang 他
日本語で読む → - 論文データセット構築ロボティクス
ロボティクスデータセット構築をアーティファクトベースのビルドプロセスとしてモデル化する
ROSバッグ記録からMLデータセットを生成する逐次スクリプトを、依存グラフ上のアーティファクトベースのビルドプロセスとしてモデル化し、Bazel拡張のBagzelを実装。反復的なデータセット更新を大幅に高速化した。
原題: Modeling Robotics Dataset Construction as an Artifact-Based Build Process / Leon Pohl, Lukas Beer, George Sebastian 他
日本語で読む → - 論文医療デバイス追跡ロボティクス
勾配計ベース電磁位置推定システムによる腔内医療デバイスの閉形式姿勢推定
本論文は、コンパクトな磁気センサアレイを準勾配計として用い、閉形式で医療デバイスの位置と姿勢を推定する新しい電磁追跡システムを提案している。事前校正や反復最適化を不要とし、実験で位置誤差10.80〜15.57mm、更新レート14.49Hzを達成した。
原題: Closed-Form Pose Estimation of Endoluminal Medical Devices via Gradiometer-Based Electromagnetic Localization System / Zhiwei Wu, Jiahao Luo, Yubo Pu 他
日本語で読む → - 論文触覚/シミュレーション/器用操作ロボティクス
触覚ジェネシス:巧みな作業学習のための大規模触覚センサの探求
GPU並列の触覚センサシミュレーションプラットフォームを構築し、多様な触覚センサを共通インターフェースで提供。巧みな操作タスクでセンサの種類・配置・解像度の影響を分析し、実機への転移も検証した。
原題: Tactile Genesis: Exploring Tactile Sensors at Scale for Learning Dexterous Tasks / Trinity Chung, Kashu Yamazaki, Dhruv Patel 他
日本語で読む → - 論文状態推定ロボティクス
非慣性地面上のヒューマノイドロボットのための固有受容不変状態推定
移動・回転する非慣性地面上で、足に取り付けたIMUと運動学的制約を用いて、外部センサなしでロボットの位置・速度を推定する不変拡張カルマンフィルタを提案。Digitロボットでの実験で収束速度と精度が大幅に向上した。
原題: Proprioceptive Invariant State Estimation for Humanoid Robots on Non-Inertial Ground / Falak Mandali, Zijian He, Yan Gu
日本語で読む → - 論文故障診断ロボティクス
微分可能到達可能性による非線形システムの安全なリアルタイム能動モデル識別と故障診断
不確かな非線形システムに対し、安全制約を保ちながら能動的にモデルを識別し故障を診断するリアルタイムアルゴリズムを提案。到達可能集合の区間近似と微分可能な目的関数を用いて、勾配法で高速に最適化する。
原題: Safe, Real-Time Active Model Discrimination and Fault Diagnosis for Nonlinear Systems via Differentiable Reachability / Xinpei Ni, Melkior Ornik, Glen Chou 他
日本語で読む → - 論文ヒューマノイド操作ロボティクス
GenHOI: タスク固有の訓練なしに生成ビデオを模倣する接触を考慮したヒューマノイドと物体のインタラクション
生成ビデオを模倣することで、タスク固有の訓練や物理デモデータなしに、ヒューマノイドロボットが多様な物体操作タスクをゼロショットで実行できるフレームワークを提案した。
原題: GenHOI: Contact-Aware Humanoid-Object Interaction by Imitating Generated Videos without Task-Specific Training / Zhihai Bi, Qiang Zhang, Guoyang Zhao 他
日本語で読む → - 論文状態推定ロボティクス
GAIT: 慣性-脚トークンへの注意機構を用いた脚ロボットの固有受容状態推定
脚ロボットの状態推定において、慣性計測と脚ごとの計測を個別のトークンとして扱い、注意機構で各計測の重要度を学習する手法を提案。接触状態に応じた重み付けを明示的な接触推定なしで実現し、未見の歩容や地形でも高い推定精度を示した。
原題: GAIT: Legged Robot Proprioceptive State Estimation with Attention over Inertial-Leg Tokens / Young-Rang Seo, Hajun Kim, Sangmin Kim 他
日本語で読む →