論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
AnyCamVLA: 視点ロバストな視覚言語行動モデルのためのゼロショットカメラ適応
カメラ視点の変化に弱いVLAモデルに対し、追加データや微調整なしで、テスト時の観測を訓練時のカメラ設定に合わせて仮想的に変換するゼロショット適応フレームワークを提案した。
原題: AnyCamVLA: Zero-Shot Camera Adaptation for Viewpoint Robust Vision-Language-Action Models / Hyeongjun Heo, Seungyeon Woo, Sang Min Kim 他
日本語で読む → - 論文ヒューマンロボットインタラクションHCI
視覚的ストーリーテリングのための具現化されたコンパニオン
描画ロボットと大規模言語モデルを統合し、人間と機械が対話しながら共同で視覚的な物語を創り出す芸術的システムを提案した。専門家による評価で、独自の美的アイデンティティと展示価値が確認された。
原題: An Embodied Companion for Visual Storytelling / Patrick Tresset, Markus Wulfmeier
日本語で読む → - 論文異常検知機械学習
UAV故障検出のためのHEP統計的推論:CLs、LRT、SBIをブレード損傷に適用
粒子物理学の統計手法(LRT、CLs、SNPE)をマルチローターのプロペラ故障検出に転用し、ブレード損傷の検出・誤警報率制御・故障度合いの不確実性付き推定を実現した。
原題: HEP Statistical Inference for UAV Fault Detection: CLs, LRT, and SBI Applied to Blade Damage / Khushiyant
日本語で読む → - 論文VLAロボティクス
VPWEM: 作業記憶とエピソード記憶を備えた非マルコフ視覚運動ポリシー
ロボットの模倣学習において、短期の作業記憶と長期のエピソード記憶を組み合わせ、長期的な記憶を要する非マルコフタスクを少ない計算コストで解く視覚運動ポリシーを提案した。
原題: VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory / Yuheng Lei, Zhixuan Liang, Hongyuan Zhang 他
日本語で読む → - 論文共有自律制御HCI
DiSCo: 共有自律のための拡散シーケンスコパイロット
共有自律制御において、拡散ポリシーを用いてユーザーの行動履歴に整合する行動シーケンスを計画する手法DiSCoを提案し、シミュレーションの運転・ロボットアームタスクで性能を向上させた。
原題: DiSCo: Diffusion Sequence Copilots for Shared Autonomy / Andy Wang, Xu Yan, Brandon McMahan 他
日本語で読む → - 論文拡散プランナー機械学習
エネルギーベースの自己教師あり行動ゲーティングによる拡散プランナーの改善
拡散プランナーの推論時に、JEPAで学習した潜在予測誤差をエネルギーとして候補軌道を再ランキングし、動的に矛盾する計画を排除して性能と堅牢性を高める手法SAGEを提案。
原題: Improving Diffusion Planners by Self-Supervised Action Gating with Energies / Yuan Lu, Dongqi Han, Yansen Wang 他
日本語で読む → - 論文HRI/センサ融合HCI
HiSync: ウェアラブルIMUとロボット搭載カメラによる手の動きの時空間整合を用いた長距離HRIにおけるコマンド発信源識別
長距離の人間とロボットのインタラクションにおいて、複数ユーザーの中からコマンドを発した人を特定する手法を提案。手首のIMUとロボットのカメラ映像を融合し、手の動きの類似性から発信源を識別する。
原題: HiSync: Spatio-Temporally Aligning Hand Motion from Wearable IMU and On-Robot Camera for Command Source Identification in Long-Range HRI / Chengwen Zhang, Chun Yu, Borong Zhuang 他
日本語で読む → - 論文群制御ロボティクス
マルチロボットシステムにおけるタスク特化の進化コスト
限られた評価予算で群ロボットの採餌タスクを進化させ、汎用行動とタスク特化行動を比較した結果、特化型は協調に失敗し性能が劣ることが示された。
原題: On the Cost of Evolving Task Specialization in Multi-Robot Systems / Paolo Leopardi, Heiko Hamann, Jonas Kuckling 他
日本語で読む → - 論文歩行ロボティクス
HybridMimic: ハイブリッドRL-セントロイダル制御による人型ロボットの動作模倣
学習ポリシーがセントロイダルモデルベースのコントローラを動的に変調し、連続的な接触状態と目標重心速度を予測することで、ドメインシフト下でも物理的に実現可能なフィードフォワードトルクを生成する人型ロボットの動作模倣フレームワークを提案した。実機実験でベース位置追従誤差を13%削減した。
原題: HybridMimic: Hybrid RL-Centroidal Control for Humanoid Motion Mimicking / Ludwig Chee-Ying Tay, I-Chia Chang, Yan Gu
日本語で読む → - 論文HRI/意思決定HCI
人間の向社会性の戦略的形成:潜在状態POMDPフレームワーク
ロボットが繰り返しの相互作用で人間の向社会性を推論し、影響を与えるための意思決定フレームワークを提案し、潜在状態POMDPとして定式化して学習したポリシーが協力行動を向上させることを示した。
原題: Strategic Shaping of Human Prosociality: A Latent-State POMDP Framework / Zahra Zahedi, Xinyue Hu, Shashank Mehrotra 他
日本語で読む → - 論文歩行ロボティクス
何本脚でも歩ける:不整地を歩行する多脚ロボットの制御
2脚につき3アクチュエータを持つセグメント型ロボットで、6〜16脚の不整地歩行を実現する軽量な制御アーキテクチャを提案し、シミュレーションで検証した。
原題: Walking on Rough Terrain with Any Number of Legs / Zhuoyang Chen, Xinyuan Wang, Shai Revzen
日本語で読む → - 論文ロボット評価ロボティクス
PRM-as-a-Judge:ロボットの細粒度監査のための高密度評価パラダイム
ロボットの実行品質をバイナリ成功率ではなく、プロセス報酬モデル(PRM)を用いて軌道ビデオから密に評価する新しいパラダイムを提案し、OPD指標体系と診断ベンチマークRoboPulseで検証した。
原題: PRM-as-a-Judge: A Dense Evaluation Paradigm for Fine-Grained Robotic Auditing / Yuheng Ji, Yuyang Liu, Huajie Tan 他
日本語で読む → - 論文マニピュレーションロボティクス
順方向デモンストレーションからの逆タスク学習によるタスクパラメータ外挿
順方向と逆方向のタスクを共通表現で学習し、新規条件の順方向デモのみから対応する逆タスクを実行できる手法を提案。シミュレーションと実機の複雑なマニピュレーションで既存手法を上回る。
原題: Task Parameter Extrapolation via Learning Inverse Tasks from Forward Demonstrations / Serdar Bahar, Fatih Dogangun, Matteo Saveriano 他
日本語で読む → - 論文マニピュレーションロボティクス
生涯にわたる言語条件付きロボット操作学習
本論文では、ロボットが複数の操作スキルを継続的に学習しつつ、古いスキルの忘却を防ぐフレームワーク「SkillsCrafter」を提案する。
原題: Lifelong Language-Conditioned Robotic Manipulation Learning / Xudong Wang, Zebin Han, Zhiyu Liu 他
日本語で読む → - 論文ナビゲーションロボティクス
GoalVLM: VLM駆動によるマルチエージェント物体ゴールナビゲーション
本論文では、視覚言語モデル(VLM)を意思決定に統合し、ゼロショットでオープン語彙の物体ナビゲーションを実現する協調マルチエージェントフレームワークGoalVLMを提案する。
原題: GoalVLM: VLM-driven Object Goal Navigation for Multi-Agent System / MoniJesu James, Amir Atef Habel, Aleksey Fedoseev 他
日本語で読む → - 論文マニピュレーションロボティクス
受動的監視から能動的防御へ:サイバー攻撃下におけるマニピュレータのレジリエント制御
冗長マニピュレータに対するステルス的な偽データ注入攻撃に対し、異常スコアに基づいて制御入力を減衰させる能動的防御手法を提案し、攻撃によるエンドエフェクタの偏差を低減しつつ通常時の性能を維持できることを示した。
原題: From Passive Monitoring to Active Defence: Resilient Control of Manipulators Under Cyberattacks / Gabriele Gualandi, Alessandro V. Papadopoulos
日本語で読む → - 論文世界モデルロボティクス
ロボット政策の訓練と評価のためのインタラクティブ世界シミュレータ
一貫性モデルを用いて高速かつ安定なインタラクティブ世界モデルを構築し、ロボット政策の訓練と評価を可能にするフレームワークを提案。世界モデル内で収集したデータで訓練した政策が実世界データと同等の性能を示し、シミュレーションと実世界の性能に強い相関があることを実証。
原題: Interactive World Simulator for Robot Policy Training and Evaluation / Yixuan Wang, Rhythm Syed, Fangyu Wu 他
日本語で読む → - 論文ナビゲーションロボティクス
エッジハードウェア上での鉱山内四足ロボットの効率的自律ナビゲーション
GPUやネットワークを必要としない低消費電力エッジコンピュータ上で動作する、鉱山内の四足ロボット向け完全自律ナビゲーションシステムを提案し、実地試験で100%の成功率を達成した。
原題: Efficient Autonomous Navigation of a Quadruped Robot in Underground Mines on Edge Hardware / Yixiang Gao, Kwame Awuah-Offei
日本語で読む → - 論文触覚ロボティクス
ArrayTac:形状・硬さ・摩擦を連続的に提示する閉ループ圧電触覚ディスプレイ
圧電アクチュエータアレイと閉ループ制御により、形状・硬さ・摩擦の3次元触覚を連続的に提示する触覚ディスプレイを開発し、遠隔腫瘍触診などへの応用を示した。
原題: ArrayTac: A Closed-loop Piezoelectric Tactile Platform for Continuously Tunable Rendering of Shape, Stiffness, and Friction / Tianhai Liang, Shiyi Guo, Baiye Cheng 他
日本語で読む → - 論文ウェアラブルセンサ/センサ統合ロボティクス
伸縮性ウェアラブルセンサのためのマルチマテリアル直接インク書き込みと刺繍の統合
シリコーン-カーボングリース-シリコーンの多層構造を直接インク書き込みで印刷し、自動刺繍で固定と電気接続を同時に行うことで、衣服に直接埋め込める伸縮性ひずみセンサを製作した。最大120%の伸びに対応し、関節角度モニタリングへの応用可能性を示した。
原題: Multi-material Direct Ink Writing and Embroidery for Stretchable Wearable Sensors / Lukas Cha, Ryman Hashem, Ria Prakash 他
日本語で読む → - 論文自動運転AI
LLM-MLFFN: 大規模言語モデルによるマルチレベル自動運転行動特徴融合
自動運転車の運転行動分類の精度と解釈性を高めるため、大規模言語モデルを用いて数値特徴と意味的特徴を融合する新しいネットワークを提案した。Waymoデータセットで94%以上の分類精度を達成した。
原題: LLM-MLFFN: Multi-Level Autonomous Driving Behavior Feature Fusion via Large Language Model / Xiangyu Li, Tianyi Wang, Xi Cheng 他
日本語で読む → - 論文ロコモーションロボティクス
横這いと転がりの統合:細長い無脚・多脚ロボットの自己復帰のための波動ベースフレームワーク
本研究は、細長い多脚ロボットの自己復帰戦略を生物学的観察とロボット実験で比較し、脚長や脚数に応じた効果的な自己復帰方法を提案する。
原題: Unifying Sidewinding and Rolling: A Wave-Based Framework for Self-Righting in Elongated Limbless and Multi-Legged Robots / Hangjun Liu, Jiarui Geng, Jinxuan Ding 他
日本語で読む → - 論文宇宙機制御制御
バイナリスラスタのための混合整数モデル予測制御と連続モデル予測制御の比較研究
宇宙機の近接運用で使われるオン/オフ型スラスタの制御について、混合整数最適化として直接解く手法と、連続制御出力を変調する2層手法を初めて体系的に比較し、変調器の状態を考慮した新しいMPCも提案した。
原題: Mixed-Integer vs. Continuous Model Predictive Control for Binary Thrusters: A Comparative Study / Franek Stark, Jakob Middelberg, Shubham Vyas
日本語で読む → - 論文VLA機械学習
シンプルな手法で十分:VLAモデルは強化学習による自然な継続学習者である
大規模事前学習済みVLAモデルの継続強化学習を体系的に検証し、LoRAを用いた単純な逐次ファインチューニングが破滅的忘却をほとんど起こさず、複雑な継続学習手法を上回ることを示した。
原題: Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning / Jiaheng Hu, Jay Shim, Chen Tang 他
日本語で読む → - 論文拡散モデル/動作生成ロボティクス
FODMP: 時間依存ロボット動作のための高速ワンステップ拡散運動プリミティブ生成
拡散モデルによる動作生成を、運動プリミティブのパラメータ空間への蒸留と単一ステップ復号により高速化し、時間構造を保ちつつリアルタイム制御を可能にするフレームワークを提案した。
原題: FODMP: Fast One-Step Diffusion of Movement Primitives Generation for Time-Dependent Robot Actions / Xirui Shi, Arya Ebrahimi, Yi Hu 他
日本語で読む → - 論文歩行機械学習
筋シナジー事前分布が予測筋骨格歩行シミュレーションの生体力学的忠実度を高める
少数の歩行実験から抽出した筋シナジーを強化学習の行動空間に組み込むことで、様々な速度・傾斜・不整地で安定した歩容を生成し、非生理的な膝運動を抑えて生体力学的忠実度を向上させた。
原題: Muscle Synergy Priors Enhance Biomechanical Fidelity in Predictive Musculoskeletal Locomotion Simulation / Ilseung Park, Eunsik Choi, Jangwhan Ahn 他
日本語で読む → - 論文全身制御ロボティクス
ULTRA: ヒューマノイド全身移動操作のための統合マルチモーダル制御
大規模モーションキャプチャを物理的に妥当なヒューマノイド動作に変換し、密な参照と疎なタスク指定の両方を扱う統合マルチモーダル制御器を学習することで、知覚と高次タスク仕様から自律的な全身移動操作を実現する。
原題: ULTRA: Unified Multimodal Control for Autonomous Humanoid Whole-Body Loco-Manipulation / Xialin He, Sirui Xu, Xinyao Li 他
日本語で読む → - 論文自動運転/世界モデルロボティクス
VectorWorld: ベクトルグラフ上の拡散フローによる効率的なストリーミング世界モデル
自動運転の閉ループ評価のための、履歴条件付きポリシーと整合し、リアルタイムで長距離ロールアウト可能なストリーミング世界モデルを提案した。
原題: VectorWorld: Efficient Streaming World Model via Diffusion Flow on Vector Graphs / Chaokang Jiang, Desen Zhou, Jiuming Liu 他
日本語で読む → - 論文ナビゲーションロボティクス
P$^{3}$Nav: 視覚と言語によるナビゲーションのためのエンドツーエンドの知覚・予測・計画
視覚と言語によるナビゲーション(VLN)タスクにおいて、知覚・予測・計画を統合したエンドツーエンドのフレームワークを提案し、シーン理解を強化してナビゲーション成功率を向上させた。
原題: P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation / Tianfu Li, Wenbo Chen, Haoxuan Xu 他
日本語で読む → - 論文自動運転画像認識
DriveCode: LLMベース自動運転のためのドメイン特化型数値エンコーディング
数値を専用埋め込みとして表現するDriveCodeを提案し、LLMベース自動運転における軌道予測と制御信号生成の精度を向上させた。
原題: DriveCode: Domain Specific Numerical Encoding for LLM-Based Autonomous Driving / Zhiye Wang, Yanbo Jiang, Rui Zhou 他
日本語で読む →