論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/6/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文触覚ロボティクス
異種触覚トランスフォーマー
異なる触覚センサー間で共有可能な表現を学習するフレームワークを提案し、多様な触覚データからの操作ポリシー学習を可能にした。
原題: Heterogeneous Tactile Transformer / Jianxin Bi, Qiang Wang, Jayaram Reddy 他
日本語で読む → - 論文ヘルスケアロボティクスロボティクス
ActiveVital: ホームヘルスケアロボットのための幾何学を考慮した身体装着型バイタルサイン計測
家庭用ロボットが非接触で呼吸数と心拍数を正確に計測できるよう、ミリ波レーダーの観測角度を視覚情報で能動的に調整するフレームワークを提案した。
原題: ActiveVital: Geometry-Aware Embodied Vital Signs Monitoring for Home Healthcare Robots / Yuxuan Hu, Shihao Li, Yang Xiao 他
日本語で読む → - 論文ナビゲーションロボティクス
安全危機状況における蒸留視覚言語モデルを用いたイベント適応型動作計画
安全が重要な場面で、視覚言語モデルを連続制御に使うと遅延が生じる問題を解決するため、異常イベント時のみモデルを起動するフレームワークを提案し、高次推論と低次制御を統合して動的安全マージンを向上させた。
原題: Event-Adaptive Motion Planning with Distilled Vision-Language Model in Safety-Critical Situations / Zhenwei Huang, Changsheng You, Shuai Wang 他
日本語で読む → - 論文群制御ロボティクス
正規化フロー強化メッセージパッシングによるマルチロボット協調位置推定
ガウス信念伝播と平均場近似を統合し、正規化フローを用いた勾配推定で非線形観測を扱う、分散型のマルチロボット協調位置推定アルゴリズムを提案した。
原題: Normalizing Flow-Enhanced Message Passing for Multirobot Collaborative Localization / Han Shen, Guanghui Wen, Liangming Chen 他
日本語で読む → - 論文風速推定/UKF/クアッドロータロボティクス
低コストクアッドロータUAVを用いたリアルタイム風速推定
クアッドロータUAVの非線形動力学に基づき、Unscented Kalman Filter (UKF)を用いて飛行中に風速をリアルタイム推定する手法を提案。シミュレーションでEKFより高精度であることを示した。
原題: Realtime Wind Estimation using Low Cost Quadrotor Uncrewed Aerial Vehicles / Hiranya Udagedara, Mahdis Bisheban
日本語で読む → - 論文ロボット操作/評価指標ロボティクス
クリティカル区間MSE:ロボット操作ポリシーの信頼できるオフライン検証に向けて
ロボット操作ポリシーのオフライン検証指標として、タスクの重要区間に限定して誤差を計算するCI-MSEを提案し、実世界性能との相関が従来のMSEより高いことを示した。
原題: Critical Interval MSE: Toward Reliable Offline Validation for Robot Manipulation Policies / Haoxu Huang, Tongsam Zheng, Yifan Chen 他
日本語で読む → - 論文表現学習機械学習
3D-DLP: 自己教師あり3Dオブジェクト中心シーン表現学習
RGB-Dやボクセル観測を3D潜在粒子に分解し、解釈可能で制御可能なオブジェクト中心表現を自己教師ありで学習するモデルを提案。ロボット操作タスクでの性能向上も確認。
原題: 3D-DLP: Self-Supervised 3D Object-Centric Scene Representation Learning / Ellina Zhang, Madhaven Iyengar, Amir Zadeh 他
日本語で読む → - 論文V2X/自動運転cs.NI
V2Xベースのマヌーバ調整における意図共有の重要性
自動運転車のマヌーバ調整において、他車の意図を直接共有することの有効性を、軌道予測と比較して評価した論文。
原題: Importance of Intent-Sharing for V2X-based Maneuver Coordination / Rafael Molina-Masegosa, Sergei S. Avedisov, Miguel Sepulcre 他
日本語で読む → - 論文操作ロボティクス
ロボット操作のためのワールドバリューモデル
ロボット操作の価値推定に世界モデルを活用した新しい汎用価値モデル(WVM)を提案し、データ品質評価やポリシー学習の性能を向上させた。
原題: World Value Models for Robotic Manipulation / Zhihao Wang, Jianxiong Li, Yu Cui 他
日本語で読む → - 論文手術ロボティクスロボティクス
不完全な運動学を克服する手術ロボティクスのシミュレーションから実機への視覚運動学習
手術ロボットの内部センサの不正確さを、外部視覚情報を統合した学習ポリシーで補正し、シミュレーションから実機への転移で運動学誤差をリアルタイムに克服する手法を提案した。
原題: Overcoming Imperfect Kinematics in Surgical Robotics Through Sim-to-Real Visuomotor Learning / Zhaoxuan Yan, Kaizhong Deng, Zhaoyang Jacopo Hu 他
日本語で読む → - 論文義足/センサ統合ロボティクス
半能動義足のためのセンサ内蔵ラティス足底板
低コストの半能動義足の荷重支持部に磁気センサを直接埋め込み、足底力を推定できることを示した論文。
原題: A Sensorised Lattice Footplate for a Semi-Active Prosthetic Foot / Jinze Ge, Jingcheng Sun, Chengxu Zhou
日本語で読む → - 論文ハンド/コンプライアントジョイントロボティクス
PDSジョイント:器用な手に特化したパラメトリック二重螺旋ジョイント
本論文は、器用な手のためのパラメトリック二重螺旋(PDS)コンプライアントジョイントを提案し、方向依存の剛性を調整可能にし、埋め込み型誘導センサと学習ベースのキャリブレーションにより関節状態推定を実現した。
原題: PDS Joint: A Parametric Double-Spiral Joint Tailored for Dexterous Hands / Haoyang Li, Yibo Wen, Yixiang Fan 他
日本語で読む → - 論文ロボット学習ロボティクス
SPACE: クロスロボットデータからの学習による汎用ポリシーの実現
異なるロボット間で共通の動作表現としてカルテシアン状態差分を用い、ロボットの動特性の違いを適応させるフレームワークSPACEを提案し、汎用ポリシーの学習と展開を改善した。
原題: SPACE: Enabling Learning from Cross-Robot Data Toward Generalist Policies / Haeone Lee, Byeongguk Jeon, Suchae Jeong 他
日本語で読む → - 論文VLA/操作ロボティクス
Action ControlNet: 視覚言語行動モデルにおけるスムーズな非同期制御のための軽量遅延対応アダプタ
VLAモデルの推論遅延による動作の不連続性を解決するため、実行済み動作の接尾辞を条件として用いる軽量アダプタを提案し、遅延下でのロバスト性と軌道の滑らかさを向上させた。
原題: Action ControlNet: A Lightweight Delay-Aware Adapter for Smooth Asynchronous Control in Vision-Language-Action Models / Tiecheng Guo, Meng Guo
日本語で読む → - 論文物理ベース制御/動作追跡ロボティクス
BFMTrack: 行動基盤モデルを用いた物理ベース動作追跡のための潜在系列最適化
行動基盤モデル(BFM)の潜在空間を時系列で最適化する手法を提案し、報酬設計なしで高精度な動作追跡を実現した。シミュレーションとポリシー勾配を組み合わせ、実ロボットへの展開も検証している。
原題: BFMTrack: Latent Sequence Optimization for Physics-Based Motion Tracking with Behavioral Foundation Models / Thomas Rupf, Agon Serifi, David Müller 他
日本語で読む → - 論文群制御ロボティクス
安全で写実的なドローンライトショーのための生成AI
テキストプロンプトから写実的で衝突のない大規模ドローン編隊の振り付けを自動生成するパイプラインSWANを提案し、シミュレーションと実機で検証した。
原題: Generative AI for Safe and Photorealistic Drone Light Shows / Pascal Reinhold, Alexander Gräfe, Sebastian Trimpe
日本語で読む → - 論文ナビゲーションロボティクス
RAVEN: 視覚・空間・時間メモリによる長期的推論とナビゲーション
ロボットの長期運用向けに、視覚特徴と位置・時刻をベクトルDBに保存し、空間マップで検索するメモリシステムRAVENを提案。画像を直接扱うことで高精度かつ低コストな長期QA・ナビゲーションを実現し、実機でも検証した。
原題: RAVEN: Long-Horizon Reasoning & Navigation with a Visuo-Spatio-Temporal Memory / Yixun Hu, Zhicheng Zheng, Lihan Zha 他
日本語で読む → - 論文VLA/データ生成ロボティクス
Wh0: 生成的世界モデルによるスケーラブルな自己中心視点の人間手操作データ生成
生成ビデオ世界モデルを用いて、ロボット学習に使える自己中心視点の人間手操作ビデオデータを大量生成し、実ロボットデータと組み合わせて器用な操作VLAモデルの性能を大幅に向上させる手法を提案した。
原題: Wh0: Generative World Models as Scalable Sources of Egocentric Human Hand Manipulation Data / Yangtao Chen, Zixuan Chen, Peiyang Wang 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
RGB: RL誘導による全身MPPIヒューマノイド制御
事前学習済みの強化学習ポリシーをサンプリング事前分布として使い、MPPIのコストでタスク目的を指定する全身制御フレームワークを提案。再学習なしでタスク精度を向上させる。
原題: RGB: RL Guided Whole-Body MPPI for Humanoid Control / Yunsoo Seo, Sol Choi, Euncheol Im 他
日本語で読む → - 論文群制御ロボティクス
GROVE: 自然言語による接地型歩行者シミュレーションと対話型ソーシャルロボットナビゲーションへの応用
テキスト入力から現実的で社会的に挑戦的な歩行者シミュレーションを生成するフレームワークを提案し、ロボットナビゲーションの訓練と展開に活用する。
原題: GROVE: Grounded Pedestrian Simulation via Natural Language for Interactive Social Robot Navigation / Duc Tai Nguyen, Volodymyr Shcherbyna, Anh Do Duc 他
日本語で読む → - 論文触覚ロボティクス
触覚センサの公平なテストと比較のための3Dプリント可能なデータセット
数学的に定義されたテクスチャを3Dプリントで再現可能なデータセットを提案し、異なるプリンタやフィラメントでの再現性を評価した。
原題: A 3D-Printable Dataset for Fair Testing and Comparisons of Tactile Sensors / Dexter R. Shepherd, Nicolas Herzig, Phil Husbands 他
日本語で読む → - 論文レーダー/3次元再構築ロボティクス
影の向こうへ:FMCWレーダーの影効果を用いた近接幾何形状の再構築
車体によるレーダー影の幾何学的特徴から、近傍の細長い垂直物体の3次元傾きを解析的に推定する手法を提案。シミュレーションと実機実験で有効性を確認した。
原題: Beyond a Shadow of a Doubt: Close Proximity Geometry Reconstruction Using FMCW Radar Shadow Effects / Felix de Trogoff du Boisguezennec, Benjamin Ramtoula, Daniele De Martini
日本語で読む → - 論文VLAロボティクス
VLAMotor: エージェントベースのデータ合成による視覚言語行動モデルのテスト駆動型強化
VLAモデルのエッジケースでの失敗を検出し、その失敗を教師データに変換してモデルを微調整するフレームワークVLAMotorを提案した。
原題: VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis / Zeqin Liao, Peifan Ren, Zixu Gao 他
日本語で読む → - 論文SLAMロボティクス
MyGO-Splat: RGBのみを用いたガウシアンSLAMのための多目的閉ループ幾何フィードバック
RGBのみの単眼SLAMにおけるスケール曖昧性と幾何学的自己補正の欠如に対し、3Dガウシアンスプラッティングを利用してマップから深度と法線をラスタライズし、カメラポーズ最適化を能動的に監督する閉ループフレームワークを提案。スケール適応アライメントにより単眼深度推定を統合し、RGB-D法に匹敵する性能を実現した。
原題: MyGO-Splat: Multi-Objective Closed-Loop Geometric Feedback for RGB-Only Gaussian SLAM / Fan Zhu, Ziyu Chen, Zhenjun Zhao 他
日本語で読む → - 論文VLA/操作ロボティクス
PhysReflect-VLA: 物理的実現可能性と自己反映的調整による信頼性の高い視覚-言語-行動ポリシー
VLAモデルに物理的実現可能性の評価と自己反映による修正を組み込んだ実行時信頼性フレームワークを提案し、実世界の多段階操作タスクで成功率を向上させた。
原題: PhysReflect-VLA: Physical Feasibility and Self-Reflective Regulation for Reliable Vision-Language-Action Policies / Jiayu Yang, Tao Yang, Weijun Li 他
日本語で読む → - 論文AR-HRCHCI
ARTOO-DARTU: 倉庫作業におけるAR障害物軽減を伴うAR-HRCの研究
倉庫での人間とロボットの協調作業において、ARによるロボット情報表示が実世界の視界を遮る問題を解決するため、障害物検出・軽減パイプラインを備えたARシステムを提案し、ユーザー実験で効率向上を実証した。
原題: ARTOO-DARTU: Studying AR-HRC With AR Obstruction Mitigation During a Warehouse Task / Christian Fronk, Hanting Ye, Zhehan Qu 他
日本語で読む → - 論文安全制御/自動運転ロボティクス
因果性に基づくパラメトリック制御バリア関数による安全な複数車両インタラクション
複数車両の相互作用における因果性を考慮したパラメトリックCBFを学習し、適応的な安全制御器を構築して、過度に保守的でない安全な動作を実現する。
原題: Causality-Based Parametric Control Barrier Function for Safe Multi-Vehicle Interaction / Yiwei Lyu, Caleb Chang, John M. Dolan
日本語で読む → - 論文ナビゲーションロボティクス
GN0: 視覚言語ナビゲーションにおける生成・評価・方策学習の統一的パラダイムに向けて
大規模データセットと高忠実度シミュレータを構築し、RL駆動のナビゲーション基盤モデルを提案して、視覚言語ナビゲーションの性能を向上させた。
原題: GN0: Toward a Unified Paradigm for Generation, Evaluation, and Policy Learning in Visual-Language Navigation / Xinhai Li, Xiaotao Zhang, Yuehao Huang 他
日本語で読む → - 論文ナビゲーションロボティクス
順序ニューラルコラプスを視覚ナビゲーションの表現事前分布として用いる手法
視覚ベースのナビゲーションにおいて、エンコーダの表現空間を行動の順序構造に合わせて整理する手法ORIONを提案し、曖昧な判断点での行動不一致を低減する。
原題: Ordinal Neural Collapse as a Representation Prior for Visual Navigation / E-In Son, Jung-Taak Kim, Seung-Woo Seo
日本語で読む → - 論文自動運転プランニングロボティクス
ASSCG: 自動運転における高速・低速LLMプランニングのための適切なゲーティング
大規模言語モデルを自動運転プランニングに使う際、低速システムの呼び出しをリソースを考慮した逐次決定問題として捉え、フレームごとにQuery/Cache/Dropを決める適応ゲートASSCGを提案。nuPlanとNAVISIMで性能向上と遅延削減を実証。
原題: ASSCG: Just-Right Gating over Chattering for Fast-Slow LLM Planning in Autonomous Driving / Sining Ang, Yuan Chen, Liu Haiyan 他
日本語で読む →