論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文UAVナビゲーションロボティクス
RASR: 距離認識スケール復元によるメートル単位UAVナビゲーション
GNSSが使えない環境での画像ゴールUAVナビゲーションにおいて、距離と方位を正確に推定するため、グローバルスケール較正に距離依存の残差補正を加えるRASRを提案した。
原題: RASR: Range-Aware Scale Recovery for Metric UAV Navigation / Hongtao Liang, Xinyu Shao, Chenxu Wang 他
日本語で読む → - 論文模倣学習ロボティクス
力制約付き弾性マップを用いた一回提示マルチモーダル模倣学習
運動と接触力の両方を考慮した一回提示の模倣学習フレームワークを提案し、力情報を含むデモンストレーションの分割・符号化・再現を実現した。
原題: One-Shot Multimodal Learning from Demonstration with Force-Constrained Elastic Maps / Brendan Hertel, Jonathan Spanos, Navya Garg 他
日本語で読む → - 論文データ生成ロボティクス
RynnWorld-Teleop: デジタル遠隔操作のための行動条件付きワールドモデル
物理的な遠隔操作に代わり、生成ワールドモデルを用いてロボット中心の映像を合成し、実機不要で模倣学習用の軌道データを生成するデジタル遠隔操作パラダイムを提案した。
原題: RynnWorld-Teleop: An Action-Conditioned World Model for Digital Teleoperation / Haoyu Zhao, Xingyue Zhao, Hangyu Li 他
日本語で読む → - 論文ソフトロボティクス/ウェアラブルロボティクス
疼痛と痙縮を軽減する筋骨格操作のためのソフトロボット外骨格グローブの開発
脳卒中や関節炎などによる手の痙縮と疼痛を緩和するため、可動性支援とマッサージ圧迫を両立するソフト空気圧アクチュエータを用いた外骨格グローブを開発し、設計・試作・実験を行った。
原題: Towards Soft Robotic Exogloves for Musculoskeletal Manipulation to Reduce Pain and Spasticity / Antonia Salluce, Maeryn Erdheim, Gailen Davis 他
日本語で読む → - 論文VLAロボティクス
TS-Mask VLA: 視覚言語行動モデルのための2次元時空間マスキングと効果的なブリッジング
本論文は、ロボット操作のための視覚言語行動(VLA)モデルを提案し、離散拡散アクションエキスパートと時空間2Dマスキング戦略を導入して、長期的で複雑なタスクにおける行動生成の精度と安定性を向上させる。
原題: TS-Mask VLA: 2D Temporal-Spatial Masking for Vision-Language-Action Model with Effective Bridging / Shengzhuo Yang, Ronghao Yu, Chuanjie Lv 他
日本語で読む → - 論文状態推定ロボティクス
グローバル対応補助慣性航法システムのための誤差状態カルマンフィルタ運動学の導出
地球の曲率や自転、重力変化を考慮したグローバル航法システム向けに、古典的および不変誤差状態カルマンフィルタ(ESKF)の数式を体系的にまとめた論文。
原題: Derivations of Error-State Kalman Filter Kinematics for Globally Applicable Aided Inertial Navigation Systems / Antonia Hager, Torleiv H. Bryne
日本語で読む → - 論文共有制御ロボティクス
Robot Trajectron V3: SE(3)操作のための確率的共有制御フレームワーク
高自由度ロボットアームの遠隔操作を支援するため、ユーザーの意図を事前分布として学習し、リアルタイムのコマンドと統合して共有制御を行う確率的フレームワークを提案した。
原題: Robot Trajectron V3: A Probabilistic Shared Control Framework for SE(3) Manipulation / Pinhao Song, Zhongxi Li, Ze Fu 他
日本語で読む → - 論文ヒューマノイドデザインロボティクス
ヒューマノイドロボット設計における不気味の谷のベイズ的枠組み
ロボットの親和性を数理モデル化する階層ベイズ生成モデルを提案し、カテゴリ曖昧性や感覚間不一致が親和性低下を引き起こす仕組みをシミュレーションと人間実験で検証した。
原題: A Bayesian framework for the uncanny valley in humanoid robot design / Shimon Honda, Rin Shibano, Hideyoshi Yanagisawa
日本語で読む → - 論文SLAMロボティクス
情報量を考慮したオドメトリと遡及的ループクロージャによるグラフベースLiDAR SLAMの地図整合性向上
LiDAR SLAMにおいて、軌道精度だけでなく再訪地点での地図の幾何的整合性を高めるため、ICPの情報行列を推定してオドメトリ制約を重み付けし、階層的かつ遡及的なループクロージャで見逃しを回復する手法を提案した。
原題: Improving Map Consistency in Graph-Based LiDAR SLAM Through Information-Aware Odometry and Retroactive Loop Closure / Saurabh Gupta, Niklas Trekel, Louis Wiesmann 他
日本語で読む → - 論文ナビゲーションロボティクス
野戦医療施設における自律患者搬送のための階層的リスクマッピング
野戦医療施設での患者搬送を自律化するため、地形・障害物・意味的走行可能性など4つの環境リスクをNoisy-OR融合で統合した確率的コストマップを提案し、衝突率を73%から32%以下に低減した。
原題: Layered Risk Mapping for Autonomous Patient Transport in Expeditionary Medical Facilities / Lorena Maria Genua, Sarvesh Prajapati, Damla Leblebicioglu 他
日本語で読む → - 論文ロボット基盤モデルロボティクス
WSA$_1$: 3D中心の世界・空間・行動モデルによる汎用ロボット制御
ロボット基盤モデルに3D世界の物理ダイナミクスと行動の因果関係を学習させる新しいパラダイムを提案し、少ない実データで高い汎化性能を実現した。
原題: WSA$_1$: a 3D-Centric World-Spatial-Action Model for Generalizable Robot Control / Jiahao Jiang, Jianing Zhang, Zhenhan Yin 他
日本語で読む → - 論文3Dシーン編集ロボティクス
セマンティックガイドによるガウススプラッティングを用いた段階的物体除去
3Dシーンから不要な物体を除去する際、セマンティック情報と段階的リファインメントを統合した新しいフレームワークを提案。DINOv2で他視点の意味情報を活用し、マスク領域を複数サブ領域に分けて品質の低い部分を選択的に改善することで、高品質な除去を実現。
原題: Semantic-Guided Progressive Object Removal with Gaussian Splatting / Xianliang Huang, Chen Xiao, Yuanxiang Ni 他
日本語で読む → - 論文センシング機械学習
ジオメトリを考慮したインフラ固定型デノイザによるUWBセンシングと工事現場再構築
屋外UWB測距のノイズを、アンカー配置推定と距離投影を組み合わせた学習フレームワークで除去し、工事現場の空間再構築精度を向上させた。
原題: Geometry-Aware Infrastructure-Anchored Denoiser for UWB Sensing and Work-Zone Reconstruction / Weizhe Tang, Jiaxi Liu, Junwei you 他
日本語で読む → - 論文航法/フィルタリングロボティクス
航空機搭載補助慣性航法における閉ループ対開ループカルマンフィルタ構成の比較
航空機の慣性航法システムにおいて、閉ループ(フィードバック)と開ループ(フィードフォワード)のカルマンフィルタ構成の性能差を、様々なIMU精度でシミュレーションし評価した論文。
原題: Closed-loop vs. Open-loop Kalman Filter Architectures in Airborne Aided Inertial Navigation / Antonia Hager, Torleiv H. Bryne
日本語で読む → - 論文ナビゲーションロボティクス
緊急支援のための社会的認識を備えた自律ドア通過と物資配送
ロボットが緊急避難時にドアを開け、救助装備を届けるための行動木ベースのシステムを提案し、105回の試験で97回成功した。
原題: Socially-Aware Autonomous Doorway Traversal and Payload Delivery for Emergency Assistance / Andrew Snowdy, Ananya Trivedi, Sarvesh Prajapati 他
日本語で読む → - 論文セキュリティ/VLAロボティクス
!Imperio, smolVLA:オープンソースロボティクスにおけるデータポイズニングの影響
オープンソースのロボット学習モデル(smolVLA)が、わずかな毒データを混入されるだけで、特定のトリガーワードでロボットを完全に停止させるバックドアを埋め込めることを実証した論文。
原題: !Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics / Stefan Bühler, Mark Schutera
日本語で読む → - 論文触覚/VLA/操作ロボティクス
接触を伴うロボット操作のための表現整合型触覚グラウンディング
触覚強化型VLAポリシーにおいて、将来の触覚状態を予測する中間表現の位置を特定し、軽量な潜在触覚予測器(LTP)を導入して行動表現と接触結果を整合させる手法を提案した。実機の接触を伴う操作タスクで有効性を実証した。
原題: Representation-Aligned Tactile Grounding for Contact-Rich Robotic Manipulation / Ruilin Chen, Jingkai Jia, Tong Yang 他
日本語で読む → - 論文長期環境認識画像認識
PreSIST: オープンワールドシーンにおける視覚言語情報を活用した物体永続性予測
ロボットが長期間環境を監視する際に、物体が現在の位置にどれだけ留まるかを、シーン文脈と視覚言語モデルを用いて事前に予測する手法を提案した。
原題: PreSIST: Vision-Language-Informed Object Persistence Prediction in Open-World Scenes / Amanda Adkins, Tarunvidyut Ravisankar, Joydeep Biswas
日本語で読む → - 論文世界モデル機械学習
Qantara: マルチパラダイムJEPA制御のためのブリッジフロー学習
Qantaraは、学習時に単一の推論パラダイムに固定されず、推論時に複数の制御手法(プランニング、行動クローニング、逆動力学)を切り替えられるJEPAベースの世界モデルを提案する。
原題: Qantara: Bridge-Flow Training for Multi-Paradigm JEPA Control / Ruslan Rakhimov, George Bredis, Yuriy Maksyuta 他
日本語で読む → - 論文ナビゲーションロボティクス
EA-Nav: 身体性を考慮した安全な視覚ナビゲーションポリシーの学習
異なる身体性を持つエージェント間でのナビゲーション性能を向上させるため、模倣学習に基づく身体性認識フレームワークを提案し、身体形状を条件付けトークンとして導入して行動の曖昧性を低減し、軌道拡張で高リスクサンプルを生成して安全なナビゲーションを実現した。
原題: EA-Nav: Learning Safe Visual Navigation Policies with Embodiment Awareness / Jialu Zhang, Yong Du, Xianda Guo 他
日本語で読む → - 論文ロバスト認識/量子化画像認識
Recti-Q: エッジロボティクスにおける分布外ロバスト量子化認識のための特徴空間補正
量子化された視覚バックボーンが分布シフト下でロバスト性を失う問題を解決するため、凍結した量子化バックボーンに小さなLoRAアダプタを訓練する軽量な特徴空間補正フレームワークを提案した。
原題: Recti-Q: Feature-Space Rectification for Out-of-Distribution-Robust Quantized Perception in Edge Robotics / Hamidreza Yaghoubi Araghi, Parastoo Pilevar, Ming C. Lin
日本語で読む → - 論文ワールドモデルロボティクス
DriftWorld: ドリフトによる高速ワールドモデリング
拡散ベースのワールドモデルは推論時の反復サンプリングが遅いため、ロボットの行動計画に必要な多数のロールアウト生成がボトルネックとなる。本論文では、訓練中に行動条件付きドリフトを学習し、単一の順伝播で未来フレームを生成できるDriftWorldを提案し、拡散ベースのベースラインより平均17倍高速で、複数の操作ベンチマークで最先端の意思決定性能を達成した。
原題: DriftWorld: Fast World Modeling through Drifting / Susie Lu, Haonan Chen, Weirui Ye 他
日本語で読む → - 論文制御制御
ケーブル駆動ロボットのための新しい非線形適応則を用いた時間遅延制御
ケーブル駆動ロボットの非線形性と低剛性による制御課題に対し、時間遅延推定に基づく適応分数次非特異ターミナルスライディングモード制御を提案し、新しい非線形適応則でチャタリングを抑えつつ追従精度を向上させた。実験でRMSEを最大34.52%削減した。
原題: Time-delay Control Using a New Nonlinear Adaptive Law for Cable-Driven Robots / Wenbo Gao, Yaoyao Wang, Jiawang Chen 他
日本語で読む → - 論文自動運転ロボティクス
NeoRacer: ベンチマーキングと教育のためのオープンで標準化された1:12スケール自動運転レースカー
オープンソースの1:12スケール自動運転レースカープラットフォームNeoRacerを提案し、低コストで高性能な標準ベンチマーク環境を提供する。
原題: NeoRacer: An Open, Standardized 1:12 Scale Autonomous Race Car for Benchmarking and Education / Koneshka Bandyopadhyay, Ansh Mehta, Bassel El Mabsout 他
日本語で読む → - 論文両腕操作ロボティクス
片手はもう一方を見る:動的環境でのサンプル効率的な両腕操作のための動的マルチエージェント協調
動的環境や両腕協調操作において、従来のマルチストリームポリシーが前提とする因果的独立性が崩れる問題を解決するため、反対側の腕を動的タスクパラメータとして扱う軽量なフレームワークDynaMACを提案し、静的デモから動的環境へのゼロショット一般化を実現した。
原題: One Hand Watches The Other: Dynamic Multi-Agent Cooperation for Sample-Efficient Bimanual Manipulation in Dynamic Environments / Jan Ole von Hartz, Abhinav Valada, Joschka Boedecker
日本語で読む → - 論文動作計画ロボティクス
未知ダイナミクスを考慮した確率制約付き動作計画のための等角制約強化
未知のダイナミクスを持つシステムに対して、既存のプランナーに確率的なタスク完了保証を付与する制約強化手法を提案。等角予測を用いて名目モデルと実システムの軌道乖離を確率的に境界付け、その境界で制約を強化することで、実システム上での成功を保証する。
原題: Conformal Constraint Tightening for Chance-Constrained Motion Planning with Unknown Dynamics / Shubham Natraj, Bruno Sinopoli, Yiannis Kantaros
日本語で読む → - 論文軌道計画ロボティクス
自己教師あり生体模倣ロボット軌道計画と障害物回避
障害物を含む環境で、前方・逆モデルを内部教師信号として用いる自己教師あり学習フレームワークによる軌道計画手法を提案・評価した。
原題: Self-Supervised Bio-Inspired Robotic Trajectory Planning with Obstacle Avoidance / Miroslav Krupa, Miroslav Cibula, Kristína Malinovská
日本語で読む → - 論文VLA画像認識
TurboVLA: RTX 4090上で32Hz・1GB未満のVRAMで動作するリアルタイム視覚言語行動モデル
従来のLLM中心のVLAアーキテクチャを、視覚と言語を独立にエンコードし軽量な双方向相互作用で直接行動にマッピングする方式に再設計し、計算コストとメモリ使用量を大幅に削減した。LIBEROで97.7%の成功率を達成し、大規模モデルに匹敵する性能を小規模で実現した。
原題: TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM / Hengyi Xie, Chenfei Yao, Xianjin Wu 他
日本語で読む → - 論文歩行ロボティクス
Isaac Simから実機へ:四足歩行の強化学習に基づく移動制御
NvidiaのIsaac SimとIsaac Labを用いて四足歩行ロボットの全身制御を強化学習で訓練し、実機のUnitree Go1でゼロショットのsim-to-realを実証した論文。
原題: Isaac Sim-to-Real: Reinforcement Learning based Locomotion for Quadrupeds / Jordan Dowdy, Jean Chagas Vaz
日本語で読む → - 論文ナビゲーションロボティクス
衝突を考慮した非重複パラメータ学習による統一予測と計画
混雑環境でのロボットナビゲーションにおいて、予測と計画を同時に行う統一モデルで生じる表現の衝突(スキル競合)を特定し、タスクごとに重要なパラメータを分離して学習・マージする新しいフレームワークDPTを提案した。
原題: Unified Prediction and Planning via Conflict-Aware Disjoint Parameter Training / Taewon Seo, Seonae Jeon, Giwon Lee 他
日本語で読む →