論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
ロボット制御のためのエージェントAI:柔軟だが依然として脆い
推論可能な言語モデルがロボットスキルを選択・実行するエージェント型制御システムを2つの実機で試し、柔軟性と脆弱性の両面を明らかにした。
原題: Agentic AI for Robot Control: Flexible but still Fragile / Oscar Lima, Marc Vinci, Martin Günther 他
日本語で読む → - 論文VLA画像認識
不確実性を考慮した観測再注入による視覚-言語-行動モデルの強化
VLAモデルの言語層の不確実性が高いときに、観測情報を次層のFFNに再注入する訓練不要のプラグインモジュールを提案し、追加データやモジュールなしで行動生成の精度と信頼性を向上させた。
原題: UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models / Jiabing Yang, Yixiang Chen, Yuan Xu 他
日本語で読む → - 論文マニピュレーションロボティクス
HAIC: ダイナミクス認識ワールドモデルによるヒューマノイドの俊敏な物体インタラクション制御
固有受容感覚の履歴のみから物体の速度・加速度を予測し、動的占有マップを構築することで、スケートボードや台車の押し引きなど劣駆動物体との俊敏な全身インタラクションを実現したヒューマノイド制御フレームワーク。
原題: HAIC: Humanoid Agile Object Interaction Control via Dynamics-Aware World Model / Dongting Li, Xingyu Chen, Qianyang Wu 他
日本語で読む → - 論文VLAロボティクス
StemVLA:未来の3D空間幾何学知識と4D履歴表現を備えたオープンソース視覚言語行動モデル
未来の3D空間構造と過去の4D時空間表現を組み合わせて行動予測を行うVLAモデルを提案し、シミュレーションで有効性を示した。
原題: StemVLA:An Open-Source Vision-Language-Action Model with Future 3D Spatial Geometry Knowledge and 4D Historical Representation / Jiasong Xiao, Yutao She, Kai Li 他
日本語で読む → - 論文シーングラフロボティクス
INHerit-SG: 増分階層型セマンティックシーングラフとRAG型検索
ロボットナビゲーション向けに、3D環境を非同期の二重ストリームで階層的なセマンティックシーングラフとして構築し、LLMとトポロジーを組み合わせた検索で複雑な embodied クエリに応答するシステムを提案。
原題: INHerit-SG: Incremental Hierarchical Semantic Scene Graphs with RAG-Style Retrieval / YukTungSamuel Fang, Zhikang Shi, Jiabin Qiu 他
日本語で読む → - 論文群制御cs.GT
準方策近似による混合階層ゲームの効率的解法
混合階層ゲームのKKT条件を高階微分を除去した準方策近似で解く非厳密ニュートン法を提案し、実機とシミュレーションでリアルタイム収束を実証した。
原題: Efficiently Solving Mixed-Hierarchy Games with Quasi-Policy Approximations / Hamzah Khan, Dong Ho Lee, Jingqi Li 他
日本語で読む → - 論文群制御ロボティクス
疎で認識協調型ネットワーク航空ロボットチーム(SpArC-NARTs)の経路計画最適化:最適化ツールと地上センシングカバレッジのユースケース
無線で繋がる航空ロボットチームのための経路計画ツールを提案し、限られた通信・エネルギー・事前情報のもとで協調的に探索・カバレッジを行う手法を検証した。
原題: Path Planning Optimisation for SParse, AwaRe and Cooperative Networked Aerial Robot Teams (SpArC-NARTs): Optimisation Tool and Ground Sensing Coverage Use Cases / Maria Conceição, António Grilo, Meysam Basiri
日本語で読む → - 論文ナビゲーションロボティクス
Sem-NaVAE: 生成的軌道事前分布による意味論誘導型屋外地図なしナビゲーション
CVAEで多様な軌道を生成し、軽量VLMのオープン語彙セグメンテーションで自然言語に基づき軌道を選択する、屋外地図なしナビゲーション手法を提案した。
原題: Sem-NaVAE: Semantically-Guided Outdoor Mapless Navigation via Generative Trajectory Priors / Gonzalo Olguín, Javier Ruiz-del-Solar
日本語で読む → - 論文VLAロボティクス
MapDream:視覚言語ナビゲーションのためのタスク駆動型地図学習
視覚言語ナビゲーションにおいて、ナビゲーション目的に直接最適化されたBEV地図を自己回帰的に生成し、行動予測と統合学習するフレームワークを提案。
原題: MapDream: Task-Driven Map Learning for Vision-Language Navigation / Guoxin Lian, Shuo Wang, Yucheng Wang 他
日本語で読む → - 論文手術シーン再構成画像認識
Diff2DGS: 2Dガウシアンスプラッティングによる遮蔽された手術シーンの信頼性の高い再構成
器具で隠れた組織を拡散モデルで補完し、2Dガウシアンスプラッティングと学習可能な変形モデルで動的な手術シーンを高精度に3D再構成する手法を提案した。
原題: Diff2DGS: Reliable Reconstruction of Occluded Surgical Scenes via 2D Gaussian Splatting / Tianyi Song, Danail Stoyanov, Evangelos Mazomenos 他
日本語で読む → - 論文オドメトリロボティクス
接触を基準とした脚式・車輪脚式ロボットの固有受容オドメトリ
IMUと関節トルクのみから接地を運動学的アンカーとして選定し、足跡記録でドリフトを抑える純固有受容の状態推定器を提案。四足と車輪脚式に統一的に適用できる。
原題: Contact-Anchored Proprioceptive Odometry for Legged and Wheel-Legged Robots / Minxing Sun, Yao Mao
日本語で読む → - 論文VLAロボティクス
WoVR: 幻覚を制御してVLAポリシーを強化学習で事後学習する信頼可能なワールドモデルシミュレータ
不完全な学習済みワールドモデルをシミュレータとして使い、キーフレーム初期化ロールアウトとモデル・ポリシー共進化で幻覚の影響を抑え、VLAポリシーを強化学習で安定に事後学習する手法を提案。
原題: WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL / Zhennan Jiang, Shangqing Zhou, Yutong Jiang 他
日本語で読む → - 論文sim2realロボティクス
物理制約付き形状・姿勢同時最適化によるシミュレーション可能な散乱シーン推定
散らかった実環境から複数物体の形状と姿勢を物理制約下で同時に最適化し、シミュレーション可能なシーンを復元するSPARCSパイプラインを提案。
原題: Simulation-Ready Cluttered Scene Estimation via Physics-aware Joint Shape and Pose Optimization / Wei-Cheng Huang, Jiaheng Han, Xiaohan Ye 他
日本語で読む → - 論文VLAロボティクス
不確実性を考慮したポリシーステアリング:行動・質問・学習の判断
VLM検証器の不確実性を較正し、高信頼行動の実行・自然言語での曖昧性解消・介入要求を選択する枠組みを提案。
原題: When to Act, Ask, or Learn: Uncertainty-Aware Policy Steering / Jessie Yuan, Yilin Wu, Andrea Bajcsy
日本語で読む → - 論文軌道予測cs.MA
ROSA: 多様な交通が混在するラウンドアバウト向けマルチエージェント軌道予測を用いた最適速度アドバイザリ
Transformerで車両と歩行者などの脆弱な道路利用者の将来軌道を予測し、ラウンドアバウトでの衝突を避けるための速度アドバイスをリアルタイムに提供するシステムを開発した。
原題: ROSA: Roundabout Optimized Speed Advisory with Multi-Agent Trajectory Prediction in Multimodal Traffic / Anna-Lena Schlamp, Jeremias Gerner, Klaus Bogenberger 他
日本語で読む → - 論文羽ばたきロボットロボティクス
オンボード姿勢制御を備えた26gの無尾蝶型羽ばたきロボット
26gの無尾蝶型羽ばたきロボット「AirPulse」を開発し、位相領域の羽ばたき制御とオンボード姿勢制御により、非係留でのピッチ・方向追従を実現した。
原題: A 26-Gram Tailless Butterfly-Inspired Flapping-Wing Robot with Onboard Attitude Control / Weibin Gu, Chenrui Feng, Lian Liu 他
日本語で読む → - 論文触覚ロボティクス
Tacmap: 幾何学的に一貫した貫入深さマップによる触覚のsim-to-realギャップの橋渡し
体積的な貫入深さに基づく高忠実・高効率な触覚シミュレーションを提案し、シミュレーションと実世界を共通の変形マップ表現で統合することで触覚のsim-to-realギャップを低減、実機へのゼロショット転移を実現した。
原題: Tacmap: Bridging the Tactile Sim-to-Real Gap via Geometry-Consistent Penetration Depth Map / Lei Su, Zhijie Peng, Renyuan Ren 他
日本語で読む → - 論文自己位置推定画像認識
SOAR: UAV向け回帰ベースLiDAR再位置推定
UAVの任意姿勢・不規則飛行経路に対応する回帰ベースLiDAR再位置推定フレームワークSOARを提案し、大規模UAV LiDARデータセットを構築して従来手法を大幅に上回る精度を実現した。
原題: SOAR: Regression-based LiDAR Relocalization for UAVs / Hengyu Mu, Jianshi Wu, Yuxin Guo 他
日本語で読む → - 論文不確実性定量化機械学習
eCP: 事前学習モデルを用いた同変コンフォーマル予測
群平均化により幾何情報を組み込むことで、コンフォーマル予測の不確実性領域を縮小し、歩行者軌道予測で検証した研究。
原題: eCP: Equivariant Conformal Prediction with pre-trained models / Nikolaos Bousias, Lars Lindemann, George Pappas
日本語で読む → - 論文VLAロボティクス
SCALE: 視覚言語行動モデルのための自己不確実性に基づく適応的知覚と行動
VLAモデルの推論時に自己不確実性を利用し、追加学習や検証器なしで視覚知覚と行動を同時に調整する単一パスの手法を提案。
原題: SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models / Hyeonbeom Choi, Daechul Ahn, Youhan Lee 他
日本語で読む → - 論文歩行ロボティクス
見えた!:生ピクセルからのエンドツーエンドヒューマノイド歩行学習
生の深度画像からヒューマノイドの歩行をエンドツーエンドで学習するフレームワークを提案し、高忠実度深度センサシミュレーションと視覚認識行動蒸留、地形別報酬設計により、実機での多様な地形適応を実現した。
原題: Now You See That: Learning End-to-End Humanoid Locomotion from Raw Pixels / Wandong Sun, Yongbo Su, Leoric Huang 他
日本語で読む → - 論文移動ロボットナビゲーションロボティクス
熱放射場を用いた移動ロボットの火災理解
深度と熱画像から3D点群を作り、シュテファン・ボルツマンの法則で熱放射場を構築し、火災環境での安全なナビゲーションを実現した。
原題: Understanding Fire Through Thermal Radiation Fields for Mobile Robots / Anton R. Wagner, Madhan Balaji Rao, Xuesu Xiao 他
日本語で読む → - 論文軌道計画ロボティクス
SPOT: 未知の動的環境におけるUAVの時空間障害物回避軌道計画
未知の動的環境で飛行するクアッドロータ向けに、視覚ベースの安全飛行回廊生成と時空間軌道最適化を組み合わせたマップレスな反応的計画手法を提案し、バックアップ計画でデッドロック時の衝突も回避する。
原題: SPOT: Spatio-Temporal Obstacle-free Trajectory Planning for UAVs in Unknown Dynamic Environments / Astik Srivastava, Thomas J Chackenkulam, Bitla Bhanu Teja 他
日本語で読む → - 論文ウェアラブルロボティクスロボティクス
出血抑制のための新型ウェアラブルロボティックベストに向けて
形状可変リング機構と膨張式バルーンを組み合わせ、腹部や背部など複雑な部位の出血を抑えるウェアラブルロボットを開発し、模擬出血での止血性能を実証した。
原題: Towards a Novel Wearable Robotic Vest for Hemorrhage Suppression / Harshith Jella, Pejman Kheradmand, Joseph Klein 他
日本語で読む → - 論文マニピュレーションロボティクス
MALLVI: 統合的汎用ロボットマニピュレーションのためのマルチエージェントフレームワーク
自然言語指示と画像からロボットの操作を計画する際、分解・位置推定・思考・反省などの専門エージェントを協調させ、視覚言語モデルによる閉ループフィードバックで汎化性能と成功率を高めるフレームワークを提案。
原題: MALLVI: A Multi-Agent Framework for Integrated Generalized Robotics Manipulation / Mehrshad Taji, Arad Mahdinezhad Kashani, Iman Ahmadi 他
日本語で読む → - 論文知覚ロボティクス
自動運転車カメラの雨天影響を低減する低コストで気候耐性のある空気圧システム
雨天時の自動運転カメラの視界を改善するため、低コストで複数カメラに適用可能な空気圧システムを開発し、歩行者検出精度を8.3%から41.6%に向上させた。
原題: A Cost-Effective and Climate-Resilient Air Pressure System for Rain Effect Reduction on Automated Vehicle Cameras / Mohamed Sabry, Joseba Gorospe, Cristina Olaverri-Monreal
日本語で読む → - 論文水中ロボティクスロボティクス
常駐型水中ロボットのドッキングと持続運用
水深90mに設置したドッキングステーションと小型ROVを用い、USBLとArUcoマーカーによる自律ドッキングと検査ミッションを実現し、90%のドッキング成功率を示した。
原題: Docking and Persistent Operations for a Resident Underwater Vehicle / Leonard Günzel, Gabrielė Kasparavičiūtė, Ambjørn Grimsrud Waldum 他
日本語で読む → - 論文マニピュレーションロボティクス
Pixel2Catch: 単眼RGBカメラによる俊敏なマニピュレーションのためのマルチエージェントSim-to-Real転移
単眼RGB画像のピクセル情報から物体の動きを認識し、アームと多指ハンドを別々のエージェントとして協調学習させるマルチエージェント強化学習で、投げられた物体をキャッチする動作をシミュレーションから実機へ転移させた。
原題: Pixel2Catch: Multi-Agent Sim-to-Real Transfer for Agile Manipulation with a Single RGB Camera / Seongyong Kim, Junhyeon Cho, Kang-Won Lee 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
ReaDy-Go: 動的障害物を伴う環境特化型視覚ナビゲーションのための実世界-シミュレーション動的3Dガウシアンスプラッティング
実環境を3Dガウシアンスプラッティングで再構成し、動く人間アバターを追加した写実的な動的シミュレーションを生成して、動的障害物に頑健な視覚ナビゲーション方策を学習する手法を提案した。
原題: ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles / Seungyeon Yoo, Youngseok Jang, Dabin Kim 他
日本語で読む → - 論文安全規格ロボティクス
産業用ロボットの安全要件の進化:ISO 10218-1/2(2011年版 vs 2025年版)の比較分析とISO/TS 15066の統合
ISO 10218の2011年版と2025年版を比較し、機能安全やサイバーセキュリティの拡充、協働ロボットの新分類、ISO/TS 15066の規範的統合を明らかにした。
原題: Evolution of Safety Requirements in Industrial Robotics: Comparative Analysis of ISO 10218-1/2 (2011 vs. 2025) and Integration of ISO/TS 15066 / Daniel Hartmann, Kristýna Hamříková, Aleš Vysocký 他
日本語で読む →