論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ロボット犬/スキル切り替えロボティクス
OpenGo: リアルタイムスキル切り替えを備えたOpenClawベースのロボット犬
OpenClawを搭載したロボット犬が、タスクや指示に応じてスキルをリアルタイムに切り替えられるシステムを提案。スキルライブラリ、ディスパッチャー、自己学習フレームワークを備え、Unitree Go2で実証した。
原題: OpenGo: An OpenClaw-Based Robotic Dog with Real-Time Skill Switching / Hanbing Li, Xuewei Cao, Zhiwen Zeng 他
日本語で読む → - 論文群制御ロボティクス
パラメトリック不確実性下での協調空中構造物のための感度ベースチューブNMPC
剛体リンクで連結された2機の空中車両チェーンに対し、パラメータ不確実性を考慮した感度ベースのチューブNMPCを提案し、制約の堅牢性を向上させた。
原題: Sensitivity-Based Tube NMPC for Cooperative Aerial Structures Under Parametric Uncertainty / Giuseppe Silano, Quentin Sablé, Marco Tognon 他
日本語で読む → - 論文視覚システムロボティクス
RobotPan: 身体化知覚のための360度全方位ロボット視覚システム
6台のカメラとLiDARを組み合わせ、ロボット周囲を360度カバーする視覚システムを構築し、リアルタイムレンダリング・再構成・ストリーミングを可能にする3Dガウシアン予測フレームワークを提案した。
原題: RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception / Jiahao Ma, Qiang Zhang, Peiran Liu 他
日本語で読む → - 論文ワールドモデルロボティクス
形態条件付けによるハードウェア非依存の四足歩行ワールドモデルに向けて
四足歩行ロボットのワールドモデルを、ロボットの形態情報を明示的に条件付けすることで、異なるハードウェア間でゼロショット汎化可能にする手法を提案した論文。
原題: Toward Hardware-Agnostic Quadrupedal World Models via Morphology Conditioning / Mohamad H. Danesh, Chenhao Li, Amin Abyaneh 他
日本語で読む → - 論文衝突回避ロボティクス
自己中心触覚・近接センサによる人型ロボット衝突回避の観測事前分布
人型ロボットH1-2の全身衝突回避を強化学習で実現し、センサの種類・範囲・配置が回避行動に与える影響をドッジボール課題で分析した。
原題: Egocentric Tactile and Proximity Sensors as Observation Priors for Humanoid Collision Avoidance / Carson Kohlbrenner, Niraj Pudasaini, William Xie 他
日本語で読む → - 論文歩行ロボティクス
リムレスホイールの受動動歩行における安定性原理
重力のみで駆動するリムレスホイールの受動歩行が常に漸近安定となる原理を、運動方程式の線形化とエネルギー保存則の関係から数学的に再考した論文。
原題: Stability Principle Underlying Passive Dynamic Walking of Rimless Wheel / Fumihiko Asano
日本語で読む → - 論文自律走行/深度推定ロボティクス
CADENCE: ナビゲーションと計算効率のための文脈適応型深度推定
自律走行車の組み込み環境向けに、ナビゲーションの必要性と環境文脈に応じて単眼深度推定ネットワークの計算量を動的に調整する適応システムCADENCEを提案し、シミュレーションで消費電力・遅延を削減しつつ航法精度を向上させた。
原題: CADENCE: Context-Adaptive Depth Estimation for Navigation and Computational Efficiency / Timothy K Johnsen, Marco Levorato
日本語で読む → - 論文ナビゲーションロボティクス
航空ロボットのための視覚言語ナビゲーション:大規模言語モデルの時代に向けて
本論文は、航空機(UAV)が自然言語の指示を理解し、3次元環境を自律的にナビゲートする「航空視覚言語ナビゲーション」の分野を概観し、大規模言語モデル(LLM)と視覚言語モデル(VLM)の統合に焦点を当てて、方法論の分類、評価インフラの批判的検討、および7つの未解決問題を提示するサーベイである。
原題: Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models / Xingyu Xia, Lekai Zhou, Yujie Tang 他
日本語で読む → - 論文歩行ロボティクス
RecoverFormer: ヒューマノイドロボットのためのエンドツーエンド接触認識回復
ヒューマノイドロボットが不意の外乱から回復するためのエンドツーエンドポリシーを提案し、補償ステップや環境接触などの回復行動を学習する。
原題: RecoverFormer: End-to-End Contact-Aware Recovery for Humanoid Robots / Zihui Liu
日本語で読む → - 論文自動運転ロボティクス
FeaXDrive: 実現可能性を考慮した軌道中心拡散プランニングによるエンドツーエンド自動運転
拡散プランニングで生成される軌道の物理的実現可能性(局所的な幾何学的歪み、運動学的制約違反、走行可能領域からの逸脱)を改善するため、軌道中心の定式化に基づく適応的曲率制約学習、走行可能領域ガイダンス、実現可能性を考慮したGRPO後訓練を統合した手法を提案した。
原題: FeaXDrive: Feasibility-aware Trajectory-Centric Diffusion Planning for End-to-End Autonomous Driving / Baoyun Wang, Zhuoren Li, Ran Yu 他
日本語で読む → - 論文sim2realロボティクス
Dreamerによるタスク不変特性の学習:四足ロボットの効率的なポリシー転移を実現
シミュレーションから実世界への転移を改善するため、Dreamer世界モデルにタスク不変特性の学習を組み込んだフレームワークDreamTIPを提案し、四足ロボットの複雑な地形での性能を大幅に向上させた。
原題: Learning Task-Invariant Properties via Dreamer: Enabling Efficient Policy Transfer for Quadruped Robots / Junyang Liang, Yuxuan Liu, Yabin Chang 他
日本語で読む → - 論文sim2realロボティクス
固有感覚分布マッチングによる脚式移動のシミュレータ適応
シミュレータと実機の動的差異を、時間整列不要な固有感覚分布のマッチングで補正し、少ない実機データで歩行ポリシーの実機適用性能を向上させる手法を提案した。
原題: Simulator Adaptation for Sim-to-Real Learning of Legged Locomotion via Proprioceptive Distribution Matching / Jeremy Dao, Alan Fern
日本語で読む → - 論文評価フレームワークロボティクス
RoboPlayground: 構造化物理ドメインによるロボット評価の民主化
ロボット操作ポリシーの評価を、固定ベンチマークではなく自然言語でタスクを定義できる構造化物理ドメイン上で行うフレームワークを提案し、ユーザビリティと一般化評価の有効性を示した。
原題: RoboPlayground: Democratizing Robotic Evaluation through Structured Physical Domains / Yi Ru Wang, Carter Ung, Evan Gubarev 他
日本語で読む → - 論文姿勢推定ロボティクス
OMNI-PoseX: 身体化タスクのための高速6D物体姿勢推定ビジョンモデル
オープンワールドで動作する6D物体姿勢推定の基盤モデルを提案し、オープンボキャブラリ認識とSO(3)対応の反射フローマッチングを統合した新規アーキテクチャにより、高精度かつリアルタイムな姿勢推定を実現した。
原題: OMNI-PoseX: A Fast Vision Model for 6D Object Pose Estimation in Embodied Tasks / Michael Zhang, Wei Ying, Fangwen Chen 他
日本語で読む → - 論文ソフトロボティクス/共同設計ロボティクス
EvoGymCM:連続的な材料剛性を活用したソフトロボットの共同設計
ソフトロボットの共同設計において、材料剛性を連続変数として扱う新しいベンチマークEvoGymCMを提案し、形態・材料・制御の同時最適化により性能向上を実証した。
原題: EvoGymCM: Harnessing Continuous Material Stiffness for Soft Robot Co-Design / Le Shen, Kangyao Huang, Wentao Zhao 他
日本語で読む → - 論文物体探索ロボティクス
成長する状態空間とハイブリッド行動領域に基づくPOMDP物体探索
移動ロボットが複雑な屋内環境で目標物体を効率的に見つけるため、物体探索を成長する状態空間とハイブリッド行動空間を持つPOMDPとして定式化し、新しいオンラインソルバーGNPF-kCTを提案した。
原題: POMDP-based Object Search with Growing State Space and Hybrid Action Domain / Yongbo Chen, Hesheng Wang, Shoudong Huang 他
日本語で読む → - 論文組立/強化学習ロボティクス
複合ロボット組立スキル適応のための学習ベース戦略
位置制御マニピュレータによるペグ・イン・ホール組立を対象に、残差強化学習を用いて接触リッチな作業中の適応を実現する、再利用可能な複合スキル戦略を提案した。
原題: Learning-Based Strategy for Composite Robot Assembly Skill Adaptation / Khalil Abuibaid, Aleksandr Sidorenko, Achim Wagner 他
日本語で読む → - 論文自動運転/強化学習ロボティクス
PALCAS: 連合強化学習を用いた自動運転車向け優先度考慮型インテリジェント車線変更アドバイザリーシステム
自動運転車の車線変更を、目的地への緊急度に基づく優先度を考慮しつつ、連合強化学習とPDQNアルゴリズムで協調的に制御するシステムを提案し、シミュレーションで有効性を示した論文。
原題: PALCAS: A Priority-Aware Intelligent Lane Change Advisory System for Autonomous Vehicles using Federated Reinforcement Learning / Yassine Ibork, Nhat Ha Nguyen, Myounggyu Won 他
日本語で読む → - 論文3D再構築ロボティクス
RoomRecon: モバイル端末での高品質テクスチャ付き部屋レイアウト再構築
RGB-Dセンサと生成AIを組み合わせ、モバイル端末上でリアルタイムに部屋の3Dモデルを高品質なテクスチャ付きで再構築するパイプラインを提案した。
原題: RoomRecon: High-Quality Textured Room Layout Reconstruction on Mobile Devices / Seok Joon Kim, Dinh Duc Cao, Federica Spinola 他
日本語で読む → - 論文オフロード航法ロボティクス
オープンソースのLiDAR・単眼カメラ対応オフロード自律航法スタック
オフロード自律航法向けに、LiDARと単眼カメラの両方をサポートするオープンソースの航法スタックを提案。単眼構成では基礎モデルによる深度推定とSLAM計測を組み合わせ、頑健性を向上させた。
原題: An Open-Source LiDAR and Monocular Off-Road Autonomous Navigation Stack / Rémi Marsal, Quentin Picard, Adrien Poiré 他
日本語で読む → - 論文SLAMロボティクス
CALMを保て:視覚幾何基盤モデルとアシスタントアイによるキャリブレーションフリーのキロメートル級SLAM
視覚幾何基盤モデル(VGFM)をキロメートル級SLAMに展開する際、単一の線形変換では非線形な幾何歪みを補正できない問題を解決するため、物理的間隔の事前知識を活用する「アシスタントアイ」とエピポーラ拘束に基づく補正モデルを導入したプラグアンドプレイフレームワークCAL2Mを提案した。
原題: Keep It CALM: Toward Calibration-Free Kilometer-Level SLAM with Visual Geometry Foundation Models via an Assistant Eye / Tianjun Zhang, Fengyi Zhang, Tianchen Deng 他
日本語で読む → - 論文ビジュアルオドメトリロボティクス
HyVGGT-VO: フィードフォワードモデルと密結合したハイブリッド高密度ビジュアルオドメトリ
従来のスパースVOの効率性とフィードフォワードモデルの高密度再構成能力を統合し、VGGTと密結合した新しいビジュアルオドメトリフレームワークを提案。適応的ハイブリッド追跡と階層的最適化により、高速かつ高精度なポーズ推定と高密度マッピングを実現。
原題: HyVGGT-VO: Tightly Coupled Hybrid Dense Visual Odometry with Feed-Forward Models / Junxiang Pan, Lipu Zhou, Baojie Chen
日本語で読む → - 論文教育/強化学習/WebRTCロボティクス
Web-Gewu: ロボット強化学習のためのブラウザベース対話型プレイグラウンド
WebRTCによるクラウド・エッジ連携アーキテクチャを用いて、ブラウザ上で物理シミュレーションと強化学習トレーニングを低コストで実行できるロボット教育プラットフォームを提案した。
原題: Web-Gewu: A Browser-Based Interactive Playground for Robot Reinforcement Learning / Kaixuan Chen, Linqi Ye
日本語で読む → - 論文3D生成画像認識
GenAssets: 潜在空間における実世界3Dアセットの生成
実世界のLiDARとカメラデータから、完全な形状と外観を持つ高品質な3Dアセットを生成する3D潜在拡散モデルを提案した論文。
原題: GenAssets: Generating in-the-wild 3D Assets in Latent Space / Ze Yang, Jingkang Wang, Haowei Zhang 他
日本語で読む → - 論文画像生成ロボティクス
深度依存型光マイクロロボット顕微鏡画像生成のための二重制御周波数認識拡散モデル
光ピンセットで駆動するマイクロロボットの3次元認識向上のため、深度に依存する回折や焦点ぼけを物理的に再現する拡散モデルを提案した。
原題: Dual-Control Frequency-Aware Diffusion Model for Depth-Dependent Optical Microrobot Microscopy Image Generation / Lan Wei, Zongcai Tan, Kangyi Lu 他
日本語で読む → - 論文医療ロボティクスロボティクス
二者間パートナーシップ(DP):医療ロボティクスにおける完全自律への欠けたる環
本論文は、医療ロボットと臨床医が生成AIや高度可視化を用いて知的に対話・協調する「二者間パートナーシップ」という新概念を提案し、部分的自律から完全自律への道筋を示す。
原題: Dyadic Partnership(DP): A Missing Link Towards Full Autonomy in Medical Robotics / Nassir Navab, Zhongliang Jiang
日本語で読む → - 論文タスク計画/能動的知覚ロボティクス
能動的知覚を備えたロボットの計画と状況対応
ロボットの実行中に発生する予期せぬ状況を能動的に知覚し対処するためのフレームワークVAP-TAMPを提案した。視覚言語モデルとシーングラフを活用し、タスクと動作の統合計画を行う。
原題: Robot Planning and Situation Handling with Active Perception / Austine Oloo, Zainab Altaweel, Yohei Hayamizu 他
日本語で読む → - 論文群制御ロボティクス
LiDARを用いた可視エッジ群表現による群衆ナビゲーション
群衆環境でのロボットナビゲーションにおいて、群予測精度は性能にほとんど影響しないことを示し、簡略化した可視エッジ群表現を提案。シミュレーションと実機で安全性・社会性を保ちつつ高速化を実証した。
原題: LiDAR-based Crowd Navigation with Visible Edge Group Representation / Allan Wang, Aaron Steinfeld
日本語で読む → - 論文自動運転/地図生成画像認識
ARETE: HSV変換された群衆車両データを用いた注意機構ベースのラスタ符号化によるトポロジー推定
群衆車両の軌跡データから道路中心線と車線境界線を推定するDETRベースの手法を提案。軌跡をHSV変換したラスタ表現で符号化し、ベクトル化された車線を予測する。
原題: ARETE: Attention-based Rasterized Encoding for Topology Estimation using HSV-transformed Crowdsourced Vehicle Fleet Data / Daniel Fritz, Dimitrios Lagamtzis, Michael Mink 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
ロボットトレーナーは人に楽しまれるか?ペーサーロボットSnoopieのケーススタディ
四足歩行ロボットがランニングのインターバルトレーニングのペーサーとして機能し、ウェアラブル端末と比較してペース順守率と一貫性が向上し、ユーザーにも好意的に受け入れられることを示した。
原題: Will People Enjoy a Robot Trainer? A Case Study with Snoopie the Pacerbot / Maximilian Du, Jennifer Grannen, Shuran Song 他
日本語で読む →