論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文4D占有追跡画像認識
4Dパノプティック占有追跡のための潜在ガウススプラッティング
動的環境の4D時空間構造を捉えるため、3D特徴を動的なガウス点群として表現し、多視点特徴を集約して占有追跡を行う手法を提案。
原題: Latent Gaussian Splatting for 4D Panoptic Occupancy Tracking / Maximilian Luz, Rohit Mohan, Thomas Nürnberg 他
日本語で読む → - 論文跳躍/車輪脚ロボットロボティクス
NMPCとDE最適化による四脚車輪脚ロボットの跳躍制御
車輪付き四脚ロボットの跳躍を実現するため、NMPCによる移動制御とDEによる軌道最適化を組み合わせた制御フレームワークを提案し、実機で前方跳躍やバク宙を検証した。
原題: Jumping Control for a Quadrupedal Wheeled-Legged Robot via NMPC and DE Optimization / Xuanqi Zeng, Lingwei Zhang, Linzhu Yue 他
日本語で読む → - 論文VLA画像認識
視覚と言語:自動運転の安全性評価と計画のための新表現とAI
視覚言語モデルを自動運転に応用し、危険検知・軌道計画・言語指示による制約の3事例を検証した研究。
原題: Vision and Language: Novel Representations and Artificial intelligence for Driving Scene Safety Assessment and Autonomous Vehicle Planning / Ross Greer, Maitrayee Keskar, Angel Martinez-Sanchez 他
日本語で読む → - 論文群制御ロボティクス
ロボット群における遭遇駆動型情報拡散のミクロ・マクロモデル
ロボット同士が出会った時のみ情報交換する状況での情報拡散を、平均自由行程を一般化したミクロモデルと全体動態を捉えるマクロモデルで記述し、シミュレーションで検証した。
原題: A Micro-Macro Model of Encounter-Driven Information Diffusion in Robot Swarms / Davis S. Catherman, Carlo Pinciroli
日本語で読む → - 論文医療ロボット/連続体ロボット/深層学習制御ロボティクス
内視鏡的粘膜下層剥離術のための分離型2セグメント連続体ロボットの深層学習制御
内視鏡的粘膜下層剥離術(ESD)用に、分離構造の2セグメント連続体ロボットと手術鉗子を開発し、GRUベースの深層学習制御器で先端位置・姿勢を高精度に制御した。
原題: Deep-Learning-Based Control of a Decoupled Two-Segment Continuum Robot for Endoscopic Submucosal Dissection / Yuancheng Shao, Yao Zhang, Jia Gu 他
日本語で読む → - 論文状態推定ロボティクス
ノイズ除去粒子フィルタ:単一ステップ目的関数による状態推定の学習
マルコフ性を活かし、単一の状態遷移から学習する粒子フィルタを提案。ノイズ除去スコアマッチングで測定モデルを暗黙的に学習し、推論時は学習済みデノイザとダイナミクスモデルでベイズフィルタを近似する。
原題: Denoising Particle Filters: Learning State Estimation with Single-Step Objectives / Lennart Röstel, Berthold Bäuml
日本語で読む → - 論文3D再構成画像認識
UniScale:ロボット知覚のための事前情報注入による統一スケール対応多視点3D再構成
多視点画像からカメラ内部・外部パラメータ、スケール不変な深度と点群、実スケールを単一のフィードフォワードネットワークで推定し、既存モデルの事前情報を活用してロボット向け3D再構成を高精度化するフレームワーク。
原題: UniScale: Unified Scale-Aware 3D Reconstruction for Multi-View Understanding via Prior Injection for Robotic Perception / Mohammad Mahdavian, Gordon Tan, Binbin Xu 他
日本語で読む → - 論文ロコマニピュレーションロボティクス
EgoHumanoid:ロボット不要の一人称デモで実世界ロコマニピュレーションを実現
人間の一人称視点デモと少量のロボットデータを共訓練し、視点・動作のずれを補正することで、ヒューマノイドの実世界ロコマニピュレーション性能を51%向上させた。
原題: EgoHumanoid: Unlocking In-the-Wild Loco-Manipulation with Robot-Free Egocentric Demonstration / Modi Shi, Shijia Peng, Jin Chen 他
日本語で読む → - 論文sim2realロボティクス
ヒューマノイドロボットのための人間らしいバドミントンスキルの学習
人間の動作データを強化学習で蒸留し、バドミントンのリフトやドロップショットなどのスキルをヒューマノイドロボットにゼロショットでsim-to-real転移させた研究。
原題: Learning Human-Like Badminton Skills for Humanoid Robots / Yeke Chen, Shihao Dong, Xiaoyu Ji 他
日本語で読む → - 論文群制御ロボティクス
SKYSURF: 協調型空中グライダーによる持続的監視のための自己学習フレームワーク
上昇気流からエネルギーを得るグライダー型UAV群を協調させ、自己学習で経路追従制御を最適化し、長時間の監視と目標検出を省電力で実現する手法を提案。
原題: SKYSURF: A Self-learning Framework for Persistent Surveillance using Cooperative Aerial Gliders / Houssem Eddine Mohamadi, Nadjia Kara
日本語で読む → - 論文モデル予測制御ロボティクス
二次モデル近似による分散低減モデル予測パス積分
MPPIのサンプリングに二次近似モデルを事前分布として組み込み、残差項の分散を抑えることで少ないサンプル数でも高精度な制御を実現する手法を提案。
原題: Variance-Reduced Model Predictive Path Integral via Quadratic Model Approximation / Fabian Schramm, Franki Nguimatsia Tiofack, Nicolas Perrin-Gilbert 他
日本語で読む → - 論文視覚的場所認識ロボティクス
分位点転送による視覚的場所認識の信頼性の高い動作点選択
視覚的場所認識システムの動作点(マッチング閾値)を、キャリブレーション走行と分位点正規化を用いて自動推定し、環境変化に適応させる手法を提案。
原題: Quantile Transfer for Reliable Operating Point Selection in Visual Place Recognition / Dhyey Manish Rajani, Michael Milford, Tobias Fischer
日本語で読む → - 論文視触覚/マニピュレーションロボティクス
UniVTAC: 視触覚マニピュレーションのデータ生成・学習・評価を統合するシミュレーションプラットフォーム
3種類の視触覚センサに対応したシミュレーション基盤で接触データを大量生成し、視触覚エンコーダと8タスクのベンチマークを提供して、触覚駆動型マニピュレーションの学習と評価を可能にした。
原題: UniVTAC: A Unified Simulation Platform for Visuo-Tactile Manipulation Data Generation, Learning, and Benchmarking / Baijun Chen, Weijie Wan, Tianxing Chen 他
日本語で読む → - 論文筋骨格ヒューマノイドロボティクス
筋骨格ヒューマノイドにおける筋肉の特性・管理・活用:KengoroとMusashiに関する実証研究
筋骨格ヒューマノイドKengoroとMusashiの研究を基に、筋肉の特性を5つに分類し、その管理・活用法を整理した実証研究。
原題: Characteristics, Management, and Utilization of Muscles in Musculoskeletal Humanoids: Empirical Study on Kengoro and Musashi / Kento Kawaharazuka, Kei Okada, Masayuki Inaba
日本語で読む → - 論文3Dビジョン最適化画像認識
3Dビジョンのための大域ソルバーの進展
3Dビジョンにおける非凸幾何最適化を証明可能な解で解く大域ソルバー(BnB・凸緩和・GNC)を初めて体系的にサーベイし、10の視覚タスクを通じて最適性・頑健性・スケーラビリティのトレードオフと今後の方向性を示した。
原題: Advances in Global Solvers for 3D Vision / Zhenjun Zhao, Heng Yang, Bangyan Liao 他
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
Co-jump: 四足歩行ロボットのマルチエージェント強化学習による協調ジャンプ
2台の四足歩行ロボットが通信なしに同期して、単体では不可能な高さのジャンプを実現する協調制御を、マルチエージェント強化学習とカリキュラム学習で獲得した。
原題: Co-jump: Cooperative Jumping with Quadrupedal Robots via Multi-Agent Reinforcement Learning / Shihao Dong, Yeke Chen, Zeren Luo 他
日本語で読む → - 論文ナビゲーションロボティクス
OVerSeeC: 衛星画像と自然言語からのオープンボキャブラリ・コストマップ生成
衛星画像と自然言語の指示から、LLMとオープンボキャブラリ・セグメンテーションを組み合わせて、未知の地形やミッション固有の走行ルールに対応した実行可能なコストマップをゼロショットで生成するフレームワーク。
原題: OVerSeeC: Open-Vocabulary Costmap Generation from Satellite Images and Natural Language / Rwik Rana, Jesse Quattrociocchi, Dongmyeong Lee 他
日本語で読む → - 論文安全最適制御ロボティクス
安全な最適制御におけるタスク論理のためのベルマン価値分解
時相論理で記述された複雑なタスクのベルマン価値を、到達回避・回避・新たに提案する到達回避ループの各ベルマン方程式で結ばれたグラフに分解し、それを二層ニューラルネットに埋め込むVDPPOを提案。高次元タスクで安全性と活性を自動的に両立させ、既存手法を大きく上回る性能を示した。
原題: Bellman Value Decomposition for Task Logic in Safe Optimal Control / William Sharpless, Oswin So, Dylan Hirsch 他
日本語で読む → - 論文マニピュレーションロボティクス
SafeFlowMPC: 学習ベース方策と予測的安全軌道計画を統合したマニピュレータ制御
フローマッチングによる学習方策とオンライン最適化を組み合わせ、7自由度マニピュレータの把持と動的な人間-ロボット間ハンドオーバーで安全性とリアルタイム性を両立させた。
原題: SafeFlowMPC: Predictive and Safe Trajectory Planning for Robot Manipulators with Learning-based Policies / Thies Oelerich, Gerald Ebmer, Christian Hartl-Nesic 他
日本語で読む → - 論文強化学習ロボティクス
マルチモーダルエージェントによるロボット強化学習の加速
人間の代わりにマルチモーダルエージェントが修正ウェイポイントや空間制約を与え、ロボットの強化学習を効率化するAGPSを提案。
原題: Accelerating Robotic Reinforcement Learning with Agent Guidance / Haojun Chen, Zili Zou, Chengdong Ma 他
日本語で読む → - 論文クロスビュー地理的位置推定画像認識
(MGS)²-Net:微視的幾何スケールと巨視的幾何構造を統合したクロスビュー地理的位置推定
斜めの航空写真と衛星写真の幾何学的なずれに対処するため、深度情報でスケールを補正し、幾何学的勾配で建物のファサードを除去する新手法を提案し、クロスビュー地理的位置推定で最高精度を達成した。
原題: (MGS)$^2$-Net: Unifying Micro-Geometric Scale and Macro-Geometric Structure for Cross-View Geo-Localization / Minglei Li, Mengfan He, Chunyu Li 他
日本語で読む → - 論文マニピュレーションロボティクス
接触を活用した部分充填コンテナへのパッキング
倉庫のビンパッキングにおいて、既に一部が充填されたコンテナに新たな物品を配置するため、接触を積極的に利用して空間を創出する手法を提案した。
原題: Pack it in: Packing into Partially Filled Containers Through Contact / David Russell, Zisong Xu, Maximo A. Roa 他
日本語で読む → - 論文深度補完ロボティクス
未見のフィールドロボティクス環境における極めて疎な深度計測を用いた深度補完
合成データで学習し、極めて疎な深度センサ計測から未見のフィールド環境で密なメートル深度を予測する深度補完モデルを提案。
原題: Depth Completion in Unseen Field Robotics Environments Using Extremely Sparse Depth Measurements / Marco Job, Thomas Stastny, Eleni Kelasidi 他
日本語で読む → - 論文マニピュレーションロボティクス
食品廃棄物選別ロボットのための実環境クラッター把持性能評価ベンチマーク
食品廃棄物選別における不純物除去のため、実環境のクラッター把持性能を評価するベンチマークGRABを提案し、3種のグリッパで1750回の把持試行を行い、把持可否の支配要因と失敗モードを分析した。
原題: A Real-World Grasping-in-Clutter Performance Evaluation Benchmark for Robotic Food Waste Sorting / Moniesha Thilakarathna, Xing Wang, Min Wang 他
日本語で読む → - 論文VLAロボティクス
WoVR: 幻覚を制御してVLAポリシーを強化学習で事後学習する信頼可能なワールドモデルシミュレータ
不完全な学習済みワールドモデルをシミュレータとして使い、キーフレーム初期化ロールアウトとモデル・ポリシー共進化で幻覚の影響を抑え、VLAポリシーを強化学習で安定に事後学習する手法を提案。
原題: WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL / Zhennan Jiang, Shangqing Zhou, Yutong Jiang 他
日本語で読む → - 論文組立/強化学習ロボティクス
設計図なしで安定構造物を自律組立するロボットの学習
強化学習により、事前設計図に頼らず目標と障害物だけから安定したブロック構造物を組み立てる自律ロボット組立フレームワークを提案し、実機実験で有効性を示した。
原題: Learning to Build: Autonomous Robotic Assembly of Stable Structures Without Predefined Plans / Jingwen Wang, Johannes Kirschner, Paul Rolland 他
日本語で読む → - 論文VLAロボティクス
RDT2:UMIデータのスケーリング限界を探り、ゼロショットのクロスエンボディメント汎化を実現
7BパラメータのVLMを基盤とし、1万時間超のUMIデータと3段階学習で、未知の物体・シーン・指示・ロボット機体にゼロショットで汎化するロボット基盤モデルを構築した。
原題: RDT2: Exploring the Scaling Limit of UMI Data Towards Zero-Shot Cross-Embodiment Generalization / Songming Liu, Bangguo Li, Kai Ma 他
日本語で読む → - 論文模倣学習ロボティクス
フローを活用した少数ショット模倣学習における人間デモンストレーションへの汎化
シーンフロー予測とフロー・クロップ点群条件付きポリシーを組み合わせ、人間の動画のみで見られるシナリオへの汎化を実現した少数ショット模倣学習手法を提案。
原題: Flow-Enabled Generalization to Human Demonstrations in Few-Shot Imitation Learning / Runze Tang, Penny Sweetser
日本語で読む → - 論文群制御ロボティクス
未来方向を考慮した群れ制御:速度予測による先読み型フロッキング
鳥の群れの姿勢変化に着想を得て、隣接エージェントの将来速度を予測して反応型フロッキングに先読み項を加える手法を提案し、遅延やノイズに対するロバスト性と整列性能の向上をシミュレーションで示した。
原題: FDA Flocking: Future Direction-Aware Flocking via Velocity Prediction / Hossein B. Jond, Martin Saska
日本語で読む → - 論文オドメトリロボティクス
接触を基準とした脚式・車輪脚式ロボットの固有受容オドメトリ
IMUと関節トルクのみから接地を運動学的アンカーとして選定し、足跡記録でドリフトを抑える純固有受容の状態推定器を提案。四足と車輪脚式に統一的に適用できる。
原題: Contact-Anchored Proprioceptive Odometry for Legged and Wheel-Legged Robots / Minxing Sun, Yao Mao
日本語で読む →