論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/22 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文シーン再構成ロボティクス
CODA: 単一RGB-D画像からの深度整合シーン補完と物体分解
単一のRGB-D画像からシーン全体の形状を生成し、環境と可動物体に分解する手法。観測点群との整合性を保つ3Dグラウンディング機構により、物体検出に依存せず高精度な再構成を実現する。
原題: CODA: Depth-Aligned Scene Completion and Object Decomposition from a Single RGB-D Image / Dongwon Son, Junhyek Han, Yoontae Cho 他
日本語で読む → - 論文走破性推定ロボティクス
FLINT: 走破性推定のための高速軽量推論
RGBカメラのみを用いた軽量な走破性推定器FLINTを提案し、CPU上で14.7FPSで動作しながら、既存の基盤モデルシステムより高精度なコストマップを生成できることを示した。
原題: FLINT: Fast Lightweight Inference for Traversability / William Bonilla, Maxime Boisvert, David-Alexandre Poissant 他
日本語で読む → - 論文建設機械の自動化ロボティクス
深層Koopman MPCによるホイールローダのVサイクル自動化
ホイールローダの土砂運搬作業(Vサイクル)を自動化するため、幾何学的計画とデータ駆動型Koopmanモデル予測制御を組み合わせた階層フレームワークを提案し、高忠実度シミュレーションで有効性を示した。
原題: Wheel-loader V-Cycle Automation with Deep Koopman MPC / Armin Abdolmohammadi, Navid Mojahed, Dinesh Kumar 他
日本語で読む → - 論文SLAM/オドメトリ評価ロボティクス
オドメトリ評価は共分散を考慮すべき
オドメトリの評価に共分散を組み込んだ厳密に適切なスコアリング規則を提案し、LiDAR慣性オドメトリの過信を検出した。
原題: You Should Be Properly Scoring Your Odometry / Ola Rønning, Usama Saqib, Andrzej Wąsowski
日本語で読む → - 論文VLAロボティクス
MachEmbodied-U0:身体知能のための統合理解・生成モデル
理解と生成の専門家をMixture-of-Transformersで統合し、視覚力学と行動生成をフローマッチングで結びつけた身体知能基盤モデルを提案。LIBEROで99.0%の成功率を達成。
原題: MachEmbodied-U0: Unified Understanding and Generation Model for Embodied Intelligence / Haoran Wen, Wenfu Wang, Kunsong Shi 他
日本語で読む → - 論文動的マニピュレーションロボティクス
MotionForge:動的物体の長期的操作のためのデータ生成パイプラインと大規模ベンチマーク
動的環境でのロボット操作を評価するため、11種類の運動パターンを含む40タスクと長期タスク17件を備えた大規模シミュレーションベンチマークとデータ生成パイプラインを提案し、ドメインシフト下での汎用ポリシーの限界を明らかにした。
原題: MotionForge: A Data Generation Pipeline and Large-Scale Benchmark for Long-Horizon Manipulation of Dynamic Objects with Domain Shifts / Mohan Liu, Dengchen Mei, Haotian Xian 他
日本語で読む → - 論文教育・ヒューマノイド・強化学習ロボティクス
高校生向け強化学習とヒューマノイドロボティクスの教育:低コストオープンプラットフォームにおける専門家検証済みカリキュラム設計
低コストのオープンソースヒューマノイドロボットと強化学習シミュレーションを用いて、高校生が組み立て・シミュレーション・歩行政策学習・実機展開を体験する統合カリキュラムを設計し、専門家による形成的評価を通じて三つの設計上の緊張を明らかにした。
原題: Teaching Reinforcement Learning and Humanoid Robotics to High-School Students: An Expert-Validated Curriculum Design on a Low-Cost Open Platform / Yuanzhe Dong, Jie Cao, Shuman Wang
日本語で読む → - 論文sim2realロボティクス
AgriGen: 農業ロボティクス向け大規模フォトリアルシーン生成フレームワーク
Isaac Sim上に構築したROS統合フレームワークで、作物列・果樹園・ぶどう園などの農業環境をフォトリアルかつ大規模に手続き生成し、物理シミュレーションとドメインランダム化を可能にする。
原題: AgriGen: Large-Scale Scene Generation Framework for Photorealistic Agricultural Robotics Simulation / Utkarsh Bajpai, Serge Tleiji, Cédric Pradalier 他
日本語で読む → - 論文テレオペレーションロボティクス
MATE: ヒューマノイド協調データ収集のためのマルチエージェント仮想テレオペレーションプラットフォーム
地理的に分散した複数の操作者が共有物理環境でヒューマノイドを同時遠隔操作できる仮想プラットフォームを構築し、協調動作の大規模データセットを収集した。
原題: MATE: Multi-Agent Virtual Teleoperation Platform for Humanoid Collaboration Data Collection / Yichuan Yu, Youzhuo Wang, Yiming Ren 他
日本語で読む → - 論文顔匿名化画像認識
HYDRO: 高忠実度ハイブリッド拡散とターゲット指向アプローチによる非可逆的な顔匿名化
ターゲット指向の顔匿名化に拡散モデルを組み合わせ、復元攻撃を防ぐ非可逆的な匿名化手法を提案。
原題: HYDRO: Towards Non-Reversible Face De-Identification Using a High-Fidelity Hybrid Diffusion and Target-Oriented Approach / Felix Rosberg, Vitomir Štruc, Cristofer Englund 他
日本語で読む → - 論文マニピュレーションロボティクス
エンドタスク成功を超えて:ロボティクスにおける視覚経験検索の監査手法
ロボットが過去の経験を再利用する際の選択ルールを、全経験を全シーンで実行して監査する手法を提案し、視覚類似度による選択が特定経験に偏りライブラリ品質に依存することを示した。
原題: Beyond End-Task Success: How to Audit Visual Experience Retrieval in Robotics / Eshika Pathak, Leela Krishna
日本語で読む → - 論文多タスク最適化機械学習
インコンテキスト誘導:数値基盤モデルによるタスク間相乗効果の学習と少数ショット多タスク最適化
数値基盤モデルをインコンテキスト学習で活用し、少数評価予算下での多タスク最適化におけるタスク間関係推定を改善するICG-MTOを提案。ベイズ最適化とMFEA-IIに適用し、ロボットアーム制御でも有効性を示した。
原題: In-Context Guidance: Learning Inter-Task Synergies via Numerical Foundational Models for Few-Shot Multitask Optimization / Tingyang Wei, Haofeng Wu, Jiao Liu 他
日本語で読む → - 論文3D生成画像認識
Fysiverse-3D-Vision: 画像から実行可能な3D世界を生成する統合空間推論フレームワーク
単一画像から物体の意味・形状・配置を統合的に推論し、物理シミュレーション可能な3Dシーンを生成する視覚言語幾何フレームワークを提案。
原題: Fysiverse-3D-Vision Technical Report: Generating Executable 3D Worlds from Images through Unified Spatial Reasoning / Dingkang Yang, Yizhou Liu, Wendong Cheng 他
日本語で読む → - 論文軌道予測ロボティクス
有限集合マルチモーダル軌道予測における目的地サポート復元
歩行者周辺で動作するロボットの軌道予測において、オンライン更新で偏った目的地サンプルを再調整し、限られた予測候補集合の多様性を保つ手法DSRを提案。再学習なしで予測精度を改善。
原題: Destination Support Restoration for Finite-Set Multimodal Trajectory Prediction / Fengrui Liu, Jiajun Peng, Duo Peng 他
日本語で読む → - 論文自動運転知覚画像認識
視覚ベース点群マップ事前情報を活用したカメラによる3D物体検出とオンラインベクトル化HDマッピング
過去のカメラ走行からPi3Xで点群事前マップを構築しDINOv3特徴を付与、実行時にBEVでカメラ特徴と融合して3D物体検出とベクトル化HDマップ生成を改善する手法を提案。
原題: Leveraging Vision-Based Point Cloud Map Priors for Camera-Based 3D Object Detection and Online Vectorized HD Mapping / Markus Käppeler, Rohit Mohan, Abhinav Valada
日本語で読む → - 論文強化学習/エージェントAI
サブタスク分解による強化学習
マルチターンの軌跡報酬をサブタスクごとに分解し、各サブタスクのグループ相対アドバンテージを計算してトークン単位でクレジットを配分するRLDSを提案。エージェント系ベンチマークで有効性を示す。
原題: Reinforcement Learning with Decomposed Subtasks / Mattie Terzolo, Mikolaj Sacha, Ayan Sinha 他
日本語で読む → - 論文マニピュレーションロボティクス
PAKT: 強化学習のための物理的整合性を備えたキネステティック教示
人間がロボットを直接動かして教示する際に、ロボットや方策が物理的に再現できない軌道を防ぐアドミッタンス制御ベースの枠組みを提案し、低頻度のRL行動を高頻度トルク指令に変換する制御スタックを構築した。
原題: PAKT: Physically-Aligned Kinesthetic Teaching for Reinforcement Learning / Lars Johannsmeier, Yashraj Narang
日本語で読む → - 論文マニピュレーションロボティクス
相対接触速度制御による手指機構で巧みな道具操作を実現
人間の道具操作に着想を得て、手指と道具を統合した「ハンド・オブジェクト機構」を定義し、相対接触速度と接触力の制約に基づく運動計画・接触推定フレームワークを開発。5種類のロボットハンドで道具の把持から操作までの一連の動作を実現した。
原題: Relative Contact Velocity-Controlled Hand-Object Mechanism for Dexterous Tool Manipulation / Sunyu Wang, Jean Oh, Nancy S. Pollard
日本語で読む → - 論文マニピュレーションロボティクス
RoboMP-DINOv2: フィルタではなくプロンプトでロバストなロボットマニピュレーション
マスクを視覚フィルタではなく空間プロンプトとして扱うDINOv2ベースの全シーン視覚エンコーダを提案し、外観変化や clutter 下での操作成功率を向上させた。
原題: RoboMP-DINOv2: Prompts, Not Filters for Robust Robot Manipulation / Han Qi, Heng Yang
日本語で読む → - 論文外骨格ロボティクス
ベンチ/バックパック両対応の再構成可能な双方向ケーブル駆動股関節外骨格
ベンチ据置型とバックパック型のアクチュエーションを素早く切り替えられる、共通の装着インターフェースを持つケーブル駆動股関節外骨格を開発し、動作追従性と歩行データ収集を検証した。
原題: A Reconfigurable Bidirectional Cable-Driven Hip Exoskeleton with Swappable Bench/Backpack Dual-configuration Actuation / YuanLong Ji, Shuhan Xiang, Qihan Ye 他
日本語で読む → - 論文マニピュレーションロボティクス
直交ハンド:全直動指による把持内マニピュレーション
直動運動のみで動く指と2つの独立グリッパを組み合わせた7自由度エンドエフェクタを提案し、ネジやピボット構造を持つ物体の操作を実現した。
原題: The Cartesian Hand: In-Hand Manipulation with All-Linear Fingers / Boxi Xia, Bokuan Li, Ryan Shin 他
日本語で読む → - 論文世界モデルロボティクス
TriWorldBench: 三視点整合性で評価する身体性世界モデル
頭部と両手首のカメラ映像を同期させた二腕操作タスクのベンチマークを提案し、視点間の整合性や物理的・時間的一貫性を19指標で評価する。
原題: TriWorldBench: A Tri-View Consistency Perspective on Embodied World Models / Xuanyi Liu, Haofeng Wang, Ruiqi Li 他
日本語で読む → - 論文マニピュレーションロボティクス
双方向LSTM学習とモデル予測パス積分制御による可変形線状物体の操作
ケーブルのような可変形線状物体の操作に向けて、双方向LSTMで動力学モデルを学習し、MPPI制御で操作する手法を提案し、シミュレーションと実験で有効性を示した。
原題: Manipulation of Deformable Linear Objects Using Model Predictive Path Integral Control with Bidirectional Long Short-Term Memory Learning / Lukas Zeh, Johannes Meiwaldt, Zexu Zhou 他
日本語で読む → - 論文VLAロボティクス
CableVLA: ケーブル配線のためのシミュレーション特権的グローバル・ローカル表現学習
シミュレーションの特権情報を活用し、ケーブルのトポロジーと触覚を表現する視覚言語行動フレームワークを提案。ケーブル配線タスクの成功率を62.6%から84.9%に向上させた。
原題: CableVLA: Simulation-Privileged Global-Local Representation Learning for Cable Routing / Zhifei Teng, Bo Feng, Xiang Zou 他
日本語で読む → - 論文遠隔操作ロボティクス
デジタルツイン駆動VR遠隔操作:多視点空間知覚による手術ロボット支援
手術環境をマーカーレスで認識してデジタルツインを構築し、HMDに多視点表示することで、従来の内視鏡視点の制限を克服するVR遠隔操作プラットフォームを提案。dVRKでのユーザー研究で経路長86%減、ジャーク95%減を達成。
原題: Digital Twin-Driven VR Teleoperation with Multi-View Spatial Perception for Surgical Robots / Chang Liu, Chenhao Yu, Honghao Zhao 他
日本語で読む → - 論文歩行ロボティクス
踏み出す前に予測せよ:疎な誘導下での動的障害物回避のための検証可能な占有予測
脚ロボットが疎なウェイポイント誘導下で動く障害物を避けるため、LiDAR履歴から将来の占有マップを予測し速度選択に用いる局所回避ポリシーLOOPを提案し、シミュレーションと実機で有効性を示した。
原題: Predict Before You Step: Auditable Occupancy Forecasting for Dynamic Obstacle Avoidance under Sparse Guidance / Yuhui Mao, Fen Liu, Shenghai Yuan 他
日本語で読む → - 論文テレオペレーションロボティクス
Astrobee用テレオペ自由飛行マニピュレーションのための展開可能な4指ペイロード
国際宇宙ステーション内の自由飛行ロボットAstrobeeに搭載する4指ハンドと、VRによる遠隔操作パイプラインを提案し、無重力シミュレータで貨物輸送タスクの予備実験を行った。
原題: A Deployable Four-Finger Payload for Teleoperated Free-Flying Manipulation with Astrobee / William Su, Jordan Kam, Yunosuke Nakamura 他
日本語で読む → - 論文協調認識/3D多物体追跡ロボティクス
CDKF-Track: クラスタ対応データ駆動型カルマンフィルタによる協調3D多物体追跡
複数車両のLiDAR検出をグラフラプラシアンで融合し、クラスタ単位で冗長検出を削減した上で、データから運動ダイナミクスを学習するカルマンフィルタとウェーブレット時間補正で協調3D多物体追跡を行うフレームワーク。
原題: CDKF-Track: Cluster-aware Data-Driven Kalman Filtering for Cooperative 3D Multi-Object Tracking / Maria Damanaki, Nikos Piperigkos, Alexandros Gkillas 他
日本語で読む → - 論文VLA画像認識
Metric-Bench: 屋内シーンにおけるVLMの文脈内空間メトリック推論の探究
画像内の参照物体を手がかりに、カメラ内部パラメータなしでVLMが2Dから3Dへのメトリック推論を行うベンチマークと強化学習微調整手法を提案。
原題: Metric-Bench: Exploring In-context Spatial Metric Reasoning in VLMs for Indoor Scenes / Yuling Xi, Haokai Zhang, Muzhi Zhu 他
日本語で読む → - 論文マニピュレーションロボティクス
DynaForge: 動的マニピュレーションのデモ生成のための計画誘導型残差学習
低周波の大域計画と高周波の物体中心逆運動学を組み合わせ、残差方策で接触時の動的相互作用を補正することで、動的物体操作の高品質なデモンストレーションを生成するフレームワーク。
原題: DynaForge: Planning-Guided Residual Learning for Dynamic Manipulation Demonstration Generation / Yiyang Jin, Yu Zheng, Xiao He 他
日本語で読む →