論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
食品廃棄物選別ロボットのための実環境クラッター把持性能評価ベンチマーク
食品廃棄物選別における不純物除去のため、実環境のクラッター把持性能を評価するベンチマークGRABを提案し、3種のグリッパで1750回の把持試行を行い、把持可否の支配要因と失敗モードを分析した。
原題: A Real-World Grasping-in-Clutter Performance Evaluation Benchmark for Robotic Food Waste Sorting / Moniesha Thilakarathna, Xing Wang, Min Wang 他
日本語で読む → - 論文手術シーン再構成画像認識
Diff2DGS: 2Dガウシアンスプラッティングによる遮蔽された手術シーンの信頼性の高い再構成
器具で隠れた組織を拡散モデルで補完し、2Dガウシアンスプラッティングと学習可能な変形モデルで動的な手術シーンを高精度に3D再構成する手法を提案した。
原題: Diff2DGS: Reliable Reconstruction of Occluded Surgical Scenes via 2D Gaussian Splatting / Tianyi Song, Danail Stoyanov, Evangelos Mazomenos 他
日本語で読む → - 論文VLAロボティクス
SCALE: 視覚言語行動モデルのための自己不確実性に基づく適応的知覚と行動
VLAモデルの推論時に自己不確実性を利用し、追加学習や検証器なしで視覚知覚と行動を同時に調整する単一パスの手法を提案。
原題: SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models / Hyeonbeom Choi, Daechul Ahn, Youhan Lee 他
日本語で読む → - 論文マニピュレーションロボティクス
自己駆動型実験室におけるロボットマニピュレータのための視覚誘導初期化を伴うアドミタンスベース動作計画
自己駆動型実験室での安全で適応的なロボット操作を実現するため、アドミタンス制御を軌道実行に組み込み、視覚による初期位置推定で参照軌道を生成する動作計画フレームワークを提案した。
原題: Admittance-Based Motion Planning with Vision-Guided Initialization for Robotic Manipulators in Self-Driving Laboratories / Shifa Sulaiman, Tobias Jensen, Francesco Schetter 他
日本語で読む → - 論文ナビゲーションロボティクス
部分観測環境における自律地上ロボットナビゲーションのための時間サンプリング効率的適応ステートラティス
部分観測環境で地域プランナの出力が急変する問題に対し、過去の軌道と現在の軌道を比較・調停するTSEASLを提案し、手動介入なしで安定したナビゲーションを実現した。
原題: Temporally-Sampled Efficiently Adaptive State Lattices for Autonomous Ground Robot Navigation in Partially Observed Environments / Ashwin Satish Menon, Eric R. Damm, Eli S. Lancaster 他
日本語で読む → - 論文知覚ロボティクス
自動運転車カメラの雨天影響を低減する低コストで気候耐性のある空気圧システム
雨天時の自動運転カメラの視界を改善するため、低コストで複数カメラに適用可能な空気圧システムを開発し、歩行者検出精度を8.3%から41.6%に向上させた。
原題: A Cost-Effective and Climate-Resilient Air Pressure System for Rain Effect Reduction on Automated Vehicle Cameras / Mohamed Sabry, Joseba Gorospe, Cristina Olaverri-Monreal
日本語で読む → - 論文移動ロボットナビゲーションロボティクス
熱放射場を用いた移動ロボットの火災理解
深度と熱画像から3D点群を作り、シュテファン・ボルツマンの法則で熱放射場を構築し、火災環境での安全なナビゲーションを実現した。
原題: Understanding Fire Through Thermal Radiation Fields for Mobile Robots / Anton R. Wagner, Madhan Balaji Rao, Xuesu Xiao 他
日本語で読む → - 論文水中ロボティクスロボティクス
常駐型水中ロボットのドッキングと持続運用
水深90mに設置したドッキングステーションと小型ROVを用い、USBLとArUcoマーカーによる自律ドッキングと検査ミッションを実現し、90%のドッキング成功率を示した。
原題: Docking and Persistent Operations for a Resident Underwater Vehicle / Leonard Günzel, Gabrielė Kasparavičiūtė, Ambjørn Grimsrud Waldum 他
日本語で読む → - 論文タスク計画ロボティクス
未知物体を含むタスク計画のための学習ベース物体探索フレームワーク
物体の位置が不明な環境で、学習ベースの物体探索をタスク計画に統合し、探索と実行を交互に行う計画手法を提案。
原題: Effective Task Planning with Missing Objects using Learning-Informed Object Search / Raihan Islam Arnob, Max Merlin, Abhishek Paudel 他
日本語で読む → - 論文軌道計画ロボティクス
SPOT: 未知の動的環境におけるUAVの時空間障害物回避軌道計画
未知の動的環境で飛行するクアッドロータ向けに、視覚ベースの安全飛行回廊生成と時空間軌道最適化を組み合わせたマップレスな反応的計画手法を提案し、バックアップ計画でデッドロック時の衝突も回避する。
原題: SPOT: Spatio-Temporal Obstacle-free Trajectory Planning for UAVs in Unknown Dynamic Environments / Astik Srivastava, Thomas J Chackenkulam, Bitla Bhanu Teja 他
日本語で読む → - 論文強化学習/世界モデルロボティクス
効率的な一次強化学習のための局所・大域世界モデルの結合
大規模拡散モデルによる世界モデル内で強化学習を行い、軽量な潜在空間サロゲートで勾配計算を効率化する一次勾配法を提案。Push-Tタスクや四足歩行ロボットの物体操作でPPOを上回るサンプル効率を実現。
原題: Coupled Local and Global World Models for Efficient First Order RL / Joseph Amigo, Rooholla Khorrambakht, Nicolas Mansard 他
日本語で読む → - 論文マニピュレーションロボティクス
非線形FEAベースMPCとEKF多センサ融合による磁気駆動カプセルロボットのピッチ角制御
4コイル電磁アレイで駆動するカプセルロボットのピッチ角を、FEAに基づく非線形MPCとEKFセンサ融合で制御し、低カメラ更新率でも安定な姿勢制御を実現した。
原題: Pitch Angle Control of a Magnetically Actuated Capsule Robot with Nonlinear FEA-based MPC and EKF Multisensory Fusion / Chongxun Wang, Zikang Shen, Apoorav Rathore 他
日本語で読む → - 論文制御/強化学習制御
クープマン作用素とリアプノフ制約による安全な強化学習
クープマン作用素で誤差ダイナミクスを線形化し、DAREから制御リアプノフ関数を導出してSACに制約として組み込み、軌道追従と安定化を保証する手法を提案。
原題: LC-SAC: Lyapunov-Constrained Soft Actor-Critic via Koopman Operator Theory for Trajectory Tracking and Stabilization / Dhruv S. Kushwaha, Zoleikha A. Biron
日本語で読む → - 論文VLAロボティクス
Action-to-Actionフローマッチング:固有感覚履歴を起点とした高速ロボット方策
ランダムノイズではなく過去の固有感覚行動を起点にフローマッチングで行動生成する方策を提案し、1ステップ推論と高い汎化性能を実現した。
原題: Action-to-Action Flow Matching / Jindou Jia, Gen Li, Xiangyu Chen 他
日本語で読む → - 論文歩行ロボティクス
PMG: 人間らしい歩行制御のためのパラメータ化モーション生成器
人間の動作構造を基に、少数のパラメータ化データと高次元コマンドからリアルタイムに参照軌道を生成し、模倣学習とsim-to-real同定を組み合わせてヒューマノイドZERITH Z1で自然な歩行とVRテレオペを実現した。
原題: PMG: Parameterized Motion Generator for Human-like Locomotion Control / Chenxi Han, Yuheng Min, Zihao Huang 他
日本語で読む → - 論文群制御physics.soc-ph
UAV群による高速道路・市街地統合軌跡データセットSWIFTraj 第II部:グラフベースの軌跡接続手法
UAV群で撮影した複数動画間の車両軌跡を、グラフ表現と時間同期・ハンガリアン法によるマッチングで接続し、長距離連続軌跡を生成する手法を提案した。
原題: The Swarm Intelligence Freeway-Urban Trajectories (SWIFTraj) Dataset -- Part II: A Graph-Based Approach for Trajectory Connection / Xinkai Ji, Pan Liu, Ying Yang 他
日本語で読む → - 論文セグメンテーション画像認識
言葉を通して道路を見る:言語誘導型RGB-T走行シーンセグメンテーション
視覚言語モデルの事前知識を活用し、照明条件に応じてRGBと熱画像の融合戦略を動的に切り替える走行シーンセグメンテーション手法を提案し、MFNetでSOTAを達成した。
原題: Seeing Roads Through Words: A Language-Guided Framework for RGB-T Driving Scene Segmentation / Ruturaj Reddy, Hrishav Bakul Barua, Junn Yong Loo 他
日本語で読む → - 論文飛行力学ロボティクス
SO(3)上の幾何学的逆飛行力学とテザー固定翼機への応用
固定翼機の逆飛行力学をSO(3)上で座標フリーに定式化し、協調飛行を仮定して軌道から姿勢・角速度・推力・迎角への閉形式写像を導出、テザー飛行の解析解や最小推力迎角の閉形式も示した。
原題: Geometric Inverse Flight Dynamics on SO(3) and Application to Tethered Fixed-Wing Aircraft / Antonio Franchi, Chiara Gabellieri
日本語で読む → - 論文接触シミュレーションロボティクス
滑らかに微分可能で効率的にベクトル化可能な接触マニフォールド生成
ロボティクス向けに、微分可能かつベクトル化可能な接触マニフォールド生成フレームワークを提案し、Mujoco XLAと比較して大幅な高速化を実現した。
原題: Smoothly Differentiable and Efficiently Vectorizable Contact Manifold Generation / Onur Beker, Andreas René Geist, Anselm Paulus 他
日本語で読む → - 論文ナビゲーションロボティクス
跳ぶべき時を学ぶオフロードナビゲーション
地形ごとの走行コストを速度の関数としてモデル化し、溝を跳び越えるなど速度に応じた安全な経路計画を実現した研究。
原題: Learning When to Jump for Off-road Navigation / Zhipeng Zhao, Taimeng Fu, Shaoshu Su 他
日本語で読む → - 論文軌道計画ロボティクス
複合バーンスタイン多項式による測地線方程式の解法と軌道計画
複合バーンスタイン多項式を用いて、障害物を連続コスト場として表現し、測地線制約を満たす滑らかで衝突のない軌道を効率的に生成する手法を提案した。
原題: Solving Geodesic Equations with Composite Bernstein Polynomials for Trajectory Planning / Nick Gorman, Gage MacLin, Maxwell Hammond 他
日本語で読む → - 論文ヒューマノイドロボティクス
ヒューマノイド・ファクターズ:人間世界でAIヒューマノイドを設計するための原則
人間と共存するAI搭載ヒューマノイドの設計・評価・統治のための「ヒューマノイド・ファクターズ」という枠組みを、物理・認知・社会・倫理の4本柱で提案し、実世界の制御アルゴリズム評価に適用した論文。
原題: Humanoid Factors: Design Principles for AI Humanoids in Human Worlds / Xinyuan Liu, Eren Sadikoglu, Ransalu Senanayake 他
日本語で読む → - 論文マニピュレーションロボティクス
MALLVI: 統合的汎用ロボットマニピュレーションのためのマルチエージェントフレームワーク
自然言語指示と画像からロボットの操作を計画する際、分解・位置推定・思考・反省などの専門エージェントを協調させ、視覚言語モデルによる閉ループフィードバックで汎化性能と成功率を高めるフレームワークを提案。
原題: MALLVI: A Multi-Agent Framework for Integrated Generalized Robotics Manipulation / Mehrshad Taji, Arad Mahdinezhad Kashani, Iman Ahmadi 他
日本語で読む → - 論文VLAロボティクス
自己教師ありブートストラップによる行動予測的な身体性推論
VLAモデルの身体性Chain-of-Thought推論を、外部報酬や人手注釈なしに自己教師ありで洗練し、操作・歩行ナビ・自動運転で性能を向上させる手法を提案。
原題: Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning / Milan Ganai, Katie Luo, Jonas Frey 他
日本語で読む → - 論文3D占有予測/マルチセンサフュージョン画像認識
TFusionOcc: Tプリミティブベースの物体中心マルチセンサフュージョンによる3D占有予測
自動運転向けの3D意味占有予測において、Studentのt分布に基づくTプリミティブ(変形可能なT超二次曲面など)を導入し、カメラとLiDARを密結合で融合する物体中心フレームワークを提案。nuScenesで最先端性能、nuScenes-Cで高い頑健性を示した。
原題: TFusionOcc: T-Primitive Based Object-Centric Multi-Sensor Fusion Framework for 3D Occupancy Prediction / Zhenxing Ming, Yaoqi Huang, Julie Stephany Berrio 他
日本語で読む → - 論文歩行ナビゲーションロボティクス
TRANS: 社会的相互作用下での四足歩行ロボットの敏捷なナビゲーションのための地形認識強化学習
四足歩行ロボットが不整地を移動しながら人混みの中をナビゲートするための、地形認識と社会的相互作用を統合した2段階強化学習フレームワークを提案し、シミュレーションと実機で有効性を示した。
原題: TRANS: Terrain-aware Reinforcement Learning for Agile Navigation of Quadruped Robots under Social Interactions / Wei Zhu, Irfan Tito Kurniawan, Ye Zhao 他
日本語で読む → - 論文VLAロボティクス
MVP-LAM: 視点間再構成による行動中心の潜在行動学習
複数視点の動画を用いて、ある視点の潜在行動が別視点の未来を説明するように学習させ、真の行動と強く相関する行動中心の潜在行動を獲得する手法を提案。VLA事前学習に用いることで下流のマニピュレーション性能を向上させた。
原題: MVP-LAM: Learning Action-Centric Latent Action via Cross-Viewpoint Reconstruction / Jung Min Lee, Dohyeok Lee, Seokhun Ju 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
ReaDy-Go: 動的障害物を伴う環境特化型視覚ナビゲーションのための実世界-シミュレーション動的3Dガウシアンスプラッティング
実環境を3Dガウシアンスプラッティングで再構成し、動く人間アバターを追加した写実的な動的シミュレーションを生成して、動的障害物に頑健な視覚ナビゲーション方策を学習する手法を提案した。
原題: ReaDy-Go: Real-to-Sim Dynamic 3D Gaussian Splatting Simulation for Environment-Specific Visual Navigation with Moving Obstacles / Seungyeon Yoo, Youngseok Jang, Dabin Kim 他
日本語で読む → - 論文マニピュレーションロボティクス
Pixel2Catch: 単眼RGBカメラによる俊敏なマニピュレーションのためのマルチエージェントSim-to-Real転移
単眼RGB画像のピクセル情報から物体の動きを認識し、アームと多指ハンドを別々のエージェントとして協調学習させるマルチエージェント強化学習で、投げられた物体をキャッチする動作をシミュレーションから実機へ転移させた。
原題: Pixel2Catch: Multi-Agent Sim-to-Real Transfer for Agile Manipulation with a Single RGB Camera / Seongyong Kim, Junhyeon Cho, Kang-Won Lee 他
日本語で読む → - 論文全身制御ロボティクス
EAGLE: 具現化を考慮した汎用・特化蒸留による統合ヒューマノイド全身制御
汎用ポリシーとロボット特化ポリシーを反復的に蒸留し合うことで、複数の異なるヒューマノイドを単一のポリシーで制御できる全身制御手法を提案した。
原題: Embodiment-Aware Generalist Specialist Distillation for Unified Humanoid Whole-Body Control / Quanquan Peng, Yunfeng Lin, Yufei Xue 他
日本語で読む →