論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLA/操作ロボティクス
CodeGraphVLP: コードによる計画とセマンティックグラフ状態を組み合わせた非マルコフ型視覚言語行動モデル
長期的なロボット操作タスクにおいて、セマンティックグラフ状態とコードベースのプランナーを組み合わせ、視覚言語行動モデルの実行を支援する階層的フレームワークを提案した。
原題: CodeGraphVLP: Code-as-Planner Meets Semantic-Graph State for Non-Markovian Vision-Language-Action Models / Khoa Vo, Sieu Tran, Taisei Hanyu 他
日本語で読む → - 論文シミュレーションロボティクス
Habitat-GS: 動的ガウシアンスプラッティングを用いた高忠実度ナビゲーションシミュレータ
Habitat-Simを拡張し、3Dガウシアンスプラッティングによる高精細なシーン描画と、駆動可能なガウシアンアバターによる動的人間モデリングを統合したナビゲーション用シミュレータを提案した。
原題: Habitat-GS: A High-Fidelity Navigation Simulator with Dynamic Gaussian Splatting / Ziyuan Xia, Jingyi Xu, Chong Cui 他
日本語で読む → - 論文HRIHCI
人間とロボットの相互作用における不確実性、曖昧さ、多義性:概念化の重要性
この論文は、人間とロボットの相互作用(HRI)における不確実性、曖昧さ、多義性の概念を整理し、一貫した定義と相互関係を提案するものである。
原題: Uncertainty, Vagueness, and Ambiguity in Human-Robot Interaction: Why Conceptualization Matters / Xiaowen Sun, Cornelius Weber, Matthias Kerzel 他
日本語で読む → - 論文ドローン制御ロボティクス
微分可能シミュレーションによる不規則な隙間を通過するUAVの視覚ベースエンドツーエンド学習
深度画像から制御指令へのエンドツーエンド学習で、不規則な隙間を自律的に通過するドローンの制御を実現した論文。
原題: Vision-Based End-to-End Learning for UAV Traversal of Irregular Gaps via Differentiable Simulation / Linzuo Zhang, Yu Hu, Feng Yu 他
日本語で読む → - 論文自動運転ロボティクス
モデル予測制御と深層強化学習の統合によるマルチエージェント自動運転の安全性と効率性の向上
交差点などのマルチエージェント環境で、MPCと深層RLを統合し、安全性と効率性のバランスを改善する手法を提案。実験で衝突率を21%削減し、成功率を6.5%向上させた。
原題: Beyond Conservative Automated Driving in Multi-Agent Scenarios via Coupled Model Predictive Control and Deep Reinforcement Learning / Saeed Rahmani, Gözde Körpe, Zhenlin 他
日本語で読む → - 論文姿勢制御制御
SO(3)上の制約付き姿勢制御のための周期的イベントトリガ型明示参照ガバナ
剛体の姿勢制御において、入力飽和と幾何学的ポインティング制約をオンライン最適化なしで満たす周期的イベントトリガ型明示参照ガバナを提案し、閉ループ系の漸近安定性と指数収束を証明した。
原題: Periodic Event-Triggered Explicit Reference Governor for Constrained Attitude Control on SO(3) / Satoshi Nakano, Masahiro Suzuki, Misa Ohashi 他
日本語で読む → - 論文意図予測ロボティクス
制御情報を活用した学習によるオンライン意図予測
自律システムの目標状態をリアルタイムで推定するオンライン意図予測フレームワークを提案。逆最適制御とシフトする地平線戦略を用い、時間変化する意図や未知パラメータに対応する。
原題: Online Intention Prediction via Control-Informed Learning / Tianyu Zhou, Zihao Liang, Zehui Lu 他
日本語で読む → - 論文機構学/動力学ロボティクス
可変トポロジー機構の順動力学 - 拘束の活性化の場合
機構の運動学的トポロジーが変化する際の非平滑動力学問題を扱い、トポロジー切替時の物理的に意味のある遷移条件を提案した。
原題: Forward Dynamics of Variable Topology Mechanisms - The Case of Constraint Activation / Andreas Mueller
日本語で読む → - 論文動画生成画像認識
MoRight: モーション制御を正しく行う
ユーザー指定の動作で物体の動きを制御しつつ、カメラ視点も自由に変えられる動画生成フレームワークを提案。能動的動作と受動的反応を分離して因果関係を学習し、順方向・逆方向の推論を可能にした。
原題: MoRight: Motion Control Done Right / Shaowei Liu, Xuanchi Ren, Tianchang Shen 他
日本語で読む → - 論文軌道計画ロボティクス
行動スコア拡散:カーネルベースのスコア推定によるモデルフリー軌道計画
事前収集した軌道データからカーネル重み付き推定で拡散スコアを直接計算し、モデルや学習なしで軌道計画を行う手法を提案した。
原題: Behavioral Score Diffusion: Model-Free Trajectory Planning via Kernel-Based Score Estimation from Data / Shihao Li, Jiachen Li, Jiamin Xu 他
日本語で読む → - 論文ローカライゼーションロボティクス
ビジョンベース自律ドローンレースのための二重ポーズグラフ意味的ローカライゼーション
ドローンレースの過酷な条件下で、オドメトリと意味的検出を融合した二重ポーズグラフ構造により、ロバストなリアルタイム自己位置推定を実現した。
原題: Dual Pose-Graph Semantic Localization for Vision-Based Autonomous Drone Racing / David Perez-Saura, Miguel Fernandez-Cortizas, Alvaro J. Gaona 他
日本語で読む → - 論文VLAロボティクス
文法制約付き大規模言語モデルによる精密なロボットコマンド理解
産業用ロボットの安全な操作のために、文法制約を組み込んだLLMを提案し、自然言語入力をロボット実行可能なJSON形式のコマンドに変換する。
原題: Precise Robot Command Understanding Using Grammar-Constrained Large Language Models / Xinyun Huo, Raghav Gnanasambandam, Xinyao Zhang
日本語で読む → - 論文自動運転/ベンチマークロボティクス
Fail2Drive: クローズドループ運転の汎化性能を評価するベンチマーク
CARLAシミュレータ上で、分布シフトに対するクローズドループ自動運転の汎化性能を評価する初のペアルートベンチマークを提案し、既存モデルの成功率が平均22.8%低下することを示した。
原題: Fail2Drive: Benchmarking Closed-Loop Driving Generalization / Simon Gerstenecker, Andreas Geiger, Katrin Renz
日本語で読む → - 論文世界モデル/リスク予測ロボティクス
ICAT: 身体化世界モデルにおける物理的リスク予測のためのインシデント事例に基づく適応的テスト
ビデオ生成型世界モデルが危険な行動のリスクを過小評価する問題を指摘し、実際の事故報告や安全マニュアルからリスク記憶を構築してテストケースを生成するICATを提案した。
原題: ICAT: Incident-Case-Grounded Adaptive Testing for Physical-Risk Prediction in Embodied World Models / Zhenglin Lai, Sirui Huang, Yuteng Li 他
日本語で読む → - 論文全身制御ロボティクス
BAT: オンライン方策切替による俊敏性と安定性の両立 - 長期的全身ヒューマノイド制御
長期的な全身動作タスクで俊敏性と安定性を両立するため、2つの補完的な強化学習方策をオンラインで切り替えるフレームワークBATを提案し、シミュレーションと実機で有効性を示した。
原題: BAT: Balancing Agility and Stability via Online Policy Switching for Long-Horizon Whole-Body Humanoid Control / Donghoon Baek, Sang-Hun Kim, Sehoon Ha
日本語で読む → - 論文歩行ロボティクス
足位置マップと安定性報酬を用いた四足ロボットの複雑地形歩行学習
四足ロボットの複雑地形歩行を強化学習で行う際、高さマップに足位置マップを統合し、動的安定性報酬を導入することで、正確で安定した歩行を実現した。
原題: Learning Locomotion on Complex Terrain for Quadrupedal Robots with Foot Position Maps and Stability Rewards / Matthew Hwang, Yubin Liu, Ryo Hakoda 他
日本語で読む → - 論文強化学習/航空機機械学習
強化学習を用いた自動対地衝突回避システム
ジェット練習機向けに、強化学習ベースの自動対地衝突回避システムを設計し、限られた観測空間での安全性と運用効率を向上させる手法を提案した論文。
原題: An Automatic Ground Collision Avoidance System with Reinforcement Learning / Seyyid Osman Sevgili, Atahan Cilan, Mahir Demir 他
日本語で読む → - 論文マニピュレーションロボティクス
GenerativeMPC: VLM-RAGガイドによる仮想インピーダンスを用いた全身MPCによる双腕移動マニピュレーション
視覚言語モデルと検索拡張生成を用いて、双腕移動マニピュレータの全身MPCの制御パラメータ(速度制限や安全マージン、仮想インピーダンス)を文脈に応じて調整する階層的フレームワークを提案した。
原題: GenerativeMPC: VLM-RAG-guided Whole-Body MPC with Virtual Impedance for Bimanual Mobile Manipulation / Marcelino Julio Fernando, Miguel Altamirano Cabrera, Jeffrin Sam 他
日本語で読む → - 論文強化学習ロボティクス
長期的ロボットタスクのための一般化可能な密な報酬
LLMとVLMを用いてタスク進捗を認識する外部報酬と、ポリシーの自己確信度に基づく内部報酬を組み合わせた密な報酬フレームワークVLLRを提案し、長期的タスクにおけるRL微調整を手動報酬設計なしで改善した。
原題: Generalizable Dense Reward for Long-Horizon Robotic Tasks / Silong Yong, Stephen Sheng, Carl Qi 他
日本語で読む → - 論文教育/ロボティクスphysics.ed-ph
錆びた空飛ぶロボット:STM32マイコン上でリアルタイム動作するロボティクススタック全体を学ぶ9ECTS修士課程
修士課程のプロジェクト型授業で、ロボティクスの基本パイプライン(動力学、状態推定、制御、計画)を、制約の強い計算機上で直接実装し、実際にロボットを飛行させることを通じて学ぶ。ブラックボックスなソフトウェアを避け、Rust言語を用いてPC上でのシミュレーションとSTM32上での実機展開を行う。
原題: Rusty Flying Robots: Learning a Full Robotics Stack with Real-Time Operation on an STM32 Microcontroller in a 9 ECTS MS Course / Wolfgang Hoenig, Christoph Scherer, Khaled Wahba
日本語で読む → - 論文拡散ポリシー/非同期実行ロボティクス
DiscreteRTC: 離散拡散ポリシーは自然な非同期実行器である
離散拡散ポリシーが本来持つインペインティング能力を活用し、非同期実行を実現する新しいポリシー「DiscreteRTC」を提案。連続的なRTCと比べて、追加コードなしで実装でき、推論コストも削減しつつ、動的タスクでの成功率が向上することを示した。
原題: DiscreteRTC: Discrete Diffusion Policies are Natural Asynchronous Executors / Pengcheng Wang, Kaiwen Hong, Chensheng Peng 他
日本語で読む → - 論文物体検出画像認識
ドメインが重要な理由:水中物体検出におけるドメイン効果の予備的研究
水中環境でのドメインシフトが物体検出性能に与える影響を、物理的特性に基づく新しいラベリング枠組みで分析し、従来の合成スタイル変換では捉えられない実世界の要因による性能変動と隠れた失敗モードを明らかにした。
原題: Why Domain Matters: A Preliminary Study of Domain Effects in Underwater Object Detection / Melanie Wille, Dimity Miller, Tobias Fischer 他
日本語で読む → - 論文農業ロボティクスロボティクス
枝を押しのけて果実検出を向上させる遮蔽処理
農業ロボットが枝葉に隠れた果実を検出・収穫できるよう、RGB-Dカメラとロボットアームで枝を押しのけて視認性を高める手法を提案した。
原題: Occlusion Handling by Pushing for Enhanced Fruit Detection / Ege Gursoy, Dana Kulić, Andrea Cherubini
日本語で読む → - 論文状態推定ロボティクス
適応ロス関数を用いた外れ値に頑健な非線形移動水平推定
外れ値の影響を低減する適応的ロバスト損失関数をMHEに統合し、正則化項で自明解を防ぐ手法を提案。シミュレーションで数回の反復で適応し、外れ値がない場合はL2挙動を示すことを確認した。
原題: Outlier-Robust Nonlinear Moving Horizon Estimation using Adaptive Loss Functions / Nestor Deniz, Guido Sanchez, Fernando Auat Cheein 他
日本語で読む → - 論文群制御ロボティクス
多UAV剛体ペイロードカスケード輸送システムの拡張チューブRRT*に基づく軌道計画
密集障害物環境での多UAVによる剛体ペイロード輸送のための2段階軌道計画フレームワークを提案し、拡張チューブRRT*で安全な仮想チューブを生成後、凸二次計画で滑らかな軌道を生成する。
原題: Trajectory Planning for a Multi-UAV Rigid-Payload Cascaded Transportation System Based on Enhanced Tube-RRT* / Jianqiao Yu, Jia Li, Tianhua Gao
日本語で読む → - 論文器用操作ロボティクス
ViserDex: 頑健な器用な手内回転のための視覚的シミュレーションから実世界への転移
単眼RGBカメラを用いた手内物体回転のためのシミュレーションから実世界への転移フレームワークを提案し、3Dガウシアンスプラッティングによる視覚的ドメインランダマイゼーションでポーズ推定と操作ポリシーを訓練する。
原題: ViserDex: Visual Sim-to-Real for Robust Dexterous In-hand Reorientation / Arjun Bhardwaj, Maximum Wilder-Smith, Mayank Mittal 他
日本語で読む → - 論文動作計画ロボティクス
疎なロードマップを用いた物理情報ニューラル動作計画の弱教師あり学習
疎なロードマップからの弱教師信号と物理情報に基づくPDE正則化を組み合わせた階層型ニューラル時間場(H-NTFields)を提案し、複雑な多部屋環境での動作計画のロバスト性を向上させた。
原題: Weakly-supervised Learning for Physics-informed Neural Motion Planning via Sparse Roadmap / Ruiqi Ni, Yuchen Liu, Ahmed H. Qureshi
日本語で読む → - 論文最適制御制御
緊急シナリオにおける精密不動化技術のための物理情報ニューラル最適制御
暴走車両を緊急停止させる精密不動化技術(PIT)の自動化に向け、物理情報ニューラルネットワーク(PicoPINN)と階層型最適制御を組み合わせた枠組みを提案し、シミュレーションと実車実験で有効性を示した。
原題: Physics-Informed Neural Optimal Control for Precision Immobilization Technique in Emergency Scenarios / Yangye Jiang, Jiachen Wang, Daofei Li
日本語で読む → - 論文ドローン制御ロボティクス
QuadAgent: 視覚言語ガイドによるクアッドローター俊敏飛行のための応答性エージェントシステム
視覚と言語の入力に基づいてクアッドローターを俊敏に飛行させる、訓練不要のエージェントシステムを提案。非同期マルチエージェント構成で高次推論と低次制御を分離し、シミュレーションと実機で有効性を実証した。
原題: QuadAgent: A Responsive Agent System for Vision-Language Guided Quadrotor Agile Flight / Ao Zhuang, Feng Yu, Tianbao Zhang 他
日本語で読む → - 論文姿勢推定ロボティクス
イベントカメラとニューロモルフィックハードウェアを用いた効率的な宇宙機姿勢推定
イベントカメラとニューロモルフィックプロセッサを組み合わせ、宇宙機の6自由度姿勢推定を低遅延・低消費電力で実現するパイプラインを提案・実証した。
原題: Efficient Onboard Spacecraft Pose Estimation with Event Cameras and Neuromorphic Hardware / Arunkumar Rathinam, Jules Lecomte, Jost Reelsen 他
日本語で読む →