論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文動作計画ロボティクス
GNN-DIP: 分解ベース動作計画のためのニューラル回廊選択
狭い通路を通る動作計画を効率化するため、グラフニューラルネットワークでセル隣接グラフ上のポータルスコアを予測し、分解ベースのプランナーで有望な回廊を優先探索する枠組みを提案した。
原題: GNN-DIP: Neural Corridor Selection for Decomposition-Based Motion Planning / Peng Xie, Yanliang Huang, Wenyuan Wu 他
日本語で読む → - 論文3D再構成/レーダーロボティクス
3Dレーダーデータからのニューラル表面・反射率モデリング
レーダー点群からシーン形状と視点依存のレーダー強度を同時に学習するニューラル暗黙表現を提案し、低視界環境での高精度な3D表面再構成を実現した。
原題: Neural Surface and Reflectance Modelling from 3D Radar Data / Judith Treffler, Vladimír Kubelka, Henrik Andreasson 他
日本語で読む → - 論文マニピュレーションロボティクス
自律ロボット操作における安全な意思決定制御のためのリアルタイム神経記号的倫理ガバナー
本論文は、自律ロボット操作タスクにおいて、トランスフォーマーに基づく倫理推論と確率的リスク場を統合したリアルタイムの倫理ガバナーを提案し、人間の近接度や危険度に応じた安全な意思決定を実現する。
原題: A Real-Time Neuro-Symbolic Ethical Governor for Safe Decision Control in Autonomous Robotic Manipulation / Aueaphum Aueawatthanaphisut, Kuepon Aueawatthanaphisut
日本語で読む → - 論文マニピュレーションロボティクス
順方向デモンストレーションからの逆タスク学習によるタスクパラメータ外挿
順方向と逆方向のタスクを共通表現で学習し、新規条件の順方向デモのみから対応する逆タスクを実行できる手法を提案。シミュレーションと実機の複雑なマニピュレーションで既存手法を上回る。
原題: Task Parameter Extrapolation via Learning Inverse Tasks from Forward Demonstrations / Serdar Bahar, Fatih Dogangun, Matteo Saveriano 他
日本語で読む → - 論文VLAロボティクス
VPWEM: 作業記憶とエピソード記憶を備えた非マルコフ視覚運動ポリシー
ロボットの模倣学習において、短期の作業記憶と長期のエピソード記憶を組み合わせ、長期的な記憶を要する非マルコフタスクを少ない計算コストで解く視覚運動ポリシーを提案した。
原題: VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory / Yuheng Lei, Zhixuan Liang, Hongyuan Zhang 他
日本語で読む → - 論文ヒューマノイド/マニピュレーションロボティクス
FAME: 全身ヒューマノイドの操作範囲を拡大する力適応型強化学習
上半身の姿勢と両手にかかる力を潜在表現として取り込み、外力下でもバランスを保つ立ち姿勢ポリシーを強化学習で獲得。力覚センサなしで実機ヒューマノイドに適用可能。
原題: FAME: Force-Adaptive RL for Expanding the Manipulation Envelope of a Full-Scale Humanoid / Niraj Pudasaini, Yutong Zhang, Jensen Lavering 他
日本語で読む → - 論文歩行ロボティクス
SmoothTurn: 四足歩行ロボットの俊敏なナビゲーションのためのスムーズな旋回学習
四足歩行ロボットが高速走行中に滑らかに方向転換できるよう、連続目標ナビゲーションタスクを定式化し、将来の目標を見越した観測とカリキュラム学習で制御方策を学習するフレームワークを提案。
原題: SmoothTurn: Learning to Turn Smoothly for Agile Navigation with Quadrupedal Robots / Zunzhi You, Yunke Wang, Haolan Guo 他
日本語で読む → - 論文世界モデル機械学習
有能なエージェントは何を知る必要があるか:不確実性下での頑健な意思決定のための選択定理
タスク性能が高いエージェントは、世界モデルや信念に似た記憶、状況追跡変数を持つことを強いられるという「選択定理」を証明した理論研究。
原題: What Capable Agents Must Know: Selection Theorems for Robust Decision-Making under Uncertainty / Aran Nayebi
日本語で読む → - 論文モデル予測制御ロボティクス
学習した線形Koopmanダイナミクスによるサンプリングベース制御の高速化
深層Koopman演算子で非線形ダイナミクスを線形近似し、MPPI制御の計算コストを削減しつつ性能を維持する手法を提案。振り子・車両・四足ロボットで有効性を検証した。
原題: Accelerating Sampling-Based Control via Learned Linear Koopman Dynamics / Wenjian Hao, Yuxuan Fang, Zehui Lu 他
日本語で読む → - 論文位置推定ロボティクス
因子グラフ最適化によるGNSSとIMUのリアルタイム密結合統合
GNSS信号が劣化する都市環境で、因子グラフ最適化を用いてGNSSとIMUをリアルタイムに密結合し、固定ラグ周辺化による因果的な状態推定を実現した。
原題: Real-time tightly coupled GNSS and IMU integration via Factor Graph Optimization / Radu-Andrei Cioaca, Paul Irofti, Cristian Rusu 他
日本語で読む → - 論文VLAロボティクス
小型無人航空機の協調的戦術的衝突回避のための大規模言語モデルのファインチューニング
BlueSkyシミュレータで生成したデータを用い、LLMをLoRAやGRPOでファインチューニングして小型無人機の協調的な衝突回避判断を行わせ、精度と分離性能の向上を示した。
原題: Fine-Tuning Large Language Models for Cooperative Tactical Deconfliction of Small Unmanned Aerial Systems / Iman Sharifi, Alex Zongo, Peng Wei
日本語で読む → - 論文歩行ロボティクス
X-Loco: 協調的ポリシー蒸留による汎用人型ロコモーション制御
複数の専門家ポリシーを蒸留し、転倒復帰から地形走破、全身協調までを単一の視覚ベース人型ロコモーションポリシーとして学習させるフレームワークを提案。
原題: X-Loco: Towards Generalist Humanoid Locomotion Control via Synergetic Policy Distillation / Dewei Wang, Xinmiao Wang, Chenyun Zhang 他
日本語で読む → - 論文歩行ロボティクス
何本脚でも歩ける:不整地を歩行する多脚ロボットの制御
2脚につき3アクチュエータを持つセグメント型ロボットで、6〜16脚の不整地歩行を実現する軽量な制御アーキテクチャを提案し、シミュレーションで検証した。
原題: Walking on Rough Terrain with Any Number of Legs / Zhuoyang Chen, Xinyuan Wang, Shai Revzen
日本語で読む → - 論文群制御ロボティクス
LASER: 時空間制約下のマルチロボット木材製造のためのレベルベース非同期スケジューリング実行方式
木材スラブ製造のねじ圧着接着作業を対象に、タスクを時空間的に分離した「レベル」に分割し、レベル内では非同期並列実行、レベル間でのみ同期することで衝突回避と時間制約を両立するスケジューリング・実行フレームワークを提案し、2ロボットで実証した。
原題: LASER: Level-Based Asynchronous Scheduling and Execution Regime for Spatiotemporally Constrained Multi-Robot Timber Manufacturing / Zhenxiang Huang, Lior Skoury, Tim Stark 他
日本語で読む → - 論文マニピュレーションロボティクス
接触を考慮した全身制御による柔軟な物体搬送
人型ロボットが物体を支えながら運ぶ際に、上半身の接触力制御と下半身のバランス制御を分離し、強化学習で外乱や負荷変動に適応する全身制御手法を提案した。
原題: Interaction-Aware Whole-Body Control for Compliant Object Transport / Hao Zhang, Yves Tseng, Ding Zhao 他
日本語で読む → - 論文VLAロボティクス
スタイル条件付き拡散ポリシーによる予測可能性と可読性のエンコード
事前学習済み拡散ポリシーを凍結し、軽量なシーンエンコーダと条件予測器で軌道生成を可読性か効率性に制御するモジュール型フレームワークを提案。曖昧な状況では可読性を高め、不要な時は効率を保つ。
原題: Encoding Predictability and Legibility for Style-Conditioned Diffusion Policy / Adrien Jacquet Crétides, Mouad Abrini, Hamed Rahimi 他
日本語で読む → - 論文移動操作/データ収集/テレオペレーションロボティクス
SuperSuit: スケーラブルな移動操作のための同型バイモーダルインターフェース
移動マニピュレータのためのデータ収集フレームワークSuperSuitを提案。テレオペレーションと能動的デモンストレーションの両モードで同一の運動学的インターフェースを共有し、データ混合を可能にする。
原題: SuperSuit: An Isomorphic Bimodal Interface for Scalable Mobile Manipulation / Tongqing Chen, Hang Wu, Jiasen Wang 他
日本語で読む → - 論文群制御制御
マルチロボット・マルチタスクのガウス過程推定とカバレッジ制御
複数のロボットが複数のタスクを同時にカバーする新たな問題に対し、需要が既知の場合の連合カバレッジアルゴリズムと、未知の場合にマルチタスクガウス過程で需要関数を学習する適応アルゴリズムを提案し、性能を理論的・数値的に示した。
原題: Multi-Robot Multitask Gaussian Process Estimation and Coverage / Lai Wei, Andrew McDonald, Vaibhav Srivastava
日本語で読む → - 論文マニピュレーションロボティクス
ManipArena:推論指向の汎用ロボットマニピュレーションの実世界包括評価
実機ロボットでのマニピュレーション汎化を公平に評価するため、20タスク・1万超の専門家軌道・約188時間分のデータを備えた標準化ベンチマークを構築し、VLAやワールドアクションモデルなど7構成を比較した。
原題: ManipArena: Comprehensive Real-world Evaluation of Reasoning-Oriented Generalist Robot Manipulation / Yu Sun, Meng Cao, Yang Ping 他
日本語で読む → - 論文手と物体のインタラクション画像認識
Glove2Hand: マルチモーダルセンシンググローブから自然な手と物体のインタラクションを合成
マルチモーダルセンシンググローブの映像から、物理的な接触情報を保ちつつ写実的な素手の映像を生成するフレームワークを提案し、触覚・IMU信号付きのデータセットHandSenseを構築した。
原題: Glove2Hand: Synthesizing Natural Hand-Object Interaction from Multi-Modal Sensing Gloves / Xinyu Zhang, Ziyi Kou, Chuan Qin 他
日本語で読む → - 論文3D再構成画像認識
球面ガウス不透明度場による幾何認識型全方位3Dシーン再構成
全方位カメラ向けにガウシアンスプラッティングを拡張し、球面上で直接レイサンプリングすることで歪みのない高品質な3D再構成を実現した。
原題: Spherical-GOF: Geometry-Aware Panoramic Gaussian Opacity Fields for 3D Scene Reconstruction / Zhe Yang, Guoqiang Zhao, Sheng Wu 他
日本語で読む → - 論文最適制御ロボティクス
GPUネイティブ逐次凸計画法による時間並列非線形最適制御
非線形最適制御をGPU上で完全に実行するSCPフレームワークを提案し、クアッドロータ障害物回避と火星着陸で100Hz超の計画と4.1倍の高速化を実現した。
原題: Parallel-in-Time Nonlinear Optimal Control via GPU-native Sequential Convex Programming / Yilin Zou, Zhong Zhang, Maxime Robic 他
日本語で読む → - 論文世界モデルロボティクス
持続可能なロボット世界モデル:強化学習によるマルチステップ展開の安定化
ロボットの世界モデルが自己回帰的に展開すると誤差が蓄積して劣化する問題に対し、強化学習を用いてモデル自身の展開上で訓練し、長期的な予測の忠実度を向上させた。
原題: Persistent Robot World Models: Stabilizing Multi-Step Rollouts via Reinforcement Learning / Jai Bardhan, Patrik Drozdik, Josef Sivic 他
日本語で読む → - 論文群制御ロボティクス
複数AMRによるバッファ保管・取出・並べ替え問題:厳密解法とヒューリスティック解法
密集した床置きバッファ領域で複数の自律移動ロボット(AMR)を協調させ、並べ替え・時間指定の保管・取出しを同時に処理する問題を定式化し、厳密な整数計画法と、A*探索と制約プログラミングを組み合わせた階層的ヒューリスティックを提案した。
原題: The Multi-AMR Buffer Storage, Retrieval, and Reshuffling Problem: Exact and Heuristic Approaches / Max Disselnmeyer, Thomas Bömer, Laura Dörr 他
日本語で読む → - 論文HRI/ナビゲーションロボティクス
視点の問題:視点がロボットの社交性の知覚に与える影響
没入型VRを用いて、ロボット軌道の社交性評価が俯瞰視点と一人称視点でどう異なるかを調査し、頭部のうなずき動作が知覚ギャップを埋めるかを検証した論文。
原題: Point of View: How Perspective Affects Perceived Robot Sociability / Subham Agrawal, Aftab Akhtar, Nils Dengler 他
日本語で読む → - 論文ナビゲーションロボティクス
エッジハードウェア上での鉱山内四足ロボットの効率的自律ナビゲーション
GPUやネットワークを必要としない低消費電力エッジコンピュータ上で動作する、鉱山内の四足ロボット向け完全自律ナビゲーションシステムを提案し、実地試験で100%の成功率を達成した。
原題: Efficient Autonomous Navigation of a Quadruped Robot in Underground Mines on Edge Hardware / Yixiang Gao, Kwame Awuah-Offei
日本語で読む → - 論文sim2realロボティクス
TADPO: 強化学習でオフロードを走破する
PPOを拡張し、教師によるオフポリシー軌道と生徒のオンポリシー探索を組み合わせた新手法TADPOを提案し、高速オフロード走行を実現。実車へのゼロショットsim2real転移に成功した。
原題: TADPO: Reinforcement Learning Goes Off-road / Zhouchonghao Wu, Raymond Song, Vedant Mundheda 他
日本語で読む → - 論文タスク計画ロボティクス
VersualRL: 視覚的実行フィードバックによる閉ループ言語強化学習を用いたタスクレベルロボット計画
視覚言語モデルが実行結果を批評し、言語モデルが行動木を更新する閉ループ枠組みを提案し、実機ロボットの多段階タスクで有効性を示した。
原題: VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning / Dmitrii Plotnikov, Iaroslav Kolomiets, Dmitrii Maliukov 他
日本語で読む → - 論文群制御制御
未知の逃避者戦略に対する包囲を保証する有限時間捕獲
2次元無界環境で複数の追跡者が単一の逃避者を包囲しながら有限時間で捕獲する戦略を提案し、逃避者の戦略に依存しない捕獲時間の上限を導出した。
原題: Encirclement Guaranteed Finite-Time Capture against Unknown Evader Strategies / Dinesh Patra, Prajakta Surve, Ashish R. Hota 他
日本語で読む → - 論文VLAロボティクス
VLN-Cache: 視覚・意味ダイナミクスを考慮したVLNモデルのトークンキャッシング
VLNタスクで大規模視覚言語モデルの推論コストを削減するため、視点移動によるトークン位置ずれとタスク進行に伴う意味的変化を考慮したトークンキャッシング手法を提案した。
原題: VLN-Cache: Enabling Token Caching for VLN Models with Visual/Semantic Dynamics Awareness / Zihao Zheng, Zhihao Mao, Xingyue Zhou 他
日本語で読む →