論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
VPWEM: 作業記憶とエピソード記憶を備えた非マルコフ視覚運動ポリシー
ロボットの模倣学習において、短期の作業記憶と長期のエピソード記憶を組み合わせ、長期的な記憶を要する非マルコフタスクを少ない計算コストで解く視覚運動ポリシーを提案した。
原題: VPWEM: Non-Markovian Visuomotor Policy with Working and Episodic Memory / Yuheng Lei, Zhixuan Liang, Hongyuan Zhang 他
日本語で読む → - 論文歩行ロボティクス
SmoothTurn: 四足歩行ロボットの俊敏なナビゲーションのためのスムーズな旋回学習
四足歩行ロボットが高速走行中に滑らかに方向転換できるよう、連続目標ナビゲーションタスクを定式化し、将来の目標を見越した観測とカリキュラム学習で制御方策を学習するフレームワークを提案。
原題: SmoothTurn: Learning to Turn Smoothly for Agile Navigation with Quadrupedal Robots / Zunzhi You, Yunke Wang, Haolan Guo 他
日本語で読む → - 論文世界モデル機械学習
有能なエージェントは何を知る必要があるか:不確実性下での頑健な意思決定のための選択定理
タスク性能が高いエージェントは、世界モデルや信念に似た記憶、状況追跡変数を持つことを強いられるという「選択定理」を証明した理論研究。
原題: What Capable Agents Must Know: Selection Theorems for Robust Decision-Making under Uncertainty / Aran Nayebi
日本語で読む → - 論文モデル予測制御ロボティクス
学習した線形Koopmanダイナミクスによるサンプリングベース制御の高速化
深層Koopman演算子で非線形ダイナミクスを線形近似し、MPPI制御の計算コストを削減しつつ性能を維持する手法を提案。振り子・車両・四足ロボットで有効性を検証した。
原題: Accelerating Sampling-Based Control via Learned Linear Koopman Dynamics / Wenjian Hao, Yuxuan Fang, Zehui Lu 他
日本語で読む → - 論文位置推定ロボティクス
因子グラフ最適化によるGNSSとIMUのリアルタイム密結合統合
GNSS信号が劣化する都市環境で、因子グラフ最適化を用いてGNSSとIMUをリアルタイムに密結合し、固定ラグ周辺化による因果的な状態推定を実現した。
原題: Real-time tightly coupled GNSS and IMU integration via Factor Graph Optimization / Radu-Andrei Cioaca, Paul Irofti, Cristian Rusu 他
日本語で読む → - 論文VLAロボティクス
小型無人航空機の協調的戦術的衝突回避のための大規模言語モデルのファインチューニング
BlueSkyシミュレータで生成したデータを用い、LLMをLoRAやGRPOでファインチューニングして小型無人機の協調的な衝突回避判断を行わせ、精度と分離性能の向上を示した。
原題: Fine-Tuning Large Language Models for Cooperative Tactical Deconfliction of Small Unmanned Aerial Systems / Iman Sharifi, Alex Zongo, Peng Wei
日本語で読む → - 論文歩行ロボティクス
X-Loco: 協調的ポリシー蒸留による汎用人型ロコモーション制御
複数の専門家ポリシーを蒸留し、転倒復帰から地形走破、全身協調までを単一の視覚ベース人型ロコモーションポリシーとして学習させるフレームワークを提案。
原題: X-Loco: Towards Generalist Humanoid Locomotion Control via Synergetic Policy Distillation / Dewei Wang, Xinmiao Wang, Chenyun Zhang 他
日本語で読む → - 論文群制御ロボティクス
LASER: 時空間制約下のマルチロボット木材製造のためのレベルベース非同期スケジューリング実行方式
木材スラブ製造のねじ圧着接着作業を対象に、タスクを時空間的に分離した「レベル」に分割し、レベル内では非同期並列実行、レベル間でのみ同期することで衝突回避と時間制約を両立するスケジューリング・実行フレームワークを提案し、2ロボットで実証した。
原題: LASER: Level-Based Asynchronous Scheduling and Execution Regime for Spatiotemporally Constrained Multi-Robot Timber Manufacturing / Zhenxiang Huang, Lior Skoury, Tim Stark 他
日本語で読む → - 論文VLAロボティクス
スタイル条件付き拡散ポリシーによる予測可能性と可読性のエンコード
事前学習済み拡散ポリシーを凍結し、軽量なシーンエンコーダと条件予測器で軌道生成を可読性か効率性に制御するモジュール型フレームワークを提案。曖昧な状況では可読性を高め、不要な時は効率を保つ。
原題: Encoding Predictability and Legibility for Style-Conditioned Diffusion Policy / Adrien Jacquet Crétides, Mouad Abrini, Hamed Rahimi 他
日本語で読む → - 論文VLAロボティクス
3PoinTr: 制約のない人間動画から操作を学習する3D点トラック
制約のない人間の動画から密な3D点トラックを予測し、それを用いてロボット操作方策を事前学習する手法を提案。20件の実演のみで成功率を大幅に向上させた。
原題: 3PoinTr: 3D Point Tracks for Learning Manipulation from Unconstrained Human Videos / Adam Hung, Bardienus Pieter Duisterhof, Jeffrey Ichnowski
日本語で読む → - 論文LiDARオドメトリロボティクス
GenZ-LIO: 閉鎖空間と開放空間の境界を越えて汎化するLiDAR慣性オドメトリ
閉鎖空間と開放空間の遷移で生じるスキャン密度や幾何構造の変化に適応するため、スケール適応型ボクセル化・ハイブリッド残差更新・ボクセル枝刈り対応探索を組み合わせたLiDAR慣性オドメトリ手法を提案し、複数データセットで安定性を検証した。
原題: GenZ-LIO: Generalizable LiDAR-Inertial Odometry Beyond Confined--Open Boundaries / Daehan Lee, Hyungtae Lim, Seongjun Kim 他
日本語で読む → - 論文視覚ナビゲーションロボティクス
変化する環境での長期視覚ナビゲーションのための予測・適応マップ
変化する環境での長期視覚ナビゲーションに向けて、地図管理手法を比較し、環境の周期的変化をモデル化して特徴の可視性を予測する手法が従来手法より優れることを3ヶ月の実験で示した。
原題: Predictive and adaptive maps for long-term visual navigation in changing environments / Lucie Halodova, Eliska Dvorakova, Filip Majer 他
日本語で読む → - 論文自動運転/VLAロボティクス
DriveVLM-RL: 視覚言語モデルと神経科学に着想を得た強化学習による安全で実用的な自動運転
脳の習慣的・熟慮的視覚処理に倣い、静的・動的の二経路でVLMから意味的報酬を学習する強化学習フレームワークを提案。VLMは訓練時のみ使用し展開時には除去することで推論遅延をなくし、CARLAで安全性と実用性を向上させた。
原題: DriveVLM-RL: Neuroscience-Inspired Reinforcement Learning with Vision-Language Models for Safe and Deployable Autonomous Driving / Zilin Huang, Zihao Sheng, Zhengyang Wan 他
日本語で読む → - 論文飛行ロボット/衝突復帰ロボティクス
双四元数に基づく接触モデリングによるクアッドロータの高速かつ滑らかな衝突復帰
双四元数を用いてSE(3)多様体上で法線・接線インパルスの連成を保つ接触モデルを提案し、衝突後の姿勢・速度を高速かつ滑らかに復帰させる制御器を設計した。
原題: Dual Quaternion Based Contact Modeling for Fast and Smooth Collision Recovery of Quadrotors / Valentin Gaucher, Wenlong Zhang
日本語で読む → - 論文VLAロボティクス
ノイズ空間におけるチャンク境界アーティファクトの帰属と制御
生成的な視覚運動ポリシーにおけるチャンク境界の実行不連続性を分析可能なメカニズム変数として扱い、潜在ノイズの操作で系統的に制御でき、タスク結果に影響を与えることを示した。
原題: Noise-Space Attribution and Control of Chunk-Boundary Artifact / Rui Wang
日本語で読む → - 論文車両状態推定制御
分布タイヤ動力学を備えた線形単一トラック車両モデルのための逆動力学オブザーバ設計
車両の横滑り角とタイヤ力を正確に推定するため、線形単一トラックモデルと分布タイヤ表現を組み合わせたオブザーバを提案し、ヨーレートと横加速度のみから状態を再構成する。
原題: Inverse-dynamics observer design for a linear single-track vehicle model with distributed tire dynamics / Luigi Romano, Ole Morten Aamo, Jan Åslund 他
日本語で読む → - 論文群制御ロボティクス
マルチロボットシステムにおけるタスク特化の進化コスト
限られた評価予算で群ロボットの採餌タスクを進化させ、汎用行動とタスク特化行動を比較した結果、特化型は協調に失敗し性能が劣ることが示された。
原題: On the Cost of Evolving Task Specialization in Multi-Robot Systems / Paolo Leopardi, Heiko Hamann, Jonas Kuckling 他
日本語で読む → - 論文触覚ロボティクス
ArrayTac:形状・硬さ・摩擦を連続的に提示する閉ループ圧電触覚ディスプレイ
圧電アクチュエータアレイと閉ループ制御により、形状・硬さ・摩擦の3次元触覚を連続的に提示する触覚ディスプレイを開発し、遠隔腫瘍触診などへの応用を示した。
原題: ArrayTac: A Closed-loop Piezoelectric Tactile Platform for Continuously Tunable Rendering of Shape, Stiffness, and Friction / Tianhai Liang, Shiyi Guo, Baiye Cheng 他
日本語で読む → - 論文宇宙機制御制御
バイナリスラスタのための混合整数モデル予測制御と連続モデル予測制御の比較研究
宇宙機の近接運用で使われるオン/オフ型スラスタの制御について、混合整数最適化として直接解く手法と、連続制御出力を変調する2層手法を初めて体系的に比較し、変調器の状態を考慮した新しいMPCも提案した。
原題: Mixed-Integer vs. Continuous Model Predictive Control for Binary Thrusters: A Comparative Study / Franek Stark, Jakob Middelberg, Shubham Vyas
日本語で読む → - 論文VLA機械学習
シンプルな手法で十分:VLAモデルは強化学習による自然な継続学習者である
大規模事前学習済みVLAモデルの継続強化学習を体系的に検証し、LoRAを用いた単純な逐次ファインチューニングが破滅的忘却をほとんど起こさず、複雑な継続学習手法を上回ることを示した。
原題: Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning / Jiaheng Hu, Jay Shim, Chen Tang 他
日本語で読む → - 論文歩行機械学習
筋シナジー事前分布が予測筋骨格歩行シミュレーションの生体力学的忠実度を高める
少数の歩行実験から抽出した筋シナジーを強化学習の行動空間に組み込むことで、様々な速度・傾斜・不整地で安定した歩容を生成し、非生理的な膝運動を抑えて生体力学的忠実度を向上させた。
原題: Muscle Synergy Priors Enhance Biomechanical Fidelity in Predictive Musculoskeletal Locomotion Simulation / Ilseung Park, Eunsik Choi, Jangwhan Ahn 他
日本語で読む → - 論文3D再構成/エッジAIロボティクス
Tiny-DroNeRF: 連合学習対応ナノドローン上の小型ニューラル放射場
ナノドローン上で動作する軽量NeRFモデルを提案し、メモリ使用量を96%削減しつつ、複数ドローンによる連合学習でデータ量の制約を克服した。
原題: Tiny-DroNeRF: Tiny Neural Radiance Fields aboard Federated Learning-enabled Nano-drones / Ilenia Carboni, Elia Cereda, Lorenzo Lamberti 他
日本語で読む → - 論文HRIロボティクス
非人型ロボットへの心の帰属を探るメンタリスティック・インターフェース
非人型ロボットの行動を心的・目的論的・機械論的の3つの説明フレームで表現できる実験プラットフォームを構築し、言語とフレーミングが意図的スタンスの採用に与える影響を調べた。
原題: A Mentalistic Interface for Probing Folk-Psychological Attribution to Non-Humanoid Robots / Giulio Pisaneschi, Pierpaolo Serio, Estelle Gerbier 他
日本語で読む → - 論文群制御ロボティクス
多UAVの差別化低空経路におけるロバスト分散協調経路追従と局所再計画
複数の固定翼UAVが複雑なDEM低空空域で協調経路追従する際の課題に対し、分散通信プロトコルによる時間同期、風外乱下での有限時間安定化を実現するロバスト誘導則、およびオンライン障害物回避のための局所再計画手法を提案した。
原題: Robust Distributed Cooperative Path-Following and Local Replanning for Multi-UAVs Under Differentiated Low-Altitude Paths / Zimao Sheng, Zirui Yu, Hong'an Yang
日本語で読む → - 論文群制御ロボティクス
ドローンライトショー性能向上:群ドローン編隊の最適割り当てと軌道生成
ドローンライトショー向けに、ドローンと目標位置の最適割り当てと衝突回避可能な軌道生成を同時に解くUATGフレームワークを提案し、1008機を約1秒で計算可能な高速性を実証した。
原題: Enhancing Drone Light Shows Performances: Optimal Allocation and Trajectories for Swarm Drone Formations / Yunes Alqudsi
日本語で読む → - 論文器用操作ロボティクス
UniDex: 人間の一人称視点ビデオからの汎用器用ハンド制御のためのロボット基盤スイート
人間の一人称視点ビデオからロボット実行可能な軌道を生成し、統一された行動空間と3D VLAポリシーを用いて、複数の器用ハンドへの汎用制御を実現する基盤スイートを提案した。
原題: UniDex: A Robot Foundation Suite for Universal Dexterous Hand Control from Egocentric Human Videos / Gu Zhang, Qicheng Xu, Haozhe Zhang 他
日本語で読む → - 論文軌道最適化ロボティクス
Hippo: 汎用制約付き軌道最適化のための高性能内点法・射影法ソルバー
ロボットの軌道最適化問題を解くための新しいソルバーHippoを提案。不等式制約には適応バリア更新を伴う内点法、等式制約には射影法や内点法を用い、既存手法より高速で堅牢に高品質な解を得られる。
原題: Hippo: High-performance Interior-Point and Projection-based Solver for Generic Constrained Trajectory Optimization / Haizhou Zhao, Ludovic Righetti, Majid Khadiv
日本語で読む → - 論文VLA/UAVナビゲーション画像認識
AerialVLA: 最小限のエンドツーエンド制御によるUAVナビゲーションのための視覚言語行動モデル
UAVナビゲーションのための視覚言語行動モデルを提案し、生の視覚情報と言語指示を直接連続的な物理制御信号にマッピングする。オラクルガイダンスや外部物体検出器に依存せず、ファジーな方向指示と統合制御空間により、未見環境での汎化性能を大幅に向上させた。
原題: AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control / Peng Xu, Zhengnan Deng, Jiayan Deng 他
日本語で読む → - 論文マニピュレーションロボティクス
MoE-ACT: スパースな言語条件付きMixture-of-Experts Transformerによるマルチタスク両腕操作のスケーリング
両腕操作のマルチタスク模倣学習において、TransformerエンコーダにスパースMoEを統合し、タスク間の干渉を軽減する軽量フレームワークMoE-ACTを提案した。シミュレーションと実機で性能を検証し、マルチタスク性能を大幅に向上させた。
原題: MoE-ACT: Scaling Multi-Task Bimanual Manipulation with Sparse Language-Conditioned Mixture-of-Experts Transformers / Kangjun Guo, Haichao Liu, Yanji Sun 他
日本語で読む → - 論文スキル適応ロボティクス
ガウス過程を用いたロボットスキル学習と適応に向けて
ガウス過程に基づくスキル表現を用いて、軌道のキネマティクスを保ちつつ、初期状態と観測状態の差異に適応する3つの手法(最適化、行動クローニング、強化学習)を提案し、シミュレーションと実機で有効性を示した。
原題: Towards Robot Skill Learning and Adaptation with Gaussian Processes / A K M Nadimul Haque, Fouad Sukkar, Sheila Sujipto 他
日本語で読む →