論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文SLAMロボティクス
DAGS-SLAM: 時空間運動確率と不確実性対応スケジューリングによる動的対応3DGS SLAM
各ガウシアンに時空間運動確率を持たせ、不確実性に応じてセマンティクスを必要な時だけ呼び出すことで、動的環境でもリアルタイムに高精度な3DGS-SLAMを実現した。
原題: DAGS-SLAM: Dynamic-Aware 3DGS SLAM via Spatiotemporal Motion Probability and Uncertainty-Aware Scheduling / Li Zhang, Yu-An Liu, Xijia Jiang 他
日本語で読む → - 論文変形物体マニピュレーションロボティクス
非無視可能なダイナミクスを持つ変形可能な線状物体の自己教師あり物理情報マニピュレーション
ロープなどの変形可能な線状物体の動的操りを、物理モデルと自己教師あり学習を組み合わせて実現するフレームワークSPiDを提案し、ロープ安定化タスクで有効性を示した。
原題: Self-supervised Physics-Informed Manipulation of Deformable Linear Objects with Non-negligible Dynamics / Youyuan Long, Gokhan Solak, Sara Zeynalpour 他
日本語で読む → - 論文マニピュレーションロボティクス
残差強化学習による大規模クレーンと受動関節ツールを用いた廃棄物容器吊り上げ
油圧ローダークレーンで廃棄物容器を吊り上げる際、従来の制御に残差強化学習を組み合わせ、軌道追従精度と揺れ抑制を改善した。
原題: Residual Reinforcement Learning for Waste-Container Lifting Using Large-Scale Cranes with Underactuated Tools / Qi Li, Karsten Berns
日本語で読む → - 論文VLAロボティクス
ForeAct: 効率的な視覚的先読み計画でVLAを誘導する
将来の観測画像とサブタスク記述を生成してVLAの視覚入力に追加するだけで、アーキテクチャ変更なしに実世界タスクの成功率を大幅に向上させる計画モジュールを提案。
原題: ForeAct: Steering Your VLA with Efficient Visual Foresight Planning / Zhuoyang Zhang, Shang Yang, Qinghao Hu 他
日本語で読む → - 論文VLAロボティクス
RDT2:UMIデータのスケーリング限界を探り、ゼロショットのクロスエンボディメント汎化を実現
7BパラメータのVLMを基盤とし、1万時間超のUMIデータと3段階学習で、未知の物体・シーン・指示・ロボット機体にゼロショットで汎化するロボット基盤モデルを構築した。
原題: RDT2: Exploring the Scaling Limit of UMI Data Towards Zero-Shot Cross-Embodiment Generalization / Songming Liu, Bangguo Li, Kai Ma 他
日本語で読む → - 論文VLAロボティクス
潜在的他者視点取得:影響拡張ローカルモデルにおけるシュレーディンガー橋
他者の隠れた心的状態を推論するため、ニューロシンボリックな世界モデルとシュレーディンガー橋による視点変換を組み合わせ、社会的ナビゲーションタスクでモデルベース強化学習を行う手法を提案。
原題: Latent Perspective-Taking via a Schr\"odinger Bridge in Influence-Augmented Local Models / Kevin Alcedo, Pedro U. Lima, Rachid Alami
日本語で読む → - 論文群制御ロボティクス
AC-MASAC: 異種UAV群協調のための注意機構付きカリキュラム学習フレームワーク
異種UAV群の協調経路計画において、役割認識型の異種注意機構と段階的カリキュラム学習を組み合わせ、非対称な依存関係や報酬の疎さ、破滅的忘却に対処するマルチエージェント強化学習フレームワークを提案した。
原題: AC-MASAC: An Attentive Curriculum Learning Framework for Heterogeneous UAV Swarm Coordination / Wanhao Liu, Junhong Dai, Yixuan Zhang 他
日本語で読む → - 論文触覚ロボティクス
触覚の音:弦振動を用いた能動的音響触覚センシング
張った弦を電磁的に振動させ、接触によるスペクトル変化から接触位置・力・滑りを推定する軽量で拡張可能な触覚センシング手法を提案。
原題: Sound of Touch: Active Acoustic Tactile Sensing via String Vibrations / Xili Yi, Ying Xing, Zachary Manchester 他
日本語で読む → - 論文VLAロボティクス
再帰的深さを持つVLA:潜在的反復推論による視覚言語行動モデルのテスト時計算スケーリング
重み共有の再帰的な行動ヘッドを用いて、推論時に潜在空間での反復的な洗練を行うことで、メモリ使用量を一定に保ちながら計算量を適応的に増やせるVLAアーキテクチャを提案した。
原題: Recurrent-Depth VLA: Implicit Test-Time Compute Scaling of Vision-Language-Action Models via Latent Iterative Reasoning / Yalcin Tur, Jalal Naghiyev, Haoquan Fang 他
日本語で読む → - 論文安全/LLM推論ロボティクス
ARGOS: 属性誘導組合せ推論による身体性AIの機能安全要件自動合成
自然言語指示を物理属性に分解してLLM推論を接地し、ISO 13482などの安全規格を文脈特化した機能安全要件へ自動変換するフレームワークARGOSを提案。
原題: ARGOS: Automated Functional Safety Requirement Synthesis for Embodied AI via Attribute-Guided Combinatorial Reasoning / Dongsheng Chen, Yuxuan Li, Yi Lin 他
日本語で読む → - 論文マニピュレーションロボティクス
高次元ロボット動作計画のためのマルチグラフ探索
複数のグラフを同時に成長させて探索する動作計画アルゴリズムMGSを提案し、マニピュレーションや移動マニピュレーションで有効性を示した。
原題: Multi Graph Search for High-Dimensional Robot Motion Planning / Itamar Mishani, Maxim Likhachev
日本語で読む → - 論文SLAM画像認識
GSO-SLAM: ガウシアンスプラッティングと直接視覚オドメトリの双方向結合
視覚オドメトリとガウシアンスプラッティングをEMフレームワークで双方向に結合し、リアルタイムで高精度な単眼高密度SLAMを実現した研究。
原題: GSO-SLAM: Bidirectionally Coupled Gaussian Splatting and Direct Visual Odometry / Jiung Yeon, Seongbo Ha, Hyeonwoo Yu
日本語で読む → - 論文SLAMロボティクス
LST-SLAM: キロメートル規模の動的環境に対応するステレオ熱画像SLAMシステム
熱画像カメラを用いた大規模動的環境向けステレオSLAMシステムを提案し、自己教師あり特徴学習と動的特徴抑制によりキロメートル規模のデータセットで高精度・高ロバスト性を実現した。
原題: LST-SLAM: A Stereo Thermal SLAM System for Kilometer-Scale Dynamic Environments / Zeyu Jiang, Kuan Xu, Changhao Chen
日本語で読む → - 論文強化学習ロボティクス
戦術的リソース制御と後続機動生成のための時間的行動表現学習
リソース使用と機動の因果関係を対比学習で捉え、離散コードブックで政策を条件付けるTARTを提案。迷路ナビと空戦シミュレータで有効性を示す。
原題: Temporal Action Representation Learning for Tactical Resource Control and Subsequent Maneuver Generation / Hoseong Jung, Sungil Son, Daesol Cho 他
日本語で読む → - 論文sim2realロボティクス
ケーブル駆動ロボットの部分観測可能な動力学をモデル化するグラフニューラルネットワーク
ケーブル駆動ロボットをグラフとして表現し、部分観測入力のみから動力学を学習するGNNシミュレータを提案。実機とシミュレータの共同学習で汎化性を高め、MPPI制御による閉ループナビゲーションで有効性を示した。
原題: CableRobotGraphSim: A Graph Neural Network for Modeling Partially Observable Cable-Driven Robot Dynamics / Nelson Chen, William R. Johnson, Rebecca Kramer-Bottiglio 他
日本語で読む → - 論文マニピュレーションロボティクス
MARVL: 視覚言語モデルによるロボットマニピュレーションの多段階ガイダンス
視覚言語モデルを微調整してタスクを多段階のサブタスクに分解し、密な報酬を自動設計することで、ロボット強化学習のサンプル効率と頑健性を向上させた研究。
原題: MARVL: Multi-Stage Guidance for Robotic Manipulation via Vision-Language Models / Xunlan Zhou, Xuanlin Chen, Shaowei Zhang 他
日本語で読む → - 論文群制御ロボティクス
海上での分散型マルチロボット障害物検出・追跡
複数のUAVと自律型水上艇が協調し、浮遊コンテナを検出・追跡する分散型フレームワークを提案。ステレオ視とYOLOv8、EKF追跡、Covariance Intersectionによる融合、情報駆動型割り当てを統合し、シミュレーションで有効性を示した。
原題: Decentralized Multi-Robot Obstacle Detection and Tracking in a Maritime Scenario / Muhammad Farhan Ahmed, Vincent Frémont
日本語で読む → - 論文VLAロボティクス
FAVLA:接触の多いロボットマニピュレーションのための力適応型高速・低速VLAモデル
低速なVLMによる計画と高速なアクションエキスパートを分離し、力覚フィードバックを適応的に活用することで、接触の多いマニピュレーションの反応性と成功率を向上させるVLAモデルを提案。
原題: FAVLA: A Force-Adaptive Fast-Slow VLA model for Contact-Rich Robotic Manipulation / Yao Li, Peiyuan Tang, Wuyang Zhang 他
日本語で読む → - 論文HRIデザインHCI
未来のHRIデザイン研究におけるモジュール式共同設計の位置づけ
モジュール性をデザインの媒体として捉え、長期の人間-ロボット関係を共同設計で議論可能にする研究プログラムを提示し、PAS(個人化・適応性・持続可能性)の視点を提唱する。
原題: Positioning Modular Co-Design in Future HRI Design Research / Lingyun Chen, Qing Xiao, Zitao Zhang 他
日本語で読む → - 論文sim2realロボティクス
自然言語によるキノダイナミクスモデリングでロボットの構造損傷にゼロショット適応
自然言語で記述された損傷情報を自己教師あり学習でキノダイナミクス挙動に結びつけ、損傷を受けたロボットの順モデルを学習。シミュレータで最大81%の誤差削減を達成し、sim-to-realやスケール間の汎化も示した。
原題: Zero-Shot Adaptation to Robot Structural Damage via Natural Language-Informed Kinodynamics Modeling / Anuj Pokhrel, Aniket Datar, Mohammad Nazeri 他
日本語で読む → - 論文計画/ハイブリッドシステムロボティクス
ハイブリッドゾノトープと混合整数ADMMヒューリスティックによるハイブリッドシステム計画
ハイブリッドシステムの運動計画において、ハイブリッドゾノトープと新しい混合整数ADMMヒューリスティックを組み合わせたフレームワークを提案し、自動運転の行動・運動計画に適用した。
原題: Hybrid System Planning using a Mixed-Integer ADMM Heuristic and Hybrid Zonotopes / Joshua A. Robbins, Andrew F. Thompson, Jonah J. Glunt 他
日本語で読む → - 論文マルチロボット協調ロボティクス
CoLF: 視覚言語ガイド付きマルチロボット協調運搬のための一貫したリーダー・フォロワー方策学習
視覚言語指示に基づくマルチロボット協調運搬において、リーダー・フォロワー役割を安定して分化させるマルチエージェント強化学習フレームワークCoLFを提案し、シミュレーションと実機四足ロボットで有効性を示した。
原題: CoLF: Learning Consistent Leader-Follower Policies for Vision-Language-Guided Multi-Robot Cooperative Transport / Joachim Yann Despature, Kazuki Shibata, Takamitsu Matsubara
日本語で読む → - 論文継続学習/物体認識/ドローン画像認識
屋内ドローンのためのリプレイベース継続的物体認識
屋内ドローン向けの時系列一貫性を保った14,400フレームのデータセットを構築し、限られたメモリ予算下でリプレイベースのクラス増分学習手法を評価した。
原題: Learning on the Fly: Replay-Based Continual Object Perception for Indoor Drones / Sebastian-Ion Nae, Mihai-Eugen Barbu, Sebastian Mocanu 他
日本語で読む → - 論文衝突検出ロボティクス
接触運動学の解析的微分による衝突検出
形状の曲率がゼロや未定義となる退化配置でも滑らかに微分可能な接触運動学を実現するため、形状を厳密凸な陰的表現に正則化し、陰関数定理で接触距離・位置・法線の解析的微分を導出する衝突検出フレームワークiDCOLを提案。
原題: Collision Detection with Analytical Derivatives of Contact Kinematics / Anup Teejo Mathew, Anees Peringal, Daniele Caradonna 他
日本語で読む → - 論文水中ロボットロボティクス
自律水中探査に向けたマンタ型ロボット:羽ばたき運動による遊泳・潜水の実験的検証
マンタの羽ばたきを模したヒレで推進する水中ロボットを開発し、プール実験で安定した遊泳と潜水を実証した。
原題: Biomimetic Mantaray robot toward the underwater autonomous -- Experimental verification of swimming and diving by flapping motion - / Kenta Tabata, Ryosuke Oku, Jun Ito 他
日本語で読む → - 論文強化学習/移動ロボティクス
位相認識型方策学習による四足ロボットのスケートボード乗り
スケートボードの位相に応じて特徴変調層を切り替える強化学習で、四足ロボットがスケートボードを安定して操る方策を学習した。
原題: Phase-Aware Policy Learning for Skateboard Riding of Quadruped Robots via Feature-wise Linear Modulation / Minsung Yoon, Jeil Jeong, Sung-Eui Yoon
日本語で読む → - 論文物理シミュレーションロボティクス
Material Point Methodのための摩擦接触解法
Material Point Method (MPM) における摩擦接触を正確かつロバストに扱うため、接触点検出と摩擦接触則をNonlinear Complementarity Problemとして定式化し、ADMMで解く手法を提案。
原題: Frictional Contact Solving for Material Point Method / Etienne Ménager, Justin Carpentier
日本語で読む → - 論文移動ロボット動作計画ロボティクス
矩形回廊表現による非ホロノミック移動ロボットの高速動作計画
構造化環境を重なり合う矩形回廊のグラフに分解し、探索空間を削減して非ホロノミック移動ロボットの準時間最適で運動学的に実行可能な軌道を高速に生成するフレームワークを提案した。
原題: Fast Motion Planning for Non-Holonomic Mobile Robots via a Rectangular Corridor Representation of Structured Environments / Alejandro Gonzalez-Garcia, Sebastiaan Wyns, Sonia De Santis 他
日本語で読む → - 論文人間ロボット協働画像認識
人間とロボットの協働絵画におけるパッチベースの空間的著者帰属
人間とロボットが共同制作した15点の抽象画をスキャナで読み取り、パッチ単位でどちらが描いたかを88.8%の精度で識別する手法を提案し、混合領域の不確実性も定量化した。
原題: Patch-Based Spatial Authorship Attribution in Human-Robot Collaborative Paintings / Eric Chen, Patricia Alves-Oliveira
日本語で読む → - 論文VLAロボティクス
VLAW:視覚-言語-行動ポリシーと世界モデルの反復的相互改善
実ロボットのロールアウトデータで世界モデルの精度を高め、その世界モデルが生成する合成データでVLAモデルを改善する反復手法を提案し、実タスクで成功率を39.2%向上させた。
原題: VLAW: Iterative Co-Improvement of Vision-Language-Action Policy and World Model / Yanjiang Guo, Tony Lee, Lucy Xiaoyang Shi 他
日本語で読む →