論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文変形物体操作ロボティクス
RopeDreamer: 柔軟な変形可能線状物体のダイナミクスのための運動学的リカレント状態空間モデル
柔軟な変形可能線状物体(DLO)の操作を高精度に予測するため、クォータニオンによる運動学的連鎖表現とリカレント状態空間モデルを組み合わせた潜在ダイナミクスモデルを提案した。自己交差を含む複雑な軌道で、50ステップ予測誤差を40.52%削減し、推論時間も31.17%短縮した。
原題: RopeDreamer: A Kinematic Recurrent State Space Model for Dynamics of Flexible Deformable Linear Objects / Tim Missal, Lucas Domingues, Berk Guler 他
日本語で読む → - 論文全身制御ロボティクス
SMASH: 自己中心視覚によるヒューマノイド卓球のスケーラブルな全身スキルの習得
外部センサに頼らず、自己中心視覚のみで連続打撃可能なヒューマノイド卓球システムを構築し、全身協調動作と生成モデルによる多様な打撃動作の学習を実現した。
原題: SMASH: Mastering Scalable Whole-Body Skills for Humanoid Ping-Pong with Egocentric Vision / Junli Ren, Yinghui Li, Kai Zhang 他
日本語で読む → - 論文3Dインスタンス分割画像認識
SpaCeFormer: 提案不要の高速オープンボキャブラリ3Dインスタンス分割
3Dシーンを空間曲線トランスフォーマーで直接インスタンス分割する提案不要の手法を開発し、従来より2〜3桁高速化。大規模データセットも構築した。
原題: SpaCeFormer: Fast Proposal-Free Open-Vocabulary 3D Instance Segmentation / Chris Choy, Junha Lee, Chunghyun Park 他
日本語で読む → - 論文人間ロボット協調ロボティクス
不確実性保証を備えた視覚ベースの安全な人間ロボット協調
人間のポーズ推定と動作予測にコンフォーマル予測を適用し、確率的に安全な人間ロボット協調を実現する枠組みを提案した。
原題: Vision-Based Safe Human-Robot Collaboration with Uncertainty Guarantees / Jakob Thumm, Marian Frei, Tianle Ni 他
日本語で読む → - 論文運転注意予測画像認識
シーンから物体へ:テキスト誘導による二重視線予測
運転者の物体レベルの注意予測を実現するため、データ構築からモデル設計までの新しい枠組みを提案し、マルチモーダル大規模言語モデルとSAM3を用いて物体レベルの視線データセットを構築し、デュアルブランチの視線予測モデルを開発した。
原題: From Scene to Object: Text-Guided Dual-Gaze Prediction / Zehong Ke, Yanbo Jiang, Jinhao Li 他
日本語で読む → - 論文動作生成math.HO
指揮パターンのための最小数学モデル
指揮動作の幾何学的軌道と時間的パラメータ化を分離した最小数学モデルを提案し、キュービック・エルミート補間とクインティックタイミング則を用いて表現力豊かな指揮ジェスチャを生成する。
原題: A Minimal Mathematical Model for Conducting Patterns / Tom Verhoeff
日本語で読む → - 論文群制御ロボティクス
動的ケーブル長調整を備えた人間-クアッドローター協調搬送のためのタスク適応型アドミッタンス制御
人間とクアッドローターが協力して荷物を運ぶ際に、ケーブル長を動的に調整しながら接触力に適応するアドミッタンス制御を提案し、実験でその有効性を検証した。
原題: Task-Adaptive Admittance Control for Human-Quadrotor Cooperative Load Transportation with Dynamic Cable-Length Regulation / Shuai Li, Ton T. H. Duong, Damiano Zanotto
日本語で読む → - 論文SLAM/オドメトリロボティクス
RadarSplat-RIO: ガウススプラッティングに基づくレーダーバンドル調整を用いた屋内レーダー慣性オドメトリ
レーダーSLAMのドリフト問題を解決するため、ガウススプラッティングによる密度の高い微分可能なシーン表現を用いた初のレーダーバンドル調整フレームワークを提案し、既存のレーダー慣性オドメトリと統合して精度を大幅に向上させた。
原題: RadarSplat-RIO: Indoor Radar-Inertial Odometry with Gaussian Splatting-Based Radar Bundle Adjustment / Pou-Chun Kung, Yuan Tian, Zhengqin Li 他
日本語で読む → - 論文スキル転移ロボティクス
部品分解によるワンショット形状横断スキル転移
デモンストレーションから物体を意味的部品に分解し、生成形状モデルを用いて相互作用点を新規物体へ転移させることで、未知形状へのスキル転移を実現した。
原題: One-Shot Cross-Geometry Skill Transfer through Part Decomposition / Skye Thompson, Ondrej Biza, George Konidaris
日本語で読む → - 論文イベントベース知覚/強化学習/ロボット制御ロボティクス
生物学的に着想を得たイベントベース知覚と高効率学習による高速卓球ロボット
高速卓球ロボット向けに、イベントカメラを用いたボール検出と、低速から高速へ段階的に学習するサンプル効率的な方策訓練を組み合わせた手法を提案した。
原題: Biologically Inspired Event-Based Perception and Sample-Efficient Learning for High-Speed Table Tennis Robots / Ziqi Wang, Jingyue Zhao, Xun Xiao 他
日本語で読む → - 論文位置推定ロボティクス
事前地図を活用したロボット位置推定のための学習ベース階層シーングラフマッチング
ロボットのセンサデータから構築したシーングラフとBIMなどの事前地図を階層的にマッチングし、SLAMのドリフト補正を高速かつ高精度に行う学習ベース手法を提案した。
原題: Learning-Based Hierarchical Scene Graph Matching for Robot Localization Leveraging Prior Maps / Nimrod Millenium Ndulue, Jose Andres Millan-Romera, Matteo Giorgi 他
日本語で読む → - 論文群制御ロボティクス
軌道上宇宙AI:衛星コンステレーションのための連合・マルチエージェント・協調アルゴリズム
衛星コンステレーションの自律運用に向けたAI研究を、連合学習・マルチエージェント・協調センシングの3つのパラダイムで体系的に整理したサーベイ論文。
原題: On-Orbit Space AI: Federated, Multi-Agent, and Collaborative Algorithms for Satellite Constellations / Ziyang Wang
日本語で読む → - 論文ヒューマノイド操作ロボティクス
触覚ドリーミングによる多用途ヒューマノイド操作の学習
ヒューマノイドの全身操作を安定させるRLベースの下半身制御とVRデータ収集システムを開発し、触覚を主要モダリティとして扱うマルチモーダルトランスフォーマーHTDを提案。触覚の潜在予測により接触認識表現を学習し、実世界の接触豊富なタスクで成功率を大幅に向上させた。
原題: Learning Versatile Humanoid Manipulation with Touch Dreaming / Yaru Niu, Zhenlong Fang, Binghong Chen 他
日本語で読む → - 論文外骨格/腱駆動/リハビリテーションロボティクス
上肢外骨格用の腱駆動手首外転-内転機構の設計・モデリング・実験評価
手首外骨格のための単一ケーブルとぜんまいばねを用いた軽量な腱駆動機構を提案し、シミュレーションによるばね剛性選定法とプロトタイプの実験評価を行った。
原題: Design, Modelling and Experimental Evaluation of a Tendon-driven Wrist Abduction-Adduction Mechanism for an upper limb exoskeleton / Juwairiya S. Khan, Mostafa Mohammadi, John Rasmussen 他
日本語で読む → - 論文器用操作ロボティクス
FingerViP: 指先視覚知覚による実世界器用操作の学習
指先に小型カメラを搭載したモジュールを多指ハンドの各指に取り付け、第三視点カメラと多視点指先視覚を組み合わせた拡散ベースの全身ビジュモータポリシーを提案し、実世界の複雑な操作タスクを実証した。
原題: FingerViP: Learning Real-World Dexterous Manipulation with Fingertip Visual Perception / Zhen Zhang, Weinan Wang, Hejia Sun 他
日本語で読む → - 論文VLAロボティクス
StarVLA: 視覚言語行動モデル開発のためのレゴ風コードベース
VLA研究の断片化を解消するため、モジュール式のバックボーン・アクションヘッド構造と統一評価インターフェースを備えたオープンソースコードベースStarVLAを提案した。
原題: StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing / StarVLA Community
日本語で読む → - 論文群制御ロボティクス
集団行動のモデルを評価するロボット学習
生体模倣ロボット魚を用いて、強化学習により魚の行動モデルを閉ループで評価する枠組みを提案し、シミュレーションから実機への転移でモデルの忠実度を定量比較した。
原題: Robots that learn to evaluate models of collective behavior / Mathis Hocke, Andreas Gerken, David Bierbach 他
日本語で読む → - 論文VLAロボティクス
PokeVLA: 包括的な世界知識の指導によるポケットサイズの視覚言語行動モデルの強化
この論文は、ロボット操作のための軽量な視覚言語行動モデルPokeVLAを提案し、2段階のトレーニングと新しいアクションエキスパートにより、LIBERO-Plusベンチマークと実世界で高い性能を達成した。
原題: PokeVLA: Empowering Pocket-Sized Vision-Language-Action Model with Comprehensive World Knowledge Guidance / Yupeng Zheng, Xiang Li, Songen Gu 他
日本語で読む → - 論文ナビゲーションロボティクス
ハミルトン・ヤコビ到達可能性に基づく探索フレームワークによる屋内平面ロボットの効率的かつ安全なナビゲーション
オフラインのHJ到達可能性計算をオンラインのグラフ探索に組み合わせ、動的環境でも効率的かつ安全なナビゲーションを実現する手法を提案した。
原題: A Hamilton-Jacobi Reachability-Guided Search Framework for Efficient and Safe Indoor Planar Robot Navigation / Hanyang Hu, Cameron Siu, Mo Chen
日本語で読む → - 論文VLA/操作ロボティクス
STARRY: ロボット操作のための時空間アクション中心世界モデル
将来の時空間予測とアクション生成を統一拡散プロセスで統合し、幾何学的注意変調により3次元制御を強化する世界モデル拡張型VLAポリシーを提案。
原題: STARRY: Spatial-Temporal Action-Centric World Modeling for Robotic Manipulation / Yuxuan Tian, Yurun Jin, Bin Yu 他
日本語で読む → - 論文ローカライゼーション画像認識
COMPASS: フロアプランに基づく視覚的ローカライゼーションのためのコンパクトなマルチチャネル事前地図とシーンシグネチャ
フロアプランの幾何情報と意味情報を活用し、二つの魚眼カメラを搭載したロボットの位置姿勢を推定するアルゴリズムを提案した。
原題: COMPASS: COmpact Multi-channel Prior-map And Scene Signature for Floor-Plan-Based Visual Localization / Muhammad Shaheer, Miguel Fernandez-Cortizas, Asier Bikandi-Noya 他
日本語で読む → - 論文摩擦推定ロボティクス
材料埋め込みとプロキシ相互作用モデリングによる一般化可能な摩擦係数推定
少数のプロキシ材料との摩擦測定から各材料の埋め込みを学習し、任意の材料ペアの摩擦係数を推定するフレームワークを提案。実験回数を大幅に削減しつつ高精度な予測を実現した。
原題: Generalizable Friction Coefficient Estimation via Material Embedding and Proxy Interaction Modeling / Zhendong Wang, Huamin Wang
日本語で読む → - 論文移動操作ロボティクス
CMP: 能力多様体投影による移動操作の堅牢な全身追従
脚式移動マニピュレータの全身制御において、センサノイズや非現実的なユーザーコマンドによる分布外入力への堅牢性を高めるため、能力多様体投影(CMP)を提案した。
原題: CMP: Robust Whole-Body Tracking for Loco-Manipulation via Competence Manifold Projection / Ziyang Cheng, Haoyu Wei, Hang Yin 他
日本語で読む → - 論文強化学習/UAVロボティクス
限られたシミュレーション訓練下での捜索救助UAVミッションにおける目標条件付き強化学習のためのルールベース高レベルコーチング
固定ルールの高レベルアドバイザとオンライン学習する低レベル強化学習コントローラを組み合わせた階層型意思決定フレームワークを提案し、限られた訓練環境でも早期の安全性とサンプル効率を向上させる。
原題: Rule-based High-Level Coaching for Goal-Conditioned Reinforcement Learning in Search-and-Rescue UAV Missions Under Limited-Simulation Training / Mahya Ramezani, Holger Voos
日本語で読む → - 論文操作学習ロボティクス
LaST-R1: 適応的物理潜在推論によるロボット操作の強化学習強化
ロボット操作の基盤モデルに対し、潜在推論と行動生成を共同最適化する強化学習フレームワークを提案し、LIBEROベンチマークで99.9%の成功率を達成した。
原題: LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning / Hao Chen, Jiaming Liu, Zhonghao Yan 他
日本語で読む → - 論文自律システムcs.LO
ODD耐性を持つ自律システムのための形式的保証付き制御適応
運用設計領域外の状況に対応するため、確率的システムモデルを適応させつつ定量的な保証を提供する手法を提案した。予期しない状況下でもシステムの信頼性を向上できることを示した。
原題: Formally Guaranteed Control Adaptation for ODD-Resilient Autonomous Systems / Gricel Vázquez, Calum Imrie, Sepeedeh Shahbeigi 他
日本語で読む → - 論文3D生成/サーベイロボティクス
具身AIとロボットシミュレーションのための3D生成:サーベイ
本論文は、具身AIとロボットシステムにおける3D生成の役割を、データ生成、シミュレーション環境構築、Sim2Real橋渡しの3つの観点から整理したサーベイである。物理的整合性やインタラクション対応など、視覚的リアリズムを超えた要件に焦点を当て、現状の課題を分析している。
原題: 3D Generation for Embodied AI and Robotic Simulation: A Survey / Tianwei Ye, Yifan Mao, Minwen Liao 他
日本語で読む → - 論文群制御機械学習
BOIL: 環境の個別情報を学習する
複雑な環境でのマルチエージェントシステム向けに、PageRankと共通情報最大化を用いて環境構造から有用な情報を抽出し、長期的な行動を導く手法を提案した。
原題: BOIL: Learning Environment Personalized Information / Rohan Patil, Henrik I. Christensen
日本語で読む → - 論文SLAMロボティクス
GNSS劣化環境における絶対精度評価のためのRTK-SLAMデータセット
RTK-SLAMの絶対精度を正しく評価するための、測地基準に基づくデータセットと評価手法を提案した論文。
原題: An RTK-SLAM Dataset for Absolute Accuracy Evaluation in GNSS-Degraded Environments / Wei Zhang, Vincent Ress, David Skuddis 他
日本語で読む → - 論文VLAロボティクス
Libra-VLA: 非同期の粗密デュアルシステムによる学習均衡の実現
VLAモデルを粗い意図予測と細かい動作生成の2段階に分離し、学習負荷の均衡と非同期実行を実現する新しいアーキテクチャを提案した。
原題: Libra-VLA: Achieving Learning Equilibrium via Asynchronous Coarse-to-Fine Dual-System / Yifei Wei, Linqing Zhong, Yi Liu 他
日本語で読む →