論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文模倣学習機械学習
行動チャンク型模倣学習におけるマルチモーダル失敗の理解
行動チャンク型ポリシーで同じ観察に複数の正解行動がある場合の失敗メカニズムを分析し、潜在変数型と生成型の各パラメータ化の特性を明らかにした。
原題: Understanding Multimodal Failure in Action-Chunking Behavioral Cloning / Lorenzo Mazza, Massimiliano Datres, Ariel Rodriguez 他
日本語で読む → - 論文模倣学習ロボティクス
ロボット制御における分布シフト問題の緩和:オフラインからオンラインへの模倣学習に基づくロバストかつ適応的なアプローチ
専門家デモの状態-行動カバレッジ不足による分布シフト問題に対し、補助デモでロバスト性を高め、オンラインで自己教師あり学習により適応する枠組みを提案した。
原題: How to Mitigate the Distribution Shift Problem in Robotics Control: A Robust and Adaptive Approach Based on Offline to Online Imitation Learning / Hyung-Suk Yoon, Seung-Woo Seo
日本語で読む → - 論文模倣学習機械学習
強化学習駆動模倣学習のための教師-生徒表現整合
教師と生徒の観測空間の違いによる模倣ギャップを、共有埋め込み空間を自己教師あり学習で構築し、教師が特権情報に依存できないようにすることで低減する新しいアルゴリズムを提案した。
原題: Teacher-Student Representational Alignment for Reinforcement Learning-Driven Imitation Learning / Meraj Mammadov, Pedro Zuidberg Dos Martires, Johannes Andreas Stork
日本語で読む → - 論文模倣学習ロボティクス
FocalPolicy: 周波数最適化チャンキングと局所アンカー付きフローマッチングによる一貫性のある視覚運動ポリシー
視覚運動ポリシーにおけるチャンク間の不連続性を解決するため、周波数最適化チャンキングと局所アンカー付きフローマッチングを組み合わせたFocalPolicyを提案した。
原題: FocalPolicy: Frequency-Optimized Chunking and Locally Anchored Flow Matching for Coherent Visuomotor Policy / Qian He, Zhenshuo Yang, Wenqi Liang 他
日本語で読む → - 論文模倣学習ロボティクス
デモンストレーション周辺での適応的探索のためのエルゴード模倣
模倣学習における訓練と実環境のミスマッチに対応するため、デモの幾何学的構造から目標分布を構築し、追従と探索を適応的に切り替えるエルゴード制御に基づく軌道生成手法を提案した。
原題: Ergodic Imitation for Adaptive Exploration around Demonstrations / Ziyi Xu, Cem Bilaloglu, Yiming Li 他
日本語で読む → - 論文模倣学習/操作ロボティクス
人間の遠隔操作データから学ぶ、シミュレーション基盤の双腕ロープ操作ポリシー
この論文は、結び目を解くタスクにおいて、視覚ベースのポリシーよりも物理状態ベースのポリシーの方が汎化性能が高いことを示し、観測空間の選択が重要であることを明らかにした。
原題: Learning Sim-Grounded Policies for Bimanual Rope Manipulation from Human Teleoperation Data / Gina Wigginghaus, Tim Missal, Berk Guler 他
日本語で読む → - 論文模倣学習/技能合成ロボティクス
述語と行動の同時学習によるゼロショット技能合成
ロボットの模倣学習において、行動とその象徴的な結果(述語)を同時に生成する新しいポリシーを提案し、学習済み技能のゼロショット合成を可能にした。
原題: Jointly Learning Predicates and Actions Enables Zero-Shot Skill Composition / Benedict Quartey, Sebastian Castro, Eric Rosen 他
日本語で読む → - 論文模倣学習ロボティクス
失敗デモデータの活用法:注意機構の分布差を利用した模倣学習の効果的データ選択
成功デモのみで訓練されることが多い模倣学習において、収集時に得られる失敗データを注意機構に組み込むことで活用し、初期観察から適切なモードを選択して行動安定性を向上させる手法を提案。さらに、失敗サンプルと成功デモ間の注意差を定量化する指標で学習に有益な失敗データを選別する。
原題: How to Utilize Failure Demo Data?: Effective Data Selection for Imitation Learning Using Distribution Differences in Attention Mechanism / Kana Miyamoto, Kanata Suzuki, Tetsuya Ogata
日本語で読む → - 論文模倣学習ロボティクス
Demo-JEPA: ワンショット異種エンボディメント模倣のための共同埋め込み予測アーキテクチャ
デモンストレーションを動作ではなく将来の目標状態として捉え、JEPAベースの世界モデルで視覚デモを目標エージェントの潜在軌跡に変換し、自己の学習済みダイナミクスで計画・実行する異種エンボディメント模倣フレームワークを提案。
原題: Demo-JEPA: Joint-Embedding Predictive Architecture for One-shot Cross-Embodiment Imitation / Jingyang He, Guangrun Li, Jieyu Zhang 他
日本語で読む → - 論文模倣学習/データ収集/VRロボティクス
VR-DAgger: 没入型VRによる器用なデータ収集と不確実性誘導型オン方策修正
VR環境で人間がロボットのデモンストレーションを収集し、拡散ポリシーの不確実性が高い失敗区間を自動選択して人間が修正するフレームワークを提案し、器用な操作タスクで性能を向上させた。
原題: VR-DAgger: Immersive VR for Dexterous Data Collection and Uncertainty-Guided On-Policy Correction / René Zurbrügg, Tifanny Portela, Arjun Bhardwaj 他
日本語で読む → - 論文模倣学習/手術支援ロボティクス
開腹手術におけるロボット支援のための模倣学習:縫合追従動作における複数ポリシーの評価
開腹手術での縫合補助動作(掴む・引く・離す)を対象に、4種類の模倣学習ポリシーを比較評価し、π0が最も高い性能とデータ効率を示した。
原題: Imitation Learning for Robot Assistance in Open Surgery: A Multi-Policy Evaluation on Suture Following / Xucheng Wang, Zhizhou Yang, Xiaoman Zhang 他
日本語で読む → - 論文模倣学習ロボティクス
低解像度自己中心視覚を用いた能動的知覚のための行動クローニング
低解像度の自己中心視覚と行動クローニングを用いて、ロボットアームが物体を見つけて把持するための能動的知覚を獲得できることを示した論文。
原題: Behavior Cloning for Active Perception with Low-Resolution Egocentric Vision / Anthony Bilic, Chen Chen, Ladislau Bölöni
日本語で読む → - 論文強化学習/模倣学習/操作ロボティクス
行動残差を超えて:ボトルネック潜在強化学習による実世界ロボットポリシーの操縦
事前学習済みの模倣ポリシーを、行動空間ではなくボトルネック潜在空間で強化学習により微調整する手法ZPRLを提案し、シミュレーションと実世界の操作タスクで性能を向上させた。
原題: Beyond Action Residuals: Real-World Robot Policy Steering via Bottleneck Latent Reinforcement Learning / Dongjie Yu, Kun Lei, Zhennan Jiang 他
日本語で読む → - 論文模倣学習/能動視覚/ベンチマークロボティクス
TAVIS: 模倣学習における自己中心視覚と予期的注視のベンチマーク
模倣学習における能動視覚の評価基盤TAVISを提案し、頭部・手首カメラの2つのタスク群と予期的注視を測る新指標GALTを導入した。
原題: TAVIS: A Benchmark for Egocentric Active Vision and Anticipatory Gaze in Imitation Learning / Giacomo Spigler
日本語で読む → - 論文模倣学習/データ生成ロボティクス
模倣学習のための高忠実度合成デモンストレーション生成の原理的アプローチ
3Dガウススプラッティングと動的運動プリミティブを組み合わせ、専門家の軌道構造を保ちつつ多様な合成デモを生成するフレームワークを提案。障害物回避も考慮し、接触を伴う操作タスクの学習に有効なデータを生成する。
原題: A Principled Approach for Creating High-fidelity Synthetic Demonstrations for Imitation Learning / Moniruzzaman Akash, Momotaz Begum
日本語で読む → - 論文計画/模倣学習AI
シンボリック世界モデル上の二段階ポリシー学習による長期的計画
低レベルの模倣学習と高レベルのシンボリック抽象化を組み合わせた二段階ポリシーを提案し、長期的な計画問題を効率的に解決するシステムBISONを実装した。
原題: Learning Bilevel Policies over Symbolic World Models for Long-Horizon Planning / Dillon Z. Chen, Till Hofmann, Toryn Q. Klassen 他
日本語で読む → - 論文模倣学習ロボティクス
キーポイント模倣学習の汎化能力、設計選択、および限界について
RGBベースの模倣学習の汎化を改善するため、視覚基盤モデルによるキーポイント表現を用いた模倣学習(KIL)の設計選択を検討し、実機2000回以上の試行で評価。KILはRGBベースライン(47%)を上回る75%の成功率を達成し、S2拡散モデルと同等の性能を示した。
原題: On the Generalization Capabilities, Design Choices and Limitations of Keypoint Imitation Learning / Thomas Lips, Marco Moletta, Michael C. Welle 他
日本語で読む → - 論文模倣学習ロボティクス
MARSポリシー:必要な時だけマルチモーダルに
ロボット操作の模倣学習において、タスクの全フェーズで多様性が必要とは限らないことに着目し、必要な時だけ確率的生成を適応的に行い、単一モードのフェーズでは決定的学習に切り替えるMARSポリシーを提案した。シミュレーションと実機で成功率向上と推論遅延削減を実証した。
原題: MARS Policy: Multimodality Only When It Matters / Jindou Jia, Tuo An, Yuxuan Hu 他
日本語で読む → - 論文模倣学習ロボティクス
X-Imitator: 双方向アクション・ポーズ相互作用による空間認識模倣学習
空間認識と行動生成を双方向ループで結びつけ、相互に洗練させる新しい模倣学習フレームワークを提案。24のシミュレーションと3つの実世界タスクで性能を実証した。
原題: X-Imitator: Spatial-Aware Imitation Learning via Bidirectional Action-Pose Interaction / Kai Xiong, Hongjie Fang, Lixin Yang 他
日本語で読む → - 論文模倣学習ロボティクス
HumanEgo: 人間の一人称視点動画数分からのゼロショットロボット学習
人間の一人称視点動画からロボット操作スキルをゼロショットで転移するフレームワークを提案。手と物体の相互作用をエンティティレベルで表現し、フローマッチングポリシーと補助損失で学習することで、ロボットデータ不要で高効率な学習を実現した。
原題: HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos / Zhi Wang, Botao He, Kelin Yu 他
日本語で読む → - 論文模倣学習ロボティクス
表面拘束ポリシー:表面拘束かつ動的に実現可能なロボットスキルの学習
拡散ベースの模倣学習に表面形状の拘束と動的実現可能性を組み込み、自由曲面に沿ったロボット動作を生成する新しいポリシーを提案した。
原題: Surface Constraint Policy for Learning Surface-Constrained and Dynamically Feasible Robot Skills / Shuai Ke, Jiexin Zhang, Huan Zhao 他
日本語で読む → - 論文模倣学習ロボティクス
悪い中に良いものを見つける(GiB):エンドユーザーのデモンストレーションからより良い方策を学習するための選別手法
非熟練ユーザーのデモンストレーションに含まれる誤ったサブタスクを自動的に検出・除去し、高品質なサブタスクのみを学習に用いることで、ロボットの方策性能を向上させるアルゴリズムGiBを提案した。
原題: Good in Bad (GiB): Sifting Through End-user Demonstrations for Learning a Better Policy / Noushad Sojib, Ola Ghattas, Momotaz Begum
日本語で読む → - 論文模倣学習ロボティクス
模倣学習のための計装化:ハンガー挿入タスクの訓練データセット強化
物体にセンサを組み込む計装化により、ロボットの模倣学習の効率を高める手法を提案し、ハンガー挿入タスクで計装データを使うと視覚のみより成功率が14〜25%向上することを示した。
原題: Instrumentation for Imitation Learning: Enhancing Training Datasets for Clothes Hanger Insertion / Remko Proesmans, Thomas Lips, Francis wyffels
日本語で読む → - 論文移動操作/模倣学習ロボティクス
Mobile UMI: 移動操作のための分離された運動学を備えたクロスビュー拡散ポリシー
移動模倣学習における移動と操作の結合問題を解決するため、デュアルカメラと空間アンカーで操作とベース軌道を分離し、非同期実行で遅延を補正するフレームワークを提案した。
原題: Mobile UMI: Cross-View Diffusion Policy with Decoupled Kinematics for Mobile Manipulation / Haoran Huang, Haonan Dong, Huixu Dong
日本語で読む → - 論文模倣学習ロボティクス
非ホロノミック移動台車と双腕の協調制御のための拡散ポリシー:ドア開閉と通過
拡散モデルに基づく視覚運動制御ポリシーを用いて、非ホロノミック移動台車と双腕を協調させ、重いドアの開閉と通過をエンドツーエンドで学習する手法を提案した。
原題: Diffusion Policy for Coordinated Control of a Nonholonomic Mobile Base and Dual Arms in Door Opening and Passing / Shangqun Yu, Matthew En, Daniel Wu 他
日本語で読む → - 論文模倣学習/ヒューマノイドロボティクス
動画からのヒューマノイド模倣学習のための直接動的リターゲティング
単眼ビデオからヒューマノイドの模倣学習を行う際、従来の幾何学的リターゲティングが持つバイアスを排除し、物理シミュレータ内で直接動的軌道を生成する新しいフレームワークを提案した。
原題: Direct Dynamic Retargeting for Humanoid Imitation Learning from Videos / Constant Roux, Ludovic De Matteïs, Armand Jordana 他
日本語で読む → - 論文模倣学習/逆強化学習ロボティクス
拡散ベースのポリシーにおける隠れた報酬の回復
拡散モデルと逆強化学習を統合し、スコア関数が専門家のソフトQ関数の勾配を回復することを利用して、敵対的学習なしで報酬を抽出するフレームワークを提案した。
原題: Recovering Hidden Reward in Diffusion-Based Policies / Yanbiao Ji, Qiuchang Li, Yuting Hu 他
日本語で読む → - 論文模倣学習/拡散ポリシー/説明可能性ロボティクス
SADP: 基盤モデル生成デモから学習するサブゴール認識拡散ポリシーによる説明可能なロボット
基盤モデルでサブゴール注釈付きデモを自動生成し、そのデータで拡散ポリシーを訓練することで、ロボットが実行中のサブタスクを説明可能にしつつ成功率も向上させる手法を提案した。
原題: SADP: Subgoal-Aware Diffusion Policy for Explainable Robots Learned from Foundation Model Generated Demonstrations / Site Hu, Takato Horii
日本語で読む → - 論文模倣学習ロボティクス
データ効率的なロボット模倣学習のためのマルチカメラ視点スケーリング
デモ収集時に複数のカメラ視点を用いて擬似デモを生成し、データ効率と汎化性を向上させる模倣学習フレームワークを提案した。
原題: Multi-Camera View Scaling for Data-Efficient Robot Imitation Learning / Yichen Xie, Yixiao Wang, Shuqi Zhao 他
日本語で読む → - 論文模倣学習/操作ロボティクス
チューブ拡散ポリシー:接触を伴う操作のための反応的視覚触覚ポリシー学習
接触を伴う操作において、視覚と触覚のフィードバックに基づいて即座に適応できるよう、拡散モデルとチューブベースのフィードバック制御を組み合わせた新しいポリシー学習フレームワークを提案した。
原題: Tube Diffusion Policy: Reactive Visual-Tactile Policy Learning for Contact-rich Manipulation / Teng Xue, Alberto Rigo, Bingjian Huang 他
日本語で読む →