論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
LILAC: 言語条件付きオブジェクト中心オプティカルフローによるオープンループ軌道生成
人間やWeb動画から学習可能なフローベースの軌道生成を用いて、言語指示に従った物体操作を実現する手法を提案。指示とフローを整合させる損失関数とクロスモーダルアダプタを導入し、既存手法より高品質なフロー生成と高いタスク成功率を達成した。
原題: LILAC: Language-Conditioned Object-Centric Optical Flow for Open-Loop Trajectory Generation / Motonari Kambara, Koki Seno, Tomoya Kaichi 他
日本語で読む → - 論文VLAロボティクス
StreamingVLA: アクションフローマッチングと適応的早期観察によるストリーミング型視覚言語行動モデル
VLAモデルの推論遅延を、アクション生成と実行、観察を非同期に並列化するストリーミング方式で削減し、実行の流暢性を向上させた。
原題: StreamingVLA: Streaming Vision-Language-Action Model with Action Flow Matching and Adaptive Early Observation / Yiran Shi, Dongqi Guo, Tianchen Zhao 他
日本語で読む → - 論文3D物体検出画像認識
CoIn3D:構成不変なマルチカメラ3D物体検出の再考
マルチカメラ3D物体検出モデルが未知のカメラ構成にうまく一般化できない問題を解決するため、空間事前情報を明示的に組み込んだCoIn3Dフレームワークを提案した。
原題: CoIn3D: Revisiting Configuration-Invariant Multi-Camera 3D Object Detection / Zhaonian Kuang, Rui Ding, Haotian Wang 他
日本語で読む → - 論文状態推定ロボティクス
等変フィルタ変換による一貫性と効率性を備えた視覚慣性航法
視覚慣性航法において、異なる対称性を持つ等変フィルタ間の変換則を導出し、一貫性を保証しつつ計算効率を向上させる手法を提案した。
原題: Equivariant Filter Transformations for Consistent and Efficient Visual--Inertial Navigation / Chungeng Tian, Fenghua He, Ning Hao
日本語で読む → - 論文マニピュレーションロボティクス
受動的監視から能動的防御へ:サイバー攻撃下におけるマニピュレータのレジリエント制御
冗長マニピュレータに対するステルス的な偽データ注入攻撃に対し、異常スコアに基づいて制御入力を減衰させる能動的防御手法を提案し、攻撃によるエンドエフェクタの偏差を低減しつつ通常時の性能を維持できることを示した。
原題: From Passive Monitoring to Active Defence: Resilient Control of Manipulators Under Cyberattacks / Gabriele Gualandi, Alessandro V. Papadopoulos
日本語で読む → - 論文ヒューマノイド/マニピュレーションロボティクス
FAME: 全身ヒューマノイドの操作範囲を拡大する力適応型強化学習
上半身の姿勢と両手にかかる力を潜在表現として取り込み、外力下でもバランスを保つ立ち姿勢ポリシーを強化学習で獲得。力覚センサなしで実機ヒューマノイドに適用可能。
原題: FAME: Force-Adaptive RL for Expanding the Manipulation Envelope of a Full-Scale Humanoid / Niraj Pudasaini, Yutong Zhang, Jensen Lavering 他
日本語で読む → - 論文群制御制御
未知の逃避者戦略に対する包囲を保証する有限時間捕獲
2次元無界環境で複数の追跡者が単一の逃避者を包囲しながら有限時間で捕獲する戦略を提案し、逃避者の戦略に依存しない捕獲時間の上限を導出した。
原題: Encirclement Guaranteed Finite-Time Capture against Unknown Evader Strategies / Dinesh Patra, Prajakta Surve, Ashish R. Hota 他
日本語で読む → - 論文触覚/近接センサロボティクス
3Dプリント全身触覚・近接センサによる設計、マッピング、接触予測
3Dプリントで作れる全身用人工皮膚を開発し、触覚と近接センサを統合して接触を事前に予測する手法を提案。ロボットの全身に装着可能で、最大18cmの検出範囲を実現し、周囲空間の知覚マッピングとオンラインでの接触予測を実証した。
原題: Design, Mapping, and Contact Anticipation with 3D-printed Whole-Body Tactile and Proximity Sensors / Carson Kohlbrenner, Anna Soukhovei, Caleb Escobedo 他
日本語で読む → - 論文データキュレーションロボティクス
実際に測定できる多様性:ロボットデータセットのための高速でモデルフリーな多様性指標
模倣学習用ロボットデータセットの多様性を、シグネチャ変換に基づくエントロピーで定量化し、多様性を最大化するデータ選択アルゴリズムFAKTUALを提案した。
原題: Diversity You Can Actually Measure: A Fast, Model-Free Diversity Metric for Robotics Datasets / Sreevardhan Sirigiri, Nathan Samuel de Lara, Christopher Agia 他
日本語で読む → - 論文歩行ロボティクス
散らかった空間を移動する:VRによる3Dシーン認識型ヒューマノイド歩行のデータ収集とベンチマークのスケーリング
VRを使って散らかった3D環境での人間の全身運動を収集し、ヒューマノイドロボットに再ターゲットするフレームワークを提案。145のシーンで348の軌道からなるデータセットを構築し、歩行性能を評価するベンチマークを導入した。
原題: Moving Through Clutter: Scaling Data Collection and Benchmarking for 3D Scene-Aware Humanoid Locomotion via Virtual Reality / Beichen Wang, Yuanjie Lu, Linji Wang 他
日本語で読む → - 論文動作キャプチャ画像認識
接地反力慣性ポーザー:スパースIMUとインソール圧力センサによる物理ベースの人間動作キャプチャ
IMUと足裏圧力センサを組み合わせ、物理シミュレータ上のデジタルツインを制御して物理的に妥当な全身動作を再構成する手法GRIPを提案した。
原題: Ground Reaction Inertial Poser: Physics-based Human Motion Capture from Sparse IMUs and Insole Pressure Sensors / Ryosuke Hori, Jyun-Ting Song, Zhengyi Luo 他
日本語で読む → - 論文外骨格/高齢者支援ロボティクス
タスク非依存型外骨格制御による高齢者の股関節負担軽減:股関節中心動作時の関節エネルギー支援
高齢者の股関節に着目し、タスクに依存しない外骨格制御を実装し、歩行や階段昇降など複数の動作で生体力学的な仕事量を削減できることを実証した論文。
原題: Task-Agnostic Exoskeleton Control Supports Elderly Joint Energetics during Hip-Intensive Tasks / Jiefu Zhang, Nikhil V. Divekar, Chandramouli Krishnan 他
日本語で読む → - 論文テレオペレーションロボティクス
KUKAloha: 建設用ロボットアームのための汎用・低コスト・共有制御型テレオペレーションフレームワーク
建設用ロボットアーム向けに、人間の直感的な操作と自律認識を組み合わせた低コストな共有制御テレオペレーションフレームワークを提案し、KUKAアームで実装・評価した。
原題: KUKAloha: A General, Low-Cost, and Shared-Control based Teleoperation Framework for Construction Robot Arm / Yifan Xu, Qizhang Shen, Vineet Kamat 他
日本語で読む → - 論文水中ロボットロボティクス
低コスト水質モニタリングのための生体模倣型ミニ潜水艇の設計
イカのジェット推進に着想を得た低コストの小型潜水艇を設計・実験検証し、水質モニタリングへの応用可能性を示した論文。
原題: Design of a Bio-Inspired Miniature Submarine for Low-Cost Water Quality Monitoring / Quang Huy Vu, Quan Le, Manh Duong Phung
日本語で読む → - 論文群制御制御
混在交通渋滞緩和のための二重相互作用認識協調制御戦略
本論文は、混在交通のボトルネック区間において、CAVとHDVの相互作用を局所・大域の両方で認識するMARLベースの協調制御戦略を提案し、交通渋滞を緩和する。
原題: Dual-Interaction-Aware Cooperative Control Strategy for Alleviating Mixed Traffic Congestion / Zhengxuan Liu, Yuxin Cai, Yijing Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
順方向デモンストレーションからの逆タスク学習によるタスクパラメータ外挿
順方向と逆方向のタスクを共通表現で学習し、新規条件の順方向デモのみから対応する逆タスクを実行できる手法を提案。シミュレーションと実機の複雑なマニピュレーションで既存手法を上回る。
原題: Task Parameter Extrapolation via Learning Inverse Tasks from Forward Demonstrations / Serdar Bahar, Fatih Dogangun, Matteo Saveriano 他
日本語で読む → - 論文群制御ロボティクス
自律移動ロボット群のバッテリ劣化を考慮したフリートスケジューリング
複数の自律移動ロボットのタスク割り当てと充電計画を、バッテリ劣化を考慮して最適化する手法を提案。階層的matheuristicにより大規模問題を効率的に解く。
原題: Fleet-Level Battery-Health-Aware Scheduling for Autonomous Mobile Robots / Jiachen Li, Shihao Li, Jian Chu 他
日本語で読む → - 論文制御/形式手法ロボティクス
競合するSTL仕様下での実行可能性回復とパレート最適な改良
競合する信号時相論理仕様により実行不可能となるMPC問題に対し、最小緩和で実行可能性を回復し、多目的最適化としてパレート最適解を求める二段階フレームワークを提案した。
原題: Feasibility Restoration under Conflicting STL Specifications with Pareto-Optimal Refinement / Tianhao Wu, Yiwei Lyu
日本語で読む → - 論文歩行ロボティクス
TransCurriculum: 高速かつ安定した移動のための多次元カリキュラム学習
本論文では、四足歩行ロボットの高速移動を安定させるため、速度指令、地形難易度、ドメインランダム化の3軸を適応的に調整するトランスフォーマーを用いた多次元カリキュラム学習手法を提案し、シミュレーションと実機で検証した。
原題: TransCurriculum: Multi-Dimensional Curriculum Learning for Fast & Stable Locomotion / Prakhar Mishra, Amir Hossain Raj, Xuesu Xiao 他
日本語で読む → - 論文VLAロボティクス
VLN-Cache: 視覚・意味ダイナミクスを考慮したVLNモデルのトークンキャッシング
VLNタスクで大規模視覚言語モデルの推論コストを削減するため、視点移動によるトークン位置ずれとタスク進行に伴う意味的変化を考慮したトークンキャッシング手法を提案した。
原題: VLN-Cache: Enabling Token Caching for VLN Models with Visual/Semantic Dynamics Awareness / Zihao Zheng, Zhihao Mao, Xingyue Zhou 他
日本語で読む → - 論文位置推定画像認識
LEAR: エッジ認識表現学習によるイベントカメラ-LiDAR位置推定
イベントカメラとLiDAR点群の位置合わせを、エッジ構造と深度フローを同時推定するデュアルタスク学習で解決する手法を提案。
原題: LEAR: Learning Edge-Aware Representations for Event-to-LiDAR Localization / Kuangyi Chen, Jun Zhang, Yuxi Hu 他
日本語で読む → - 論文ナビゲーションロボティクス
CATNAV: キャッシュ型視覚言語走破性による効率的なゼロショットロボットナビゲーション
マルチモーダルLLMを用いて、ロボットの身体性を考慮したコストマップをゼロショットで生成し、視覚意味キャッシュによりオンライン推論を85.7%削減するナビゲーションフレームワークを提案。四足ロボットで屋内・屋外の5タスクで高い成功率と制約違反の低減を実証した。
原題: CATNAV: Cached Vision-Language Traversability for Efficient Zero-Shot Robot Navigation / Aditya Potnis, Francisco Affonso, Shreya Gummadi 他
日本語で読む → - 論文移動ロボット/タスク計画ロボティクス
AIエージェントとマルチLMMモジュールによる移動建設ロボットの即興タスク対応位置決め
建設現場の即興タスクに対応するため、自然言語指示を理解し、図面から位置を特定して移動するAIエージェントを四足ロボットで実装し、92.2%の成功率を達成した。
原題: Task-Aware Positioning for Improvisational Tasks in Mobile Construction Robots via an AI Agent with Multi-LMM Modules / Seongju Jang, Francis Baek, SangHyun Lee
日本語で読む → - 論文模倣学習ロボティクス
Easy-IIL: アシスタント専門家による対話型模倣学習の人間の操作負担軽減
対話型模倣学習において、モデルベースの模倣手法をアシスタント専門家として活用し、人間の介入を最小限に抑えつつ性能を維持するフレームワークを提案した。
原題: Easy-IIL: Reducing Human Operational Burden in Interactive Imitation Learning via Assistant Experts / Chengjie Zhang, Chao Tang, Wenlong Dong 他
日本語で読む → - 論文歩行ロボティクス
何本脚でも歩ける:不整地を歩行する多脚ロボットの制御
2脚につき3アクチュエータを持つセグメント型ロボットで、6〜16脚の不整地歩行を実現する軽量な制御アーキテクチャを提案し、シミュレーションで検証した。
原題: Walking on Rough Terrain with Any Number of Legs / Zhuoyang Chen, Xinyuan Wang, Shai Revzen
日本語で読む → - 論文VLA画像認識
PVI: 視覚言語行動モデルのためのプラグイン型視覚注入
事前学習済みの視覚言語モデルと行動エキスパートを組み合わせたVLAアーキテクチャに対し、軽量でエンコーダ非依存のモジュールを追加し、時間的視覚特徴を注入することで性能を向上させる手法を提案した。
原題: PVI: Plug-in Visual Injection for Vision-Language-Action Models / Zezhou Zhang, Songxin Zhang, Xiao Xiong 他
日本語で読む → - 論文遠隔操作ロボティクス
OmniClone: 頑健で万能な全身ヒューマノイド遠隔操作システムの構築
全身ヒューマノイド遠隔操作システムOmniCloneを提案し、診断ベンチマークOmniBenchを用いて従来手法の弱点を特定し、データレシピとシステム改良によりMPJPEを66%以上削減し、計算資源を大幅に削減した。
原題: OmniClone: Engineering a Robust, All-Rounder Whole-Body Humanoid Teleoperation System / Yixuan Li, Le Ma, Yutang Lin 他
日本語で読む → - 論文医療ロボティクスロボティクス
スキャンガイドラインから行動へ:LLM推論を用いたロボット超音波エージェント
LLMベースのエージェントが超音波スキャンガイドラインを解釈し、動的にツールを呼び出して自律的にスキャンを実行する統一フレームワークを提案。強化学習で推論とツール選択の品質を改善する。
原題: From Scanning Guidelines to Action: A Robotic Ultrasound Agent with LLM-Based Reasoning / Yuan Bi, Yiping Zhou, Pei Liu 他
日本語で読む → - 論文VLAロボティクス
ReMem-VLA: 二重レベル再帰クエリによる記憶を備えた視覚言語行動モデル
視覚言語行動モデルに、フレーム単位とチャンク単位の再帰クエリを導入し、短期・長期記憶を実現。過去の観測予測を補助タスクとして追加し、記憶依存タスクで既存モデルを大幅に上回る性能を達成した。
原題: ReMem-VLA: Empowering Vision-Language-Action Model with Memory via Dual-Level Recurrent Queries / Hang Li, Fengyi Shen, Dong Chen 他
日本語で読む → - 論文歩行ロボティクス
HybridMimic: ハイブリッドRL-セントロイダル制御による人型ロボットの動作模倣
学習ポリシーがセントロイダルモデルベースのコントローラを動的に変調し、連続的な接触状態と目標重心速度を予測することで、ドメインシフト下でも物理的に実現可能なフィードフォワードトルクを生成する人型ロボットの動作模倣フレームワークを提案した。実機実験でベース位置追従誤差を13%削減した。
原題: HybridMimic: Hybrid RL-Centroidal Control for Humanoid Motion Mimicking / Ludwig Chee-Ying Tay, I-Chia Chang, Yan Gu
日本語で読む →