論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/3/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文歩行ロボティクス
前を見て後ろへ歩く:前方視覚による後方移動のための効率的な地形記憶
前方カメラしか持たない脚ロボットが、前方移動中に地形の記憶を書き込み、後方移動時にその記憶を利用して衝突を回避しながら複雑な地形を歩行できるフレームワークを提案した。
原題: Look Forward to Walk Backward: Efficient Terrain Memory for Backward Locomotion with Forward Vision / Shixin Luo, Songbo Li, Yuan Hao 他
日本語で読む → - 論文システム設計math.OC
システム共同設計における分布的不確実性と適応的意思決定
本論文は、複雑なシステム設計における不確実性を分布としてモデル化し、適応的な意思決定を可能にするco-designフレームワークの拡張を提案している。
原題: Distributional Uncertainty and Adaptive Decision-Making in System Co-design / Yujun Huang, Gioele Zardini
日本語で読む → - 論文経路計画ロボティクス
負荷を考慮した情報収集経路計画と物理的サンプリング
サンプル収集による質量増加が移動コストに影響する状況を考慮した情報収集経路計画問題を新たに定義し、エネルギー予算制約下で訪問位置・順序・サンプル数を最適化するMIQPとして定式化した。
原題: LIPP: Load-Aware Informative Path Planning with Physical Sampling / Hojune Kim, Guangyao Shi, Gaurav S. Sukhatme
日本語で読む → - 論文BMI/リハビリテーションロボティクス
上肢外骨格による受動的腕運動中の運動イメージ開始・終了の特性評価
上肢外骨格による受動運動中に、脳波から運動イメージの開始と終了を検出するデコーダを構築し、その精度を評価した論文。
原題: Characterizing the onset and offset of motor imagery during passive arm movements induced by an upper-body exoskeleton / Kanishka Mitra, Frigyes Samuel Racz, Satyam Kumar 他
日本語で読む → - 論文医療ロボティクス/セグメンテーション画像認識
白内障SAM-2:前眼部手術のセグメンテーションとスケーラブルな正解アノテーションのためのドメイン適応モデル
白内障手術動画のリアルタイムセグメンテーションのためにSAM-2をドメイン適応させ、さらにスパースプロンプトと動画ベースのマスク伝播による対話的アノテーションフレームワークを導入して、アノテーション時間を短縮し高品質な正解マスクの大規模作成を可能にした。
原題: CataractSAM-2: A Domain-Adapted Model for Anterior Segment Surgery Segmentation and Scalable Ground-Truth Annotation / Mohammad Eslami, Dhanvinkumar Ganeshkumar, Saber Kazeminasab 他
日本語で読む → - 論文システム設計ロボティクス
長時間ロボット卓上ゲームにおける内部状態整合性を維持するシステム設計
ロボットによる長時間の卓上ゲーム(麻雀)で、知覚や実行の小さな誤りが状態を破壊する問題に対し、状態を明示的に分離・監視し、触覚トリガーによる回復機構を備えた統合アーキテクチャを提案・実証した。
原題: System Design for Maintaining Internal State Consistency in Long-Horizon Robotic Tabletop Games / Guangyu Zhao, Ceyao Zhang, Chengdong Ma 他
日本語で読む → - 論文オドメトリロボティクス
KISS-IMU: 運動バランス学習と不確実性認識推論による自己教師あり慣性オドメトリ
LiDARベースのICPとポーズグラフ最適化を教師信号として用い、IMUのみを自己教師ありで学習する慣性オドメトリ手法を提案。運動バランス学習と不確実性に基づく適応重み付けにより、多様な環境でのロバスト性を実現した。
原題: KISS-IMU: Self-supervised Inertial Odometry with Motion-balanced Learning and Uncertainty-aware Inference / Jiwon Choi, Hogyun Kim, Geonmo Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
部分観測下での言語誘導把持:現場点検・保守における移動操作のための手法
脚式移動マニピュレータが部分観測下で言語指示に基づき物体を把持するパイプラインを提案し、現場の点検・保守シナリオで成功率を向上させた。
原題: Language-Guided Grasping under Partial Observation for Mobile Manipulation in Field Inspection and Maintenance / Dilermando Almeida, Juliano Negri, Guilherme Lazzarini 他
日本語で読む → - 論文群制御ロボティクス
IndoorR2X: LLM駆動計画による屋内ロボット対全機器連携
屋内環境のIoTセンサーと移動ロボットを統合し、LLMによる計画でマルチロボットのタスク効率を高めるベンチマークとシミュレーションフレームワークを提案した。
原題: IndoorR2X: Indoor Robot-to-Everything Coordination with LLM-Driven Planning / Fan Yang, Soumya Teotia, Shaunak A. Mehta 他
日本語で読む → - 論文制御理論math.OC
ギブス変分原理によるセンサベース制御の基本原理限界
部分観測下のフィードバック制御における最小期待コストの下界を、ギブス変分原理を用いて導出し、自己無撞着な改良により厳密な数値限界を計算する手法を提案した。
原題: Fundamental Limits for Sensor-Based Control via the Gibbs Variational Principle / Vincent Pacelli, Evangelos A. Theodorou
日本語で読む → - 論文VLM/空間推論/動作計画ロボティクス
ロボット動作に対するVLMの空間推論能力の評価:動作嗜好を考慮したロボット計画への一歩
視覚言語モデル(VLM)がロボットの動作計画に必要な空間推論(物体との距離や経路スタイルなどの嗜好)をどの程度理解できるかを、4つの最新VLMと4つの質問方法で評価した。
原題: Evaluating VLMs' Spatial Reasoning Over Robot Motion: A Step Towards Robot Planning with Motion Preferences / Wenxi Wu, Jingjing Zhang, Martim Brandão
日本語で読む → - 論文マニピュレーションロボティクス
DexGrasp-Zero: 形態整合型ポリシーによるゼロショット異種エンボディ器用把持
異なる多指ハンド間でゼロショット転移可能な器用把持ポリシーを提案。解剖学的ノードと直交運動プリミティブを用いた形態整合グラフ表現と、物理特性注入機構を備えたグラフ畳み込みネットワークにより、未見のハンドへの汎化を実現。
原題: DexGrasp-Zero: A Morphology-Aligned Policy for Zero-Shot Cross-Embodiment Dexterous Grasping / Yuliang Wu, Yanhan Lin, WengKit Lao 他
日本語で読む → - 論文生涯学習/模倣学習機械学習
SPREAD: 生涯模倣学習のための部分空間表現蒸留
生涯模倣学習において、特異値分解を用いてタスク間のポリシー表現を低ランク部分空間で整列させ、幾何構造を保ちながら知識転移と忘却防止を実現する手法を提案した。
原題: SPREAD: Subspace Representation Distillation for Lifelong Imitation Learning / Kaushik Roy, Giovanni D'urso, Nicholas Lawrance 他
日本語で読む → - 論文実験自動化ロボティクス
AgentChemist: 化学認識と精密制御を統合したマルチエージェント実験ロボットプラットフォーム
化学実験の自動化における長尾分布問題に対処するため、マルチエージェントロボットプラットフォームを提案。化学認識とフィードバック駆動制御を統合し、酸塩基滴定の検証で自律的な進行追跡と適応的な分注制御を実証した。
原題: AgentChemist: A Multi-Agent Experimental Robotic Platform Integrating Chemical Perception and Precise Control / Xiangyi Wei, Fei Wang, Haotian Zhang 他
日本語で読む → - 論文VLAロボティクス
訓練不要の注意再調整によるVLAモデルの言語基盤の回復
VLAモデルが視覚情報に偏り、指示と矛盾する動作を実行する「言語的盲目」現象を明らかにし、推論時に注意を再調整して指示の影響を回復する手法IGARを提案した。
原題: Restoring Linguistic Grounding in VLA Models via Train-Free Attention Recalibration / Ninghao Zhang, Bin Zhu, Shijie Zhou 他
日本語で読む → - 論文オドメトリ/較正ロボティクス
連続時間IMUモデリングによるオンライン時空間較正を備えたレーダ慣性オドメトリ
レーダとIMUの間の時間オフセットと外部較正パラメータを、因子グラフ最適化と連続時間IMUモデリングを用いて同時にオンライン推定するRIOフレームワークを提案した。
原題: Radar-Inertial Odometry with Online Spatio-Temporal Calibration via Continuous-Time IMU Modeling / Vlaho-Josip Štironja, Luka Petrović, Juraj Peršić 他
日本語で読む → - 論文安全強化学習機械学習
制約付き楽観的探索を用いたオフポリシー安全強化学習
安全制約を満たすオフポリシー強化学習アルゴリズムCOX-Qを提案し、コスト制約付き探索と分布価値学習により、サンプル効率と安全性を両立させた。
原題: Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration / Guopeng Li, Matthijs T. J. Spaan, Julian F. P. Kooij
日本語で読む → - 論文世界モデルロボティクス
PlayWorld: 自律的な遊びからロボットの世界モデルを学習する
ロボットの自己遊びデータのみから高忠実度のビデオ世界モデルを学習する手法を提案し、物理的に一貫した物体操作の予測を実現した。
原題: PlayWorld: Learning Robot World Models from Autonomous Play / Tenny Yin, Zhiting Mei, Zhonghe Zheng 他
日本語で読む → - 論文安全制御ロボティクス
Koopmanニューラルダイナミクスを用いたロボットシステムの全身安全制御
非線形で高次元なロボットのダイナミクスをKoopman作用素で線形化し、安全制約を単一の二次計画問題として解くことで、実時間での安全追従制御を実現した。Kinova Gen3マニピュレータとGo2四足ロボットで検証し、精度の高い追従と障害物回避を確認した。
原題: Whole-Body Safe Control of Robotic Systems with Koopman Neural Dynamics / Sebin Jung, Abulikemu Abuduweili, Jiaxing Li 他
日本語で読む → - 論文マニピュレーションロボティクス
受動的観察者から能動的批評家へ:強化学習がロボット操作のプロセス推論を引き出す
ビデオMLLMを受動的な観察者から能動的な批評家へと変えるため、結果ベースの強化学習を用いてプロセス推論を誘発する7BフレームワークPRIMO R1を提案し、長期的ロボット操作の進捗監視性能を大幅に向上させた。
原題: From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation / Yibin Liu, Yaxing Lyu, Daqi Gao 他
日本語で読む → - 論文ベイズ最適化機械学習
曲率を考慮した期待自由エネルギーに基づくベイズ最適化の獲得関数
ベイズ最適化において、学習と最適化を同時に行うための獲得関数として期待自由エネルギーを提案し、特定の条件下で既存の獲得関数と等価になることを示した。さらに、曲率を考慮した更新則を導入し、Van der Pol発振器のシステム同定問題で有効性を実証した。
原題: Curvature-aware Expected Free Energy as an Acquisition Function for Bayesian Optimization / Ajith Anil Meera, Wouter Kouw
日本語で読む → - 論文VLA/制御ロボティクス
Realtime-VLA V2: VLAを高速・滑らか・正確に実行する学習
VLAモデルを実ロボットに高速展開するための実践的技術群を提案し、軽量アームで人間並みの速度と精度を実現した。
原題: Realtime-VLA V2: Learning to Run VLAs Fast, Smooth, and Accurate / Chen Yang, Yucheng Hu, Yunchao Ma 他
日本語で読む → - 論文遠隔操作/ヒューマノイドロボティクス
MIRROR: 並列微分逆運動学によるリアルタイムリターゲティングと遠隔操作を用いた視覚的動作模倣
GPU並列化と継続法を用いた微分逆運動学ソルバを提案し、拘束による局所最小値からの脱出を改善しつつ、自己衝突回避制御障壁関数とLyapunov基準で安全性を確保。視覚骨格推定と組み合わせ、THEMISヒューマノイドでのリアルタイム上半身遠隔操作を実現した。
原題: MIRROR: Visual Motion Imitation via Real-time Retargeting and Teleoperation with Parallel Differential Inverse Kinematics / Junheng Li, Lizhi Yang, Aaron D. Ames
日本語で読む → - 論文連続体ロボットロボティクス
ケーブル駆動連続体ロボット:近位統合力覚センシングによる自己受容感覚
本論文は、ケーブル駆動連続体ロボットのための新しい自己受容感覚手法を提案し、近位統合力覚センシング(ケーブル張力と6軸力/トルクセンサ)を用いて、微小スケールのロボットにおける3次元接触力と接触点位置の推定、および形状推定を実現する。
原題: Cable-driven Continuum Robotics: Proprioception via Proximal-integrated Force Sensing / Gang Zhang, Junyan Yan, Jibiao Chen 他
日本語で読む → - 論文ナビゲーション画像認識
RAE-NWM: 高密度視覚表現空間におけるナビゲーションワールドモデル
高密度なDINOv2特徴空間でナビゲーションの状態遷移をモデル化するワールドモデルを提案し、構造安定性と行動精度を向上させた。
原題: RAE-NWM: Navigation World Model in Dense Visual Representation Space / Mingkun Zhang, Wangtian Shen, Fan Zhang 他
日本語で読む → - 論文タスク計画ロボティクス
対話から実行へ:MoA支援型対話計画によるビヘイビアツリーを用いた長期的ロボット実行
大規模言語モデルによる対話型タスク計画で、複数の専門エージェント(MoA)が代理回答することで人間の介入を減らし、ビヘイビアツリーで構造化された長期実行を実現する手法を提案。実験で人間の応答要求を約27%削減しつつ、実ロボットでの長期的実行と障害回復を確認した。
原題: From Dialogue to Execution: Mixture-of-Agents Assisted Interactive Planning for Behavior Tree-Based Long-Horizon Robot Execution / Kanata Suzuki, Kazuki Hori, Haruka Miyoshi 他
日本語で読む → - 論文ビデオ異常検出ロボティクス
TIMID: ロボット実行ビデオにおける時間依存ミスの検出
ロボットの高次タスク実行中に発生する時間的・空間的なミスを検出する新しいアーキテクチャTIMIDを提案。ビデオとタスク・ミスのプロンプトを入力とし、フレーム単位でミスの有無を予測する。弱教師あり学習とシミュレーションデータで訓練し、実ロボットへのゼロショット転送を実現。
原題: TIMID: Time-Dependent Mistake Detection in Videos of Robot Executions / Nerea Gallego, Fernando Salanova, Claudio Mannarano 他
日本語で読む → - 論文VLA/推論高速化ロボティクス
HeiSD: 運動学的認識を備えた身体化視覚言語行動モデルのためのハイブリッド投機的復号
VLAモデルの推論を高速化するため、ドラフタベースと検索ベースの投機的復号を統合したハイブリッド手法HeiSDを提案し、検証スキップ機構と運動学に基づく融合指標により高速化と成功率を両立した。
原題: HeiSD: Hybrid Speculative Decoding for Embodied Vision-Language-Action Models with Kinematic Awareness / Zihao Zheng, Zhihao Mao, Sicheng Tian 他
日本語で読む → - 論文ナビゲーションロボティクス
MRPoS: 空間ポインティングと大規模言語モデルを用いた音声対話による複合現実ベースのロボットナビゲーションインターフェース
複合現実(MR)環境でのロボットナビゲーションにおいて、従来のエアタップ操作に代わり、空間ポインティングと大規模言語モデル(LLM)による音声対話を組み合わせた自然なマルチモーダルインターフェースを提案し、タスク完了時間と作業負荷を削減した。
原題: MRPoS: Mixed Reality-Based Robot Navigation Interface Using Spatial Pointing and Speech with Large Language Model / Eduardo Iglesius, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文モーションプランニングロボティクス
ロボットマニピュレータのための汎用ニューラルモーションプランナーに向けて:課題と機会
この論文は、ロボットマニピュレータのモーションプランニングにおけるニューラルプランナーの現状をレビューし、その利点と限界を分析して、汎用性の高いプランナーを構築するための道筋を示しています。
原題: Toward Generalist Neural Motion Planners for Robotic Manipulators: Challenges and Opportunities / Davood Soleymanzadeh, Ivan Lopez-Sanchez, Hao Su 他
日本語で読む →