論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/14 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文模倣学習ロボティクス
フローマッチング運動事前分布:模倣学習のためのオンライン最適輸送報酬
現在のロールアウトと専門家運動の間の経路に沿ってフローマッチングで学習したスカラー報酬を提案し、Unitree G1の歩行タスクで従来のAMPや重心OT報酬より安定した歩行を実現した。
原題: Flow-Matched Motion Priors: Online Optimal-Transport Rewards for Imitation Learning / Yilin Zou, Chenghua Liu, Chenglong Wu 他
日本語で読む → - 論文歩行ロボティクス
JEPLO: LiDARベース脚式移動のための結合埋め込み予測学習
LiDARの生スキャンから自己中心的な地形表現を予測学習し、地図構築なしで脚式ロボットの知覚移動を実現する単段階フレームワークを提案。シミュレーションから実機への転移に成功し、遮蔽やノイズに頑健な omnidirectional な移動を可能にした。
原題: JEPLO: Joint-Embedding Predictive Learning for LiDAR-Based Legged Locomotion / Qihao Yuan, Yixuan Qiu, Ziyu Cao 他
日本語で読む → - 論文タスク計画ロボティクス
ロボットタスク計画におけるシーングラフ十分性への情報空間的アプローチ
シーングラフ上の計画を情報空間で定式化し、タスクに十分な縮約シーングラフの条件を明らかにした。
原題: An Information-Space Perspective to Scene Graph Sufficiency for Robotic Task Planning / Başak Sakçak, Francesco Verdoja
日本語で読む → - 論文触覚ロボティクス
PredTac: 予測触覚による接触の多いマニピュレーションの学習
触覚センサの実測値の代わりに、視覚とロボット状態から触覚を予測してポリシー学習・実行に使う枠組みを提案し、実機で実測触覚に迫る成功率を達成した。
原題: PredTac: Learning Contact-Rich Manipulation with Predicted Touch / Weijia Fan, Daqiang Guo
日本語で読む → - 論文マニピュレーションロボティクス
Bench2Dex: 多様な器用ハンドにおける視触覚両手マニピュレーションのベンチマーク
12種類の器用ハンドに対応した共通の触覚インターフェースを備えるシミュレーションベンチマークを構築し、26の両手操作タスクと約1.3Kのテレオペデモを提供して視触覚マニピュレーションを評価可能にした。
原題: Bench2Dex: Benchmarking Visuo-Tactile Bimanual Dexterous Manipulation Across Dexterous Hands / Zhenjie Yang, Yideng Zhang, Dongjie Zhang 他
日本語で読む → - 論文模倣学習ロボティクス
接触の多い模倣学習のための連続多様体分解インピーダンス再ターゲティング
固定インピーダンスの実演を連続可変インピーダンス制御器に変換し、模倣学習の構造的教師信号として利用する手法を提案。実タスクで力変動とピーク力を低減し、学習可能性を示した。
原題: Continuous Manifold-Decomposed Impedance Retargeting for Contact-Rich Imitation Learning / Jiahao Liu, Kento Kawaharazuka, Tasuku Makabe 他
日本語で読む → - 論文マニピュレーションロボティクス
StereoPatch: ロボットマニピュレーションの空間知覚のためのパッチ整合RGB-深度融合
RGBパッチと深度情報をパッチ単位で非対称クロスアテンションにより融合し、幾何学的な曖昧さを解消する視覚運動ポリシー向け表現を提案。実機6タスクで外観のみ・幾何のみ・生RGB-D・後段融合のベースラインを上回る成功率を達成。
原題: StereoPatch: Patch-Aligned RGB-Depth Fusion for Spatial Perception in Robot Manipulation / Yanan Zhou, Zhaoyan Qian, James Zhao 他
日本語で読む → - 論文ナビゲーションロボティクス
クアッドロータのための体積調和場ナビゲーション
事前計算した体積調和場を予測プランナに組み込み、クアッドロータの衝突回避と運動制約を満たす局所動作を生成する手法を提案し、実機で検証した。
原題: Volumetric Harmonic Field Navigation for Quadrotors / Shuxiu Jia, Amartya Mukherjee, Yating Yuan 他
日本語で読む → - 論文触覚/マニピュレーションロボティクス
Touch2Trace: 触覚駆動型模倣学習による巧みなケーブルトレース
触覚センサと自己教師あり学習エンコーダ、トランスフォーマーポリシーを組み合わせ、巧みな手でケーブルをたどるタスクを実現。触覚フィードバックが成功率を0%から93%に向上させ、未知のケーブルにもゼロショット転移可能。
原題: Touch2Trace: Tactile-Driven Imitation Learning for Dexterous Cable Tracing / Matteo Grimaldi, David Klee, Ziling Chen 他
日本語で読む → - 論文VLA画像認識
PhysBrain 1.5:視覚言語モデルから物理基盤モデルへ
人間のインタラクション動画から身体動作を学習し、行動生成と未来状態予測を統合した8Bの物理基盤モデルを構築、28の身体理解ベンチマークでオープンソース最高性能を達成した。
原題: PhysBrain 1.5: From Vision-Language Models to Physical Foundation Models / DeepCybo Team, Yu Bin, Haipeng Cao 他
日本語で読む → - 論文言語モデル/誤り訂正AI
凍結ベースモデルに対する安全な誤り訂正:能力を保ちながら修正する軽量モジュール
凍結した大規模言語モデルの出力誤りを、ごく小さなロジット補正モジュールで修正しつつ、元の能力を劣化させない手法を提案・検証した。
原題: Safe Error Correction for Language Models: Frozen-Base Adjustment with Capability Preservation / Gautam Kishore
日本語で読む → - 論文触覚ロボティクス
SlipSense: 低遅延かつ汎用的な滑り検出のためのマルチモーダル触覚学習
圧力アレイと加速度センサを組み合わせた触覚センサTacV5で、滑りを23ms以内に検出し、未学習のロボットハンドにもゼロショットで汎化するマルチモーダル学習フレームワークを提案。
原題: SlipSense: Multimodal Tactile Learning for Low-Latency and Generalized Slip Detection / Tong Jian, Aditya Thurvas Senthil Kumar, Xinyi Li 他
日本語で読む → - 論文VLAロボティクス
UDAV: 不確実性駆動型適応VLMウェイポイントプランナー
VLMの確率的予測から不確実性を見積もり、必要に応じて再検討することで、UAV誘導UGVのオフロード経路計画の精度を向上させる手法を提案。
原題: UDAV: Uncertainty-Driven Adaptive VLM Waypoint Planner / Ghazal Farhani, Shabnam Shabani
日本語で読む → - 論文VLA画像認識
画像生成による推論
マルチモーダルLLMの推論に画像生成モデルを柔軟な視覚操作ツールとして組み込み、多視点空間推論や衝突予測など6タスクで最大25%の性能向上を達成した。
原題: Reasoning with Image Generation / Nishad Singhi, Hector Garcia Rodriguez, Aditya Arora 他
日本語で読む → - 論文量子ロボティクスロボティクス
ロボット運動学のための構造保存型量子回路アーキテクチャ
剛体変換とDH運動学を量子回路で表現し、古典的な運動学量を再現する構造保存型アーキテクチャを提案した。
原題: Structure-Preserving Quantum Circuit Architectures for Robot Kinematics / Andrea Morghen, Pierluigi Arpenti, Roberto Schiattarella 他
日本語で読む → - 論文実験自動化physics.optics
プログラマブル光学クラウドラボラトリ
自由空間光学実験を遠隔・自動で再構成できるロボットクラウドラボ基盤PICOを提案し、実験ケーススタディで実証した。
原題: A Programmable Optics Cloud Laboratory / Sachin Vaidya, Caio Silva, Seou Choi 他
日本語で読む → - 論文社会シミュレーション機械学習
社会シミュレーションのためのLLMエージェントの解釈と操作
LLMベースの社会シミュレーションにおいて、プロンプト操作・SAE特徴操作・プローブ方向操作の3手法を比較し、選好や能力の制御性能を評価した。
原題: Interpreting and Steering LLM Agents for Social Simulations / Jiayue Gaveal Fan, Arul Murugan, Shreyas Krishnan 他
日本語で読む → - 論文全身制御ロボティクス
不完全な追従目標下での衝突回避型ヒューマノイド全身制御
シーン形状を考慮しない全身制御器に、ロボット・環境間のクロスアテンション層を追加し、目標追従と衝突回避を両立させる手法を提案。シミュレーションと実機Digit V3で有効性を検証した。
原題: Collision-Aware Humanoid Whole-Body Control under Imperfect Tracking Targets / Mohitvishnu S. Gadde, Ashish Malik, Pranay Dugar 他
日本語で読む → - 論文sim2realロボティクス
幾何か構造か:LiDAR点群シミュレーション忠実度のためのグラフベース診断
実スキャンとシミュレーションのLiDAR点群からグラフを構築し、Louvain法で空間的にまとまった部分グラフを抽出して対応付けることで、従来の幾何指標では捉えにくい構造的な忠実度を評価する枠組みを提案した。
原題: Geometry vs Structure: Graph-Based Diagnostics for LiDAR Point-Cloud Simulation Fidelity / Ghazal Farhani, Taufiq Rahman
日本語で読む → - 論文液滴操作機械学習
モデルベース強化学習による液滴の自律ナビゲーション
重力駆動プラットフォーム上で、モデルベース強化学習を用いて液滴を複雑な形状の経路に沿って自律的にナビゲートする手法を実証した。
原題: Autonomous Droplet Navigation via Model-Based Reinforcement Learning / Rajneesh Anand, Mayuresh V. Kothare
日本語で読む → - 論文自律手術ロボティクス
占有ネットワーク誘導による自律ロボット部分腎切除
物理シミュレーションで学習した占有ネットワークを用い、単視点の部分点群から3次元解剖を推定して、組織の変形や切断に適応しながら腫瘍切除を自律実行するシステムを開発した。
原題: Occupancy Network-Guided Autonomous Robotic Partial Nephrectomy / Ethan Kilmer, Pit Henrich, Jiawei Ge 他
日本語で読む → - 論文マニピュレーションロボティクス
ManiSkillFormer: タスク条件付き幾何契約によるデモンストレーション不要の構成的マニピュレーション
LLMが生成するタスク条件付き幾何契約で知覚と行動を構造化し、デモなしで多様な物体・タスクのマニピュレーションを実現するニューロシンボリック手法を提案。
原題: ManiSkillFormer: Demonstration-Free Compositional Manipulation via Task-Conditioned Geometric Contracts / Peiqi Yu, Mosam Dabhi, Shangtao Li 他
日本語で読む → - 論文群制御ロボティクス
Auto-HSI: LLMによるオンライン自動コード生成を用いたロボット群のオンデマンド個人向け操作
自然言語とジェスチャーでロボット群の集合行動を指示すると、LLMが個人向け操作インターフェースのコードを自動生成し、未訓練の操作者が群を遠隔操作できるようにする手法。
原題: Auto-HSI: Personalized human control of a robot swarm on demand by using LLMs for online automatic code generation / Alessandro Nazzari, Nathan Cerisara, Dorian Tonnis 他
日本語で読む → - 論文マニピュレーションロボティクス
ConGraspXL: 制約条件に基づく制御可能な巧みな把持動作の生成
多様なタスク制約(接近方向・接触領域・手首軌道・機能的手姿勢)とその組み合わせに柔軟に対応し、精密に制御可能な把持動作を生成する手法を提案した。
原題: ConGraspXL: Controllable Constraint-Conditioned Dexterous Grasping Motion Synthesis / Hui Zhang, Mirko Meboldt, Jie Song
日本語で読む → - 論文sim2realロボティクス
Neverwhere ビジュアルパルクールベンチマークスイート
3Dガウススプラッティングで再構成した60以上の都市シーンからなる、視覚移動制御の閉ループ評価環境を構築し、多様なデータの必要性を示した。
原題: The Neverwhere Visual Parkour Benchmark Suite / Ziyu Chen, Henghui Bao, Haoran Chang 他
日本語で読む → - 論文テレオペレーションロボティクス
XRoboToolKit-T:接触を伴う操作のための触覚センシングによる高安定・高精度テレオペレーション
触覚フィードバックを活用した力制御とVLAモデルによる動作補正を組み込んだテレオペレーションシステムを提案し、変形しやすいピペットの把持や注射器の挿入といった接触の多い作業で安定性とデータ収集効率を向上させた。
原題: XRoboToolKit-T: Teleoperation with High Stability and Precision with Tactile Sensing for Contact-rich Manipulation / Xiwen Dengxiong, Xueting Wang, Ke Jing 他
日本語で読む → - 論文連続体ロボットロボティクス
モジュール式剛性と自己姿勢推定を備えた腱駆動連続体ロボット
交換可能な連続体関節と磁気センサーによる自己姿勢推定を組み合わせ、外部トラッキングなしで形状適応できるモジュール式連続体ロボットを開発した。
原題: Tendon-Driven Continuum Robot with Modular Stiffness and In-Situ Self Pose Estimation / Guo Ning, Sue, Zheng Cao 他
日本語で読む → - 論文ナビゲーションロボティクス
HarnessVLN: エージェントハーネスによる訓練不要の具現化ナビゲーションの統合
マルチモーダル大規模言語モデルを活用し、知覚・検証・回復・終了を統合ツールインターフェースで調整する訓練不要のゼロショット具現化ナビゲーション枠組みを提案し、複数ベンチマークで従来の訓練不要手法を上回った。
原題: HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness / Yang Chen, Lirong Che, Zhenyu Huang 他
日本語で読む → - 論文外骨格ロボティクス
複雑環境下の下肢外骨格における動力学を考慮した最適化によるアシストトルク推定
動力学モデルに基づく最適化で外骨格のアシストトルクを直接生成し、データ駆動型ネットワークでリアルタイム予測することで、代謝率や心拍数、筋活動を低減できることを示した研究。
原題: Assistance Torque Estimation via Dynamics-Aware Optimization for Lower-Limb Exoskeleton in Complex Environments / Xiao-Yin Liu, Guotao Li, Weiqun Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
直列マニピュレータのためのタスク分布を考慮したカウンターウェイト合成と制約付き共同設計
マニピュレータの実際の動作分布を考慮してカウンターウェイトを最適化する枠組みを提案し、3リンクマニピュレータで動作分布の違いにより最適質量が40%以上変化することを示した。
原題: Task-Distribution-Aware Counterweight Synthesis and Constrained Co-Design for Serial Manipulators / Mohammad Abbadi
日本語で読む →