論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
LH-AVLN: 長時間音声・視覚・言語ナビゲーションのベンチマーク
複数目標と空間化された音響手がかりを組み合わせた長時間ナビゲーションのベンチマークを提案し、音声を活用した参照エージェントPAG-Navを開発して評価した。
原題: LH-AVLN: A Benchmark for Long-Horizon Audio-Visual-Language Navigation / Rufeng Chen, Yue Chang, Zili Shao 他
日本語で読む → - 論文自動運転ロボティクス
自己運動ダイナミクス拡張ワールドモデルによる自動運転のゼロショット車両間適応
自動運転のワールドモデルに自己運動の事前知識を組み込み、シーン予測精度を向上させるとともに、未見の車両へのゼロショット適応を実現する手法を提案した。
原題: Ego-Dynamics-Augmented World Model for Autonomous Driving with Zero-Shot Cross-Chassis Adaptation / Zhidong Wang, Jingsong Liang, Zirui Li 他
日本語で読む → - 論文マニピュレーションロボティクス
HCPG-Flow:フローポリシーによるロボット操作のための階層的接触進行ガイダンス
フローポリシーによるロボット操作において、接触前後で階層的な物体中心の進行指標を用いて候補動作を選択する手法を提案し、シミュレーションと実機で成功率を向上させた。
原題: HCPG-Flow:Hierarchical Contact-Progress Guidance for Flow-Policy Robot Manipulation / Guanghu Xie, Mingxu Li, Shuo Zhang 他
日本語で読む → - 論文マニピュレーションロボティクス
コートを着せる:微分可能な衣服シミュレーションを用いた双腕ロボットによる着衣支援
微分可能な衣服シミュレーションを統合した双腕ロボットの着衣制御アルゴリズムを提案し、接触拘束下での衣服状態を高精度に推定して多段階制御でコート着衣を実現した。
原題: Wearing A Coat: Dual-Arm Robot-Assisted Dressing with Differentiable Clothing Simulation / Yiming Liu, Lijun Han, Hesheng Wang
日本語で読む → - 論文ナビゲーションロボティクス
差分に基づく関係学習によるゼロショット物体目標視覚ナビゲーションと直接的なシミュレーションから実機への転移
物体の見た目やカメラ視野角の違いによるシミュレーションと実環境のギャップを克服するため、差分特徴抽出と時間的バッファを組み合わせたT-DRNを提案し、AI2-THORと実機ロボットでゼロショット転移の性能を検証した。
原題: Difference-Based Relational Learning for Zero-Shot Object-Goal Visual Navigation With Direct Sim-to-Real Transfer / Guolei Qi, Feitian Zhang
日本語で読む → - 論文自動運転ロボティクス
GeoWorldAD: 自動運転のための幾何学的世界アクションモデル
自動運転のための行動モデルに、自己中心の3D空間での軌道計画と、潜在的な未来の幾何学トークンによる短期的なシーン進化の予測を組み込んだ手法を提案し、NAVSIMベンチマークで最高性能を達成した。
原題: GeoWorldAD: Geometry World Action Model for Autonomous Driving / Songyan Zhang, Jinyuan Tian, Hanbing Li 他
日本語で読む → - 論文自動運転/VLAロボティクス
AnchorVLA: 離散的な意思決定と連続的な軌道を橋渡しする視覚言語行動計画
自動運転の計画において、高レベルの意思決定を表すアンカートークンと、その残差空間での連続軌道生成を組み合わせたVLA計画フレームワークを提案した。
原題: AnchorVLA: Bridging Discrete Decisions and Continuous Trajectories for Vision-Language-Action Planning / Qi Liu, Yabei Li, Hongsong Wang 他
日本語で読む → - 論文操作計画ロボティクス
ロボット操作計画のための効果予測による物体・行動シンボルの同時発見
連続的なセンサ情報から物体カテゴリと操作プリミティブを同時に学習し、効果予測に基づく離散計画で高精度な操作を実現する手法を提案した。
原題: Joint Discovery of Object and Action Symbols through Effect Prediction for Robotic Manipulation Planning / Burcu Kilic, Berke Kartal, Fatih Dogangun 他
日本語で読む → - 論文位置推定ロボティクス
SASGeo: GNSS非依存UAVのための安定性を考慮したセマンティックマップ位置推定 -- フレームワークと合成概念実証
GNSSが使えないUAVのドリフト補正のため、道路や建物などの永続的なセマンティック構造を用いた位置推定フレームワークを提案し、合成実験でその有効性を示した。
原題: SASGeo: Stability-Aware Semantic Map Localization for GNSS-Denied UAVs -- A Framework and Synthetic Proof of Concept / Natalia Trukhina, Vadim Vashkelis
日本語で読む → - 論文3D再構成cs.GR
StructureGS: 関節物体再構成のための構造認識ガウシアンスプラッティング
関節物体の再構成において、部品の幾何学・外観・運動パラメータの絡み合いを解消するため、部品の有向境界ボックスを用いた構造認識ガイダンスを3Dガウシアンスプラッティングに統合し、空間的一貫性と構造的接続性を強制する損失を導入した。
原題: StructureGS: Structure-aware Gaussian Splatting for Articulated Object Reconstruction / Gahye Lee, Gyoonseo Kim, Wonjong Jang 他
日本語で読む → - 論文自動実験/自己運転ラボAI
検証ボトルネックの圧縮:科学的発見のためのエージェント型セルフドライビングラボ
実験検証のボトルネックを減らすため、事前知識を活用した実験計画と、低コスト測定から高コスト測定を予測するサロゲートモデルを組み合わせたエージェントを提案し、生物学と材料科学でのループ数とコスト削減を目指す。
原題: Compressing the Validation Bottleneck: An Agentic Self-Driving Lab for Scientific Discovery / Kyunghoon Hur, Chihun Lee
日本語で読む → - 論文触覚HCI
CASAband: 形状記憶合金アクチュエータを用いた、空間的・時間的触覚フィードバックのための簡単に装着できるテキスタイル製リストバンド
形状記憶合金アクチュエータを織り込んだ軽量・無線のリストバンド型触覚デバイスを開発し、触覚キューによる情報伝達の有効性を評価した。
原題: CASAband: Easy-to-Wear Textile Wristband using Shape Memory Alloy Actuators for Spatial and Temporal Haptic Feedback / Baekgyeom Kim, Anoush Sepehri, Jessica Healey 他
日本語で読む → - 論文ロボット超音波/ワールドモデル/プローブ誘導ロボティクス
ロボット超音波における目標平面プローブ誘導のための行動条件付きワールドモデル
ロボット超音波検査のプローブ誘導を、行動条件付き拡散ワールドモデルと目標条件付きトランスフォーマーを用いた2段階学習で実現した。実機実験で頸動脈70%、甲状腺65%の成功率を達成した。
原題: Action-Conditioned World Model for Goal Plane Probe Guidance in Robotic Ultrasound / Siqi Fan, Mingcong Chen, Ran Liu 他
日本語で読む → - 論文動作計画ロボティクス
ELMP: 解析的方針勾配による効率的な動作計画学習
ニューラル動作プランナーを新しい環境に適応させる際、高価な専門家データの再収集を不要にし、微分可能な運動学レイヤーと自己教師あり微調整で直接ポリシーを最適化するフレームワークを提案。
原題: ELMP: Efficient Learning for Motion Planning via Analytical Policy Gradients / Yixiao Li, Tifanny Portela, Jordis Herrmann 他
日本語で読む → - 論文UAV制御cs.CR
RT-SHCUA: UAV制御のためのリアルタイム自己ホスト型コンピュータ利用エージェント
自己ホスト型コンピュータ利用エージェントをUAV制御に適用する際の構造的不整合を解決するため、エージェント出力を契約付きスキル呼び出しに変換し、意味推論と実行・安全監視を分離するリアルタイム・セキュリティ指向アーキテクチャを提案した。
原題: RT-SHCUA: Real-Time Self-Hosted Computer-Use Agent for UAV Control / Di Lu, Bo Zhang, Xiyuan Li 他
日本語で読む → - 論文義足制御ロボティクス
リプレイ制約付きシミュレーションフレームワークによるパワード膝-足首義足コントローラの個人化
記録された歩行データを再生するMuJoCoベースのシミュレータを用いて、深層強化学習により義足のインピーダンスパラメータを個人化し、実機での有効性を実証した。
原題: A Replay-Constrained Simulation Framework for Personalization of Powered Knee--Ankle Prosthesis Controllers / Duong Le, Ryan Posh, Shihao Cheng 他
日本語で読む → - 論文触覚/VLA/操作ロボティクス
予期せぬ感覚を捉える:残差触覚表現によるResTacVLAの接触豊富な操作
視覚言語行動モデルに触覚を統合する際、視覚特徴が触覚を覆い隠す問題を解決するため、視覚予測と実際の触覚の差を残差表現として用い、視覚的に予測できない重要な接触イベントを捉えるResTacVLAを提案した。
原題: Feeling the Unexpected: ResTacVLA for Contact-Rich Manipulation via Residual Tactile Representation / Pengwei Zhang, Bin Xie, Xinpan Meng 他
日本語で読む → - 論文オフライン強化学習機械学習
効率的なオフライン強化学習のためのショートカット軌道計画
拡散モデルによる軌道計画の推論コストを削減するため、単一ステージで学習可能なショートカット軌道モデルを提案し、ステップサイズ調整による1ステップ・数ステップ推論と、実現可能性補正付き批評家による計画選択を実現した。
原題: Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning / Guanquan Wang, Yoshimasa Tsuruoka
日本語で読む → - 論文触覚ロボティクス
スパースな触覚による変形物体のトポロジー非依存メッシュ再構成
視覚なしで少数の触覚のみから、ロープ・布・立体など様々な変形物体の全体メッシュを再構成する学習ベース手法を提案。触覚の次の位置を能動的に選ぶことで精度が向上することを示した。
原題: Topology-Agnostic Mesh Reconstruction of Deformable Objects from Sparse Touch / Everest Yang
日本語で読む → - 論文触覚画像認識
VQ-Touch: センサーとシナリオを横断する高効率触覚生成フレームワーク
触覚画像生成のためのフレームワークVQ-Touchを提案。データ効率の良い表現学習と離散拡散デコーダにより、異なるセンサーやシナリオでの触覚データ生成を実現し、既存手法を上回る性能を示した。
原題: VQ-Touch: A Data-Efficient Tactile Generation Framework Across Sensors and Scenarios / Kailin Lyu, Long Xiao, Jianing Zeng 他
日本語で読む → - 論文VLA/セグメンテーション画像認識
GEAR-Seg: 推論セグメンテーションとデータエンジンのための根拠付き説明可能エージェント
推論セグメンテーションを、クラス非依存セグメンテーション、意味記述、LLM推論に分離した説明可能なエージェントを提案し、ゼロショットで高性能を達成。さらに、大規模データセットGEAR-131Kを自動生成し、軽量モデルの蒸留実験で有効性を示した。
原題: GEAR-Seg: A Grounded Explainable Agent for Reasoning Segmentation and Data Engine / Yanan Wang, Wen Li, Yibin Ying 他
日本語で読む → - 論文メタ学習/ダイナミクスモデリング機械学習
MetaKoopman: 分布シフト下での構造化ダイナミクスモデリングのためのコープマン作用素のベイズメタ学習
コープマン作用素にベイズメタ学習を適用し、分布シフト下での非線形ダイナミクスを線形潜在表現でモデル化・予測する手法を提案。雪や氷などの厳しい条件下での自動運転トラック・トレーラー実験で有効性を実証した。
原題: MetaKoopman: Bayesian Meta-Learning of Koopman Operators for Modeling Structured Dynamics under Distribution Shifts / Mahmoud Selim, Sriharsha Bhat, Karl H. Johansson
日本語で読む → - 論文実験自動化ロボティクス
低コストで拡張可能な実験室自動化:デジタルツイン統合型ロボットプラットフォームによる自律液体分注(RAINBOT)
市販の3Dプリンタを改造した低コスト液体分注ロボットを開発し、ブラウザベースのデジタルツインで遠隔監視・操作を可能にした。色付き溶液の混合実験で精度を実証し、自動実験設計フレームワークと連携させた。
原題: Scalable Low-Cost Laboratory Automation: A Digital Twin-Integrated Robotic Platform for Autonomous Liquid Handling (RAINBOT) / Mohamed Rami Ayeche, Souhil Sid, Ahyen Mostofa 他
日本語で読む → - 論文VLA/計画ロボティクス
STeP: 信号時相論理による視覚言語モデルを用いた行動生成の精密仕様化
視覚言語行動モデルによる指示分解を、信号時相論理(STL)で精密な制約に変換し、実行時検証・監視・再計画を行う階層的フレームワークを提案した。
原題: STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models / Kasra Torshizi, Anukriti Singh, Sidharth Mathur 他
日本語で読む → - 論文操作ロボティクス
NEO: 一度NeRF化すれば何度でも編集可能な連続物体操作フレームワーク
言語指示によるNeRF編集をロボット操作に統合し、物体除去や把持配置実験で既存手法より優れた視覚的・幾何的一貫性を実現した。
原題: NEO: NeRF It Once, Edit It Many Times for Continuous Object Manipulation / Mikołaj Zieliński, David Hall, Dominik Belter 他
日本語で読む → - 論文4D再構成画像認識
SM4RT: 4D再構成のための構造化モーション幾何学の学習
単眼RGBビデオから、物体の剛体運動をSE(3)のモーションベースに分解して表現し、3D再構成と構造化された動きの知覚をエンドツーエンドで行うTransformerモデルを提案した。
原題: SM4RT: Learning Structured Motion Geometry for 4D Reconstruction / Shing Ho J. Lin, Wenzhao Zheng, Dong Zhuo 他
日本語で読む → - 論文視覚慣性オドメトリロボティクス
DB-VIO: 視覚・慣性表現を強化した二分岐型視覚慣性オドメトリ
回転と並進の動特性を別々にモデル化する二分岐構造と、深度情報・姿勢事前情報を活用した視覚・慣性表現の強化により、高精度な6自由度姿勢推定を実現する視覚慣性オドメトリ手法を提案した。
原題: DB-VIO: Dual-Branch Visual Inertial Odometry with Enhanced Visual-Inertial Representation / Ziyu Wan, Lin Zhao
日本語で読む → - 論文ナビゲーションロボティクス
わずか58万の学習可能パラメータで効率的なナビゲーションを学習する
閉形式の幾何計算と3つの小さな学習モジュールを組み合わせた分解型ナビゲーションモデルを提案し、極めて少ないパラメータとデータで高性能を達成した。
原題: Learning to Navigate Efficiently with Only 0.58M Trainable Parameters / Edward Beng Wai Tan, Siew-Kei Lam
日本語で読む → - 論文VLAロボティクス
Xiaomi-Robotics-U0: 世界基盤モデルによる統合的身体性合成
ロボットの身体性を考慮した画像・動画生成を統合する380億パラメータのマルチモーダル自己回帰モデルを提案し、マルチビュー一貫性やロボットの身体制約を保ちながら、シーン生成や転移、動画生成を高品質で実現した。
原題: Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model / Xinghang Li, Jun Guo, Qiwei Li 他
日本語で読む → - 論文自動運転/モデル予測制御ロボティクス
優先度バイアス付き階層スラックを用いた自動運転のためのリアルタイム規則認識非線形MPC
自動運転の運動計画において、安全・規則・快適性・効率の競合をリアルタイムで解決しつつ監査可能にするため、重み付き階層スラック非線形モデル予測制御(W-SQP)を提案した。9つの運転規則ファミリーを4層の共有スラック非線形計画に組み込み、10Hzで再計画し、Waymoデータセットで評価した。
原題: Real-Time Rulebook-Aware Nonlinear MPC for Autonomous Driving with Priority-Biased Tiered Slacks / Hadi Hajieghrary, Benedikt Walter, Chaitanya Shinde 他
日本語で読む →