論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/3 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文空中ロボット/制御ロボティクス
多リンク空中ロボットによる接触豊富な表面滑走タスクのためのハイブリッドインピーダンス-アドミッタンス制御
多リンク空中ロボットの関節とローターの駆動源を分離し、アドミッタンス制御とインピーダンス制御を同時に実現するハイブリッド制御戦略を提案し、表面滑走タスクでの適応性とロバスト性を実証した。
原題: Hybrid Impedance-Admittance Control with Multi-Link Aerial Robot for Contact-Rich Surface Sliding Task / Zicheng Luo, Maolin Lei, Jinjie Li 他
日本語で読む → - 論文VLA画像認識
SpatioLM: 視覚言語モデルにおける汎用物理空間知能の実現
視覚言語モデルに追加の3D入力や外部エンコーダを使わず、パラメータ効率的なモジュールと擬似深度・カメラ情報の教師信号で空間推論能力を強化し、汎用性能の低下を抑えつつ空間知能を向上させた。
原題: SpatioLM: Towards General Physical Spatial Intelligence in Vision-Language Models / Jing Wu, Jianhua Wu, Jiayi Guan 他
日本語で読む → - 論文自動運転/シミュレーション画像認識
DecoupleGS: エンドツーエンド自動運転テストのためのインタラクティブ3Dガウススプラッティング
エンドツーエンド自動運転の検証用に、高忠実度の静的背景と操作可能な動的エージェントを分離した3Dガウススプラッティングフレームワークを提案し、リアルタイムでインタラクティブなクローズドループシミュレーションを実現した。
原題: DecoupleGS: Interactive 3D Gaussian Splatting for End-to-End Autonomous Driving Testing / Siying Li, Ying Ni, Jie Sun 他
日本語で読む → - 論文VLAロボティクス
ValueFormer: ステージ認識ラベルを備えた半自律VLAポリシーのための因果トランスフォーマー価値関数
行動クローニングによるVLAポリシーは失敗を検出できないため、密で連続的な価値ラベルを生成するコンパクトな因果トランスフォーマーを提案し、実ロボットのサンドイッチ組み立てタスクで成功率を70%から85%に向上させた。
原題: ValueFormer: A Causal Transformer Value Function with Stage-Aware Labels for Semi-Autonomous Vision-Language-Action Policies / Inkyu Sa, Konstantin Stulov, Rajat Bhageria
日本語で読む → - 論文VLAロボティクス
重要な場所を見る:視覚言語行動モデルのための適応的視覚精緻化
VLAモデルの視覚エンコーダに生じる注意アーティファクトを修正し、不確実性に基づいて高解像度の局所精緻化を行うフレームワークAtVLAを提案した。
原題: Look Where It Matters: Adaptive Visual Refinement for Vision-Language-Action Models / Jin Cui, Yanbin Hu, Xinyue Long 他
日本語で読む → - 論文探索/救助ロボティクス
四足ロボットの捜索救助のための状況認識フロンティア優先順位付け
四足ロボットの捜索救助において、情報利得や救助関連性、地形ペナルティなどを考慮したフロンティア優先順位付け手法を提案し、シミュレーションで有効性を検証した。
原題: Situation Aware Frontier Prioritization for Quadruped Search and Rescue / Kevin Farias, Santiago Martin, Barbara Flores 他
日本語で読む → - 論文人ロボット協調ロボティクス
選好最適化と動的運動プリミティブを組み合わせた適応型人ロボット協調塗装
人間のフィードバックに基づく選好最適化と動的運動プリミティブを統合し、ロボットが塗装作業中にリアルタイムで動作を適応させる協調フレームワークを提案した。実験により作業者の負担軽減と成果向上を確認した。
原題: Adaptive Human-Robot Collaborative Painting Combining Preference-Based Optimization and Dynamic Motion Primitives / C. Cella, M. Ristic, M. Faroni 他
日本語で読む → - 論文マルチエージェント/帰属分析AI
CockpitHAT: 依存関係グラフ駆動の階層的帰属分析による具現化マルチエージェントコックピットの信頼性向上
LLMマルチエージェントシステムのプロセスレベルの失敗を、依存関係グラフとマルチチャネル証拠を用いて階層的に帰属分析するフレームワークCockpitHATを提案し、自動車コックピットなどの安全重要領域での信頼性を向上させた。
原題: CockpitHAT: Dependency-Graph-Driven Hierarchical Attribution for Embodied Multi-Agent Cockpits / Wei Wang, Shuanghe Liu, Zhu Zhuo 他
日本語で読む → - 論文コード生成cs.SE
再生成せずデバッグせよ:ニアミスハードウェア演算子を修復するドメイン特化エージェント
ハードウェアアクセラレータ向けカーネル生成において、失敗した候補を捨てずにデバッグして再利用するドメイン特化エージェントを提案し、再生成よりも高い成功率と低コストを実証した。
原題: Don't Regenerate, Debug: A Domain-Specific Agent for Repairing Near-Miss Hardware Operators / Yansong Sun, Shenxiu Wu, Siyuan Chen 他
日本語で読む → - 論文画像鑑識画像認識
スパース制約付き整流フローによるオープンセット視覚テキスト鑑識
生成AIによる視覚テキスト改ざんを検出するため、改ざんパターンに依存せず、画像を本物の統計に合わせるための局所復元コストを推定する生成型検出器を提案。スパース制約付き整流フローと自己教師ありアーティファクト注入により、未知の改ざんに対しても高い性能を示した。
原題: Open-Set Visual Text Forensics via Sparse-Constraint Rectified Flow / Jiangling Zhang, Shuxuan Gao, Zeyu Chen 他
日本語で読む → - 論文安全制御ロボティクス
ミンコフスキー演算による制御バリア関数:多面体環境での安全なナビゲーション
多面体ロボットと多面体障害物の正確な符号付き距離関数をミンコフスキー演算と凸最適化で計算し、非平滑制御バリア関数に統合して安全な制御を実現する手法を提案した。
原題: Control Barrier Functions via Minkowski Operations for Safe Navigation among Polytopes / Yi-Hsuan Chen, Shuo Liu, Wei Xiao 他
日本語で読む → - 論文検証/到達可能性ロボティクス
確率的到達可能動作検証:セットベース学習による視覚運動ポリシーの検証
視覚エンコーダを固定し、下流ポリシーとの低次元インターフェースにセット伝播を限定することで、視覚運動ポリシーの到達可能性解析を効率化し、セットベース学習で動作偏差を直接最適化して確率的到達可能半径を縮小する手法を提案。
原題: Probabilistic Reachable-Action Verification of Visuomotor Policies via Set-Based Training / Yanliang Huang, Zhuocheng Zhang, Peng Xie 他
日本語で読む → - 論文機能安全ロボティクス
産業用人型ロボットの機能安全認証に向けて:フェイルパッシブのギャップと実現可能性調査
人型ロボットの安全認証における根本課題(電源遮断が危険を招く「フェイルパッシブのギャップ」)を特定し、外部安全チェーンを用いてその位置を特定し、Unitree G1での実証実験を行った。
原題: Toward Certified Functional Safety for Industrial Humanoid Robots: The Fail-Passive Gap and a Feasibility Study / Caiwu Ding, Tao Cui, Lingyun Wang 他
日本語で読む → - 論文ビデオ理解画像認識
PhyCheck: ビデオLLMにおける物理法則理解のための詳細な根拠に基づくデータセット
ビデオ中の事象が物理法則に従うかどうかを判定するデータセットPhyCheckを構築し、粗粒度・細粒度のサブセットと診断用サブセットを用いてVideo-LLMの物理理解を改善・評価した。
原題: PhyCheck: Fine-Grained Evidence-Grounded Dataset for Physical Law Understanding in Video-LLMs / Zhongjie Ba, Shengwang Xu, Peng Cheng 他
日本語で読む → - 論文ケアロボットロボティクス
ケアロボットに関する人間中心の考察:介護者の視点の比較研究
米国、メキシコ、チリの介護者298人を対象に、4種類のケアロボット(物品搬送、ベッド移動補助、バイタルサイン監視、移動支援)に対する認識を混合手法で調査し、国を超えて概ね肯定的な評価が得られた一方、倫理的懸念(依存性、人間の監督、雇用への影響)も明らかにした。
原題: Human-Centered Reflections on Care Robots: A Comparative Study of Caregiver Perspectives / Laura Londoño, Klaus Baumann, Abhinav Valada 他
日本語で読む → - 論文強化学習機械学習
上側期待値マルチステップQ学習によるオフ方策強化学習
マルチステップリターンの悲観的バイアスを非対称な期待値損失で補正する新しいQ学習アルゴリズムENQを提案し、理論的性質と実験性能を示した。
原題: Upper-Expectile Multi-Step Q-Learning for Off-Policy Reinforcement Learning / Abdelghani Ghanem, Mounir Ghogho
日本語で読む → - 論文把持ロボティクス
MANGO-Grasp: 幾何指向3Dガウス上のマハラノビス場によるクロスエンボディ器用把持
異なる多指ハンド間で安定した把持を合成するクロスエンボディ器用把持のため、物体を幾何指向3Dガウスプリミティブで、ロボットハンドを形態・運動学的記述子で表現し、マハラノビス場を用いて相互作用を予測・最適化するフレームワークを提案した。
原題: MANGO-Grasp: Mahalanobis Fields over Geometry-Oriented 3D Gaussians for Cross-Embodiment Dexterous Grasping / Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou 他
日本語で読む → - 論文ナビゲーション制御
ロボットナビゲーションのための安全でロバストなチューブベース経路追従
未知の障害物環境でロボットが安全に経路追従するための制御フレームワークを提案。チューブベース制御で外乱に強く、障害物回避と経路追従を統合する。
原題: Safe and robust tube-based path-following for robot navigation / Arthur H. D. Nunes, Vinicius M. Gonçalves, Guilherme V. Raffo 他
日本語で読む → - 論文サーベイロボティクス
重みかスキルか?ロボット学習技術のサーベイ:行動予測重みから自らスキルを書くロボットまで
ロボット学習の2つのアプローチ(重みに知識を埋め込むVLAモデルと、コードとしてスキルを自己改善するエージェント)を軸に、77の代表的なシステムを分類・分析したサーベイ論文。
原題: Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills / Gaytri Jena, Kapil Wanaskar, Vinija Jain 他
日本語で読む → - 論文世界モデル/自律航法画像認識
DF$^3$: デコーダ不要の特徴予測による自律航法の世界モデリング
ビデオから未来の状態を予測する世界モデルにおいて、デコーダを使わずに潜在空間内で特徴を予測し、直接タスク出力を得る新しいフレームワークを提案した。
原題: DF$^3$: World Modeling via Decoder-Free Feature Forecasting in Autonomous Navigation / Jiaming Chen, Guoan Xu, Aoshen Huang 他
日本語で読む → - 論文sim2realロボティクス
モデルミスマッチ下での計画の認証:乏しいデータからの到達可能性に関する三難問題
シミュレーションから実機へのポリシーにおいて、観測データが少ない場合に固定制御シーケンスの安全性を事前認証する方法を提案し、モデル誤差の有界性を仮定した上で、到達可能集合を伝播させて安全でない領域を回避することを保証する。
原題: Certifying Plans under Model Mismatch: A Trilemma for Reachability from Scarce Data / Yanliang Huang, Zhen Zhang, Ahmad Hafez 他
日本語で読む → - 論文動作捕捉画像認識
Sen-Cap: LiDARとカメラ統合によるセンサ柔軟かつノイズ耐性のある人間動作捕捉
LiDARとカメラのマルチモーダルデータを統合し、センサ間のキャリブレーション不要で柔軟な配置に対応し、ノイズやセンサ故障に頑健な3D人間動作捕捉フレームワークを提案した。
原題: Sen-Cap: Sensor-Flexible and Noise-Resilient Human Motion Capture via LiDAR-Camera Integration / Aoru Xue, Yujing Sun, Yiming Ren 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
StableMimic: 人間らしいスムーズな復帰を実現するヒューマノイド動作追跡 - 追跡分布を超えた学習による構造化された転倒後行動
ヒューマノイドの動作追跡中に転倒した際、追跡のみのポリシーでは非現実的な参照を追いかけて危険な動作を引き起こす問題に対し、転倒後の復帰動作を学習する専門家と追跡専門家を切り替える手法を提案し、実機で検証した。
原題: StableMimic: Smooth Human-Like Recovery for Humanoid Motion Tracking - Learning Beyond the Tracking Distribution for Structured Post-Fall Behavior / Weihao Wu, Ming Huang, Ruofei Liu 他
日本語で読む → - 論文状態推定ロボティクス
脚式ロボットの状態推定のための残差ベース適応カルマンフィルタ
脚式ロボットの状態推定において、ノイズ共分散行列をオンラインで適応させる手法を提案し、固定パラメータのInEKFと比較して精度が向上することを示した。
原題: Residual-Based Adaptive Kalman Filtering for Legged Robot State Estimation / Mihaela Popescu, Dennis Mronga, Shivesh Kumar 他
日本語で読む → - 論文3D再構成画像認識
DerainSplat: スパースな雨天視点からのフィードフォワードによるクリーンな3Dガウススプラッティング
雨天の少数視点からクリーンな3Dシーンを再構成するフィードフォワード型フレームワークを提案し、天候要因の予測と整合性を利用して高品質な再構成を実現した。
原題: DerainSplat: Feed-Forward Clean 3D Gaussian Splatting from Sparse Rainy Views / Fuzhen Jiang, Changyue Shi, Chuxiao Yang 他
日本語で読む → - 論文手と物体のインタラクション合成画像認識
PhotoHOI: 単一RGB写真からの3D手と物体のインタラクション合成
単一のRGB写真と自然言語指示から、3Dの手と物体のインタラクションシーケンスを合成する新しい手法を提案。視覚言語モデルでタスクを解析し、接触と把握の事前知識を活用して、実写画像や未知の物体にも一般化する。
原題: PhotoHOI: Synthesizing 3D Hand-Object Interactions from a Single RGB Photograph / Zhenhao Zhang, Jiajun Zhang, Wei Min 他
日本語で読む → - 論文VLAロボティクス
接地された意味的再結合による視覚言語行動モデルの指示一般化の堅牢化
VLAモデルが言い換え指示で性能低下する原因を、アーキテクチャ上の問題として特定し、タスク意味と視覚特徴を明示的に融合する介入(GSR)を提案して、パラフレーズ不変性を大幅に改善した。
原題: Grounded Semantic Re-Binding for Robust Instruction Generalization in Vision-Language-Action Models / Zhaokai Yin, Zhipeng Zhang
日本語で読む → - 論文群制御ロボティクス
接触駆動による自由形状ロボット自己組織化構造の位置推定
モジュールロボットが接触情報のみを用いて相対位置を推定する手法を提案し、外部インフラなしでタワーやカンチレバーの組み立てを可能にした。
原題: Contact-Driven Localization in a Freeform Robotic Self-Assembled Structure / Mohammadali Rashidioun, Michael Sosa, Petras Swissler
日本語で読む → - 論文歩行ロボティクス
Open-DiffLoco: 展開可能なブラインド四足歩行のためのオープンソース微分可能学習
微分可能シミュレーションを用いて、複雑な報酬設計なしで実機展開可能な四足歩行ポリシーを訓練するオープンソースフレームワークを提案し、Unitree Go2で実証した。
原題: Open-DiffLoco: Open-Source Differentiable Learning for Deployable Blind Quadruped Locomotion / Martin Opat
日本語で読む → - 論文走行可能性解析ロボティクス
TravKAN: コルモゴロフ-アーノルドネットワークによる高速かつ解釈可能な非線形走行可能性解析
本論文では、コルモゴロフ-アーノルドネットワークを用いた走行可能性推定フレームワークTravKANを提案し、学習後に解析式を抽出することで解釈可能性を実現し、LiDARの反射率特徴を新たに導入して性能を向上させた。
原題: TravKAN: Fast and Interpretable Nonlinear Traversability Analysis with Kolmogorov-Arnold Networks / Daniel Fusaro, Simone Mosco, Wanmeng Li 他
日本語で読む →