論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/20 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
SAGE: 海底インフラの自律適応点検のためのエルゴード制御
海底クリスマスツリーのバルブ点検において、センサーから得られるリスク分布に応じて車両の滞在時間を割り当てるエルゴード制御アーキテクチャを提案し、固定ルート方式と比較して高リスクバルブの再訪頻度を向上させることを示した。
原題: SAGE: Ergodic Control for Autonomous and Adaptive Inspection of Subsea Infrastructure / Markus Buchholz, Ignacio Carlucho, Yvan R. Petillot
日本語で読む → - 論文通信フレームワークロボティクス
ネットワーク型フィジカルAIにおける検証ギャップ:ポスト意味論的通信フレームワーク
提案が物理的な実行に至るまでに必要な証拠や権限が不足する「検証ギャップ」を定義し、提案形成と実行の間のインターフェースを扱う通信フレームワークを提案した。
原題: The Verification Gap in Networked Physical AI: A Post-Semantic Communication Framework / Shunsuke Saruwatari
日本語で読む → - 論文VLA/継続学習ロボティクス
OrthoSkillVLA: 勾配情報に基づくスキル部分空間適応による継続的スキル学習
事前学習済みのVLAモデルを複数のスキルに順次適応させる際に生じる破滅的忘却を防ぐため、VLMとActionHeadに別々の部分空間制約を課し、出力層には軽量なMoEデコーダを導入するパラメータ効率的な継続学習フレームワークを提案した。
原題: OrthoSkillVLA: Continual Skill Learning via Gradient-Informed Skill Subspace Adaptation / Jiaqi Wang, Zhou Fang, Qiongfeng Shi 他
日本語で読む → - 論文画像フォレンジック画像認識
ノイズ残差アーティファクトパターン解析によるゼロショットカラー画像改ざん位置特定
単一の画像から参照アーティファクトパターンを推定し、ブロック相関とGMMスコアリングで画素レベルの改ざん確率マップを生成する、学習不要のゼロショット改ざん位置特定手法を提案した。
原題: Zero-Shot Color Image Manipulation Localization via Noise Residual Artifact Pattern Analysis / Edgar Gonzalez-Fernandez
日本語で読む → - 論文マニピュレーションロボティクス
CoToGrasp: 接触トポロジー条件付き器用な把持合成のための正準ワークスペース学習
物体の形状に依存せず、指定された接触トポロジーに厳密に従う多様で安定した把持を生成する新しいフレームワークを提案。物体非依存の学習により、未見物体へのゼロショット一般化を実現し、物理ロボットでの実証も行った。
原題: CoToGrasp: Contact-Topology-Conditioned Dexterous Grasp Synthesis via Canonical Workspace Learning / Julien Merand, Boris Meden, Liming Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
GOAG: 生成型・物体非依存の器用なロボット操作のための把持プランナー
多指ロボットの把持計画において、物体固有のデータに依存せず、グリッパーの接触面分布を学習して汎用的に把持を生成する新しい深層生成モデルを提案した。シミュレーションと実世界で高い成功率を達成し、物体非依存でありながら既存手法と同等以上の性能を示した。
原題: GOAG: Generative and Object-Agnostic Grasp Planner for Dexterous Robotic Manipulation / Julien Merand, Boris Meden, Mathieu Grossard 他
日本語で読む → - 論文セキュリティ/攻撃画像認識
TempJail: 字幕スケジューリングによる大規模視覚言語モデルへの時間的ジェイルブレイク攻撃
動画内の字幕の表示タイミングを最適化することで、大規模視覚言語モデルに有害な応答を引き起こすブラックボックス攻撃手法を提案した。
原題: TempJail: Temporal Jailbreak Attack against Large Vision-Language Models via Subtitle Scheduling / Ling Zhou, Yihao Huang, Jingling Sun 他
日本語で読む → - 論文航法/LLMプランニングロボティクス
洋上風力発電所近傍のAUV・ASV航法のためのワールドモデル基盤LLMプランニング
大規模言語モデルによるプランニングに物理的ワールドモデルを組み合わせ、水中・水上ロボットの航法を実現。衝突回避と目標到達精度を大幅に向上させた。
原題: World-Model-Grounded LLM Planning for AUV and ASV Navigation Near Offshore Wind Farms / Markus Buchholz, Ignacio Carlucho, Yvan R. Petillot
日本語で読む → - 論文手動作復元画像認識
DreamHand: ビデオ拡散モデルを転用した、遮蔽に頑健な自己中心視点3D手動作復元
ビデオ拡散モデルを決定的な幾何エンコーダとして転用し、遮蔽やフレーム外の手の動きを復元する新しい手法を提案。5つのベンチマークでSOTAを達成し、特に遮蔽の多いデータで誤差を大幅に削減した。
原題: DreamHand: Repurposing Video Diffusion Models for Occlusion-Robust Egocentric 3D Hand Motion Recovery / Yufei Liu, Xixi Wang, Hao Li 他
日本語で読む → - 論文階層型強化学習/四足歩行ロボティクス
狭い空間を跳び越える四足ロボットの高ダイナミックスキル遷移学習
四足ロボットが狭いゲートを動的に通過するための階層型強化学習パイプラインを提案。低レベル方策は模倣学習で動物の多様なスキルを獲得し、高レベル制御が視覚情報とスキル能力を考慮して衝突回避軌道を選択する。
原題: Learning Highly Dynamic Skills Transition for Quadruped Jumping Through Constrained Space / Zeren Luo, Jiahui Zhang, Yimin Han 他
日本語で読む → - 論文車両制御ロボティクス
DART-S: オフロード車両ジャンプのための到達可能性監査付きアクティブサスペンション事前調整
オフロード車両のジャンプ時に、サスペンションを事前に調整してピッチや車輪回転を変え、空中での姿勢制御の余裕を増やす手法を提案。シミュレーションで成功率を大幅に向上させた。
原題: DART-S: Reachability-Audited Active-Suspension Preconditioning for Off-Road Vehicle Jumps / Yu Hu, Fangzhou Zhao, Liang Chen 他
日本語で読む → - 論文マニピュレーションロボティクス
PVRA: ロボット組立のための点単位キーポイント投票フレームワーク
RGB-D入力から組立シーンの3Dキーポイントを学習し、組立依存関係を推定してロボットの組立操作に必要なアクション出力を予測するフレームワークを提案した。
原題: PVRA: A Pointwise Key-point Voting Framework for Robotic Assembly / Kulunu Samarawickrama, Roel Pieters
日本語で読む → - 論文ヒューマンロボットインタラクションHCI
ロボットの声の高さは子どものストレスを和らげるか?
ロボットの音声ピッチ(高低)が子どものストレスに与える影響を調べた実験。低い声の方がストレス軽減に有効とされるが、子どもとロボットの対話ではその効果は確認されなかった。
原題: Calming Robot Pitches? Exploring the Influence of Robot Voice Pitch on Children's Stress Levels / Nina G. M. van Roij, Emilia I. Barakova, Briana Isaila 他
日本語で読む → - 論文オフライン強化学習画像認識
RoMAN-Flow: ロボット操作におけるオフライン強化学習のための自己回帰正規化フローの制御
自己回帰正規化フローを用いたオフライン強化学習フレームワークを提案し、サンプリング不要の尤度目的と一段階蒸留により推論遅延を削減しつつ、ロボット操作の性能を維持する。
原題: RoMAN-Flow: Taming Autoregressive Normalizing Flows for Offline Reinforcement Learning in Robotic Manipulation / Shaoxuan Wang, Guangting Zheng, Rui Huang 他
日本語で読む → - 論文移動マニピュレーションAI
DECOWAM: 脚式移動マニピュレーションのための分離型全身世界行動モデル
移動マニピュレーションのための世界行動モデルを提案し、カメラの自己運動とベース・アーム動作を分離して予測する。実ロボットデータセットを用いて、将来の映像と行動の予測精度を向上させた。
原題: DECOWAM: Decoupled Whole-Body World-Action Model for Legged Mobile Manipulation / Siyuan Ma, Boshi Zhang, Yutian Zhang 他
日本語で読む → - 論文ロボット制御ロボティクス
Franka Emika Pandaを生かし続ける:信頼性の高い位置インターフェースを備えたROS 2スタック
Franka Emika Pandaロボットの不安定な外部位置制御の原因を解析し、非同期ハードウェアインターフェースとレートマッチング機構を導入して信頼性の高いROS 2スタックを構築した。
原題: Keeping the Franka Emika Panda alive: a ROS 2 stack with a reliable position interface / Antonio Langella, Davide Risi, Vincenzo Petrone 他
日本語で読む → - 論文空間計画AI
クラスベースヒューリスティック選択によるフライングブロックパズルの解法
NP完全な空間計画問題であるフライングブロックパズルに対し、状態空間を7つのクラスに分類し、クラスに応じた許容ヒューリスティックとタイブレーク機構を動的に切り替えるCBHA*アルゴリズムを提案し、探索性能を大幅に向上させた。
原題: Class-Based Heuristic Selection for Solving the Flying Block Puzzle / Sanyar Ahmadi, Pedram Asadzadeh, Amanj Khorramian
日本語で読む → - 論文HRIロボティクス
深層強化学習による人間伴走ロボットの適応的インタラクション戦略
深層強化学習とMPPI・CBF制御を組み合わせ、環境や状況に応じて人間に対する追従位置を動的に調整する伴走ロボットを実現した研究。
原題: Towards Adaptive Interaction Strategies for Human Companion Robot via Deep Reinforcement Learning / Cong-Thanh Vu, Yen-Chen Liu
日本語で読む → - 論文ヒューマノイドロボットロボティクス
音楽喚起感情の実験インターフェースとしてのヒューマノイド音楽ロボット
音楽ヒューマノイドロボットを、音楽が引き起こす感情を研究するための実験インターフェースとして提案するポジションペーパー。WAS-5ロボットを用いたケーススタディで技術的実現可能性を示す。
原題: Humanoid Musical Robots as Experimental Interfaces for Music-Evoked Emotion / Vincent K. M. Cheung, Jia-Yeu Lin
日本語で読む → - 論文経済モデルphysics.soc-ph
人間なしの成長:機械消費者、企業の循環性、AGI後のGDPと人類の乖離
AGI後の完全自動化経済において、人間が消費しなくても企業間取引だけで経済が成長可能であることを示し、成長率が人間の人口動態から解放され、人間の福祉は所有権シェアにのみ依存することを理論的に証明した。
原題: Growth Without Us: Machine Consumers, Corporate Circularity, and the Decoupling of GDP from Humanity after AGI / Sahil Sharma
日本語で読む → - 論文マニピュレーションロボティクス
コアラグリッパー:器用な操作学習のスケール化のためのロボットグリッパーとデータ収集デバイスの共設計
データ収集用ハンドヘルドデバイスとロボットグリッパーを同時に設計する共設計フレームワークを提案し、並行ジョーグリッパーより器用で把持能力が高いコアラグリッパーシステムを開発した。
原題: Koala Gripper: Co-designing Robotic Grippers and Data-Capture Devices for Scaling Dexterous Manipulation Learning / Amar Hajj-Ahmad, Zubin Kremer Guha, Tim Fofonoff 他
日本語で読む → - 論文触覚HCI
ウェアラブル触覚デバイスにおける論理ベース逐次励起のための空気圧ユニット(PULSE)
流体論理回路を内蔵した平らな布製空気圧アクチュエータを開発し、前腕スリーブの空気圧入力を60%削減して、触覚ストロークキューを生成できることを示した。
原題: Pneumatic Units for Logic-based Sequential Excitation (PULSE) in Wearable Haptic Devices / Jessica Healey, Anoush Sepehri, Michael T. Tolley 他
日本語で読む → - 論文手術計画画像認識
手術の世界行動モデリングに向けて:手術動作計画のための視覚・軌道同時予測の予備的検討
手術映像と器具の軌跡を同時に予測する新しいモデルを提案し、将来の視覚状態と動作軌道の一貫性を評価する。
原題: Towards Surgical World-Action Modeling: A Preliminary Joint Visual-Trajectory Forecasting for Surgical Motion Planning / Weiliang Huang, Huanrong Liu, Bob Zhang 他
日本語で読む → - 論文安全制御制御
状態推定誤差下での障害物回避のための学習ベース計測ロバスト制御バリア関数
状態推定誤差にロバストな新しい制御バリア関数(DMR-CBFとNMR-CBF)を提案し、障害物回避の安全性を向上させつつ保守性と計算コストを低減した。シミュレーションと実機(Unitree Go2)で有効性を実証した。
原題: Learning-Based Measurement-Robust Control Barrier Functions for Obstacle Avoidance under State Estimation Error / Nicholas Rober, Yixuan Jia, Jonathan P. How
日本語で読む → - 論文VLAロボティクス
Logic-VLA: 時間論理条件付き視覚言語行動モデル
自然言語指示に加えて、推論時に与えられる信号時相論理(STL)仕様を満たすように行動を調整するVLAモデルを提案。STLエンコーダと2段階のポリシー適応により、形式要件の充足率を大幅に向上させつつ、通常のタスク成功率をほぼ維持する。
原題: Logic-VLA: A Temporal Logic Conditioned Vision-Language-Action Model / Celina Shiyu Wang, Yiqi Zhao, Junjie Ye 他
日本語で読む → - 論文強化学習AI
階層的スキルポリシーの学習:オフライン品質多様性強化学習によるアプローチ
事前収集データから多様で高品質なスキルを抽出し、オンライン学習を強化する統合パイプラインQDOSを提案。アドバンテージ重み付き品質多様性事前学習とデータ再利用戦略により、操作タスクで優れた性能を達成。
原題: Learning Hierarchical Skill Policies with Offline Quality-Diversity Reinforcement Learning / Tanachai Anakewat, Takayuki Osa, Tatsuya Harada
日本語で読む → - 論文医療ロボティクスロボティクス
EndoLIFT: 言語で曖昧性を解消する潜在条件付き整流フローによる双方向内視鏡制御
内視鏡検査の双方向制御において、同じ視覚情報でも逆の動作が必要となる「意図の曖昧性」を解決するため、言語指示と軌跡潜在変数を組み合わせた視覚言語行動ポリシーを提案した。
原題: EndoLIFT: Language-Disambiguated Latent-Conditioned Rectified Flow for Bidirectional Endoscopic Control / Chi Kit Ng, Yidong Zhang, Lui Siu Hing 他
日本語で読む → - 論文VLAAI
汎用身体性知能に向けて:大規模言語モデル、知識ベース、推論能力を統合した次世代AIエージェントの構築
大規模言語モデル、知識ベース、推論能力を統合し、物理環境で行動する汎用身体性知能エージェントの実現に向けた概念フレームワークと課題を整理したサーベイ論文。
原題: Towards general embodied intelligence: integrating large language models, knowledge bases, and reasoning capabilities to build the next generation of AI agents / Fujiang Yuan, Xia Huang, Lusheng Wang 他
日本語で読む → - 論文ロボット学習ロボティクス
ロボット学習における潜在アクションの重要要素
ロボット操作のための潜在アクションモデル(LAM)の設計選択を体系的に比較し、41の設計選択肢を3次元で評価。VLMバックボーンの微調整が下流のポリシー学習に有効であることを示した。
原題: What Matters for Latent Actions in Robot Learning / Xizhou Bu, Qingda Hu, Lei Zhou 他
日本語で読む → - 論文LiDARオドメトリロボティクス
LF-GICP: ボクセル法線局在性フィールドによるパラメータフリーかつ縮退認識型LiDARオドメトリ
トンネルや廊下などの幾何学的に縮退した環境でのLiDARオドメトリのドリフト問題に対し、パラメータ調整不要の手法を提案。ボクセル法線局在性フィールドとその統計量を用いて縮退を検出し、フィッシャー情報対応重み付けを適用する。
原題: LF-GICP: Parameter-Free Degeneracy-Aware LiDAR Odometry via a Voxel-Normal Localizability Field / Eunsoo Im
日本語で読む →