論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/21 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文3Dシーン理解画像認識
Stream3Dv2: 幾何学的・意味的融合によるストリーミングゼロショット3Dシーン理解の強化
本論文は、ストリーミングRGB-D入力とノイズのある2Dセグメンテーションマスクを扱うためのトレーニング不要の3Dシーン理解フレームワークを提案し、幾何学的・意味的融合と多様体距離に基づく点群精緻化により性能を向上させる。
原題: Stream3Dv2: Geometric-Semantic Fusion Enhanced Streaming Zero-Shot 3D Scene Understanding / Jie Xu, Na Zhao
日本語で読む → - 論文マニピュレーションロボティクス
力/トルクベースの運動学的適応によるロボット操作タスク
関節角度と手首の力/トルクセンサのみを用いて、未知のツールの運動学をオンライン推定する適応手法を提案し、安定性を証明した。
原題: Force/Torque-Based Kinematic Adaptation for Robotic Manipulation Tasks / Carl Glen Henshaw
日本語で読む → - 論文歩行ロボティクス
模擬変形地表面上での人間型ロボットの立ち上がり動作のデモンストレーション誘導
硬い地面で記録した人間のデモンストレーションを参照として、変形する柔らかい地面での29自由度ヒューマノイドの立ち上がり動作を強化学習で生成する手法を提案した。
原題: Demonstration-Guided Humanoid Stand-Up on an Emulated Deformable Surface / Aniruddh Kushwah, Vyankatesh Ashtekar, Ashish Dutta
日本語で読む → - 論文ワールドモデル機械学習
部屋を読む:リカレントワールドモデルの状態における暗黙の混乱エンコーディング
RSSMベースのワールドモデル(DreamerV3など)の隠れ状態が、予測誤差だけでなく自身の「混乱」も追跡していることを発見し、線形プローブで検出可能であることを示した。
原題: Reading the Room: Implicit Confusion Encoding in Recurrent World Model States / Donald Aadithiyan
日本語で読む → - 論文把持/物理特性推定/視覚触覚融合ロボティクス
ViTacPhys: 人間の視覚・触覚デモから物体の物理特性を推定し適応的把持を実現するフレームワーク
人間の操作デモから物体の質量・摩擦係数・剛性を推定し、その物理特性に基づいてロボットの把持ポリシーを適応させる視覚・触覚融合フレームワークを提案した。
原題: ViTacPhys: Physical Property-Aware Grasping from Human Visual-Tactile Demonstrations / Yiwen Liu, Yujun Zhu, Kui Jia 他
日本語で読む → - 論文オフロード移動/動力学予測ロボティクス
NeSAM: 土壌適応を備えたオフロード移動のためのニューロシンボリック動力学
オフロード車両の運動予測を、土壌力学を明示的に扱うテラメカニクスと学習ベースの残差モデルを組み合わせたニューロシンボリックフレームワークで高精度化した。
原題: NeSAM: Neuro-Symbolic Kinodynamics with Soil Adaptation for Off-Road Mobility / Chenhui Pan, Tong Xu, Francesco Cancelliere 他
日本語で読む → - 論文タスク計画ロボティクス
TaPeR: 少数のデモンストレーションからの疎なタスク先行関係グラフの確率的復元
人間のデモンストレーションから、タスクの部分的な順序関係(先行関係)を確率的に推定し、ロボットが柔軟にサブタスクを並べ替えられるようにする手法を提案した論文。
原題: TaPeR: Probabilistic Recovery of Sparse Task Precedence Graphs from a Handful of Demonstrations / Adrian Röfer, Karla Stepanova, Abhinav Valada
日本語で読む → - 論文位置推定ロボティクス
海岸線を構造的制約として活用する:自律型水上艇の位置推定のためのシーン幾何学
GPSが使えない環境での自律型水上艇の位置推定のために、海岸線と水面の幾何学的構造を利用する2つの手法を提案した。LiDARとカメラの両方で海岸線を観測し、衛星地図との照合により位置を推定する。
原題: The Coastline as a Structural Constraint: Harnessing Scene Geometry for Autonomous Surface Vessel Localization / Derek R. Benham, Joshua G. Mangelson
日本語で読む → - 論文ナビゲーションロボティクス
SRL-MPC: 形状を考慮した強化学習モデル予測制御
異なる形状のロボット群や群衆の中での安全で効率的なナビゲーションを実現するため、強化学習でMPCのパラメータを適応的に調整する手法を提案した。
原題: SRL-MPC: Shape-Aware Reinforcement Learned Model Predictive Control / Ruihua Han, Rui Gao, Zhe Liu 他
日本語で読む → - 論文HRIAI
なぜ私のロボットは性格を変えたのか?LLMベースのHRIにおける接地されたロボットペルソナのためのプロンプトガイドライン
LLMベースのロボットの対話におけるプロンプト設計の枠組みを提案し、8つの機能コンポーネントからなるテンプレートとガイドラインを提示した。
原題: Why did My Robot Just Change Personality? Prompting Guidelines for a Grounded Robot Persona in LLM-Based HRI / Ashita Ashok, Franziska Babel, Patrick Holthaus 他
日本語で読む → - 論文群制御ロボティクス
FF-MPCC: モデル予測輪郭制御による高速アジャイル編隊飛行
UAVの編隊飛行を高速かつアジャイルに行うため、MPCCフレームワークに編隊維持を統合した分散型手法を提案し、複雑な経路追従と動的編隊形状の変更を実現した。
原題: FF-MPCC: High-speed Agile Formation Flight with Model Predictive Contouring Control / Aditya Dandwate, Vit Kratky, Parakh M. Gupta 他
日本語で読む → - 論文音響データセットcs.SD
AudioWorldSim: 世界モデルのための現実的なバイノーラル音響データセット
MetaのSoundSpaces 2.0を拡張し、ランダムなエージェント移動に基づく現実的なバイノーラル音響データセットを自動生成するオープンソースプラットフォームを提案した。
原題: AudioWorldSim: Realistic Binaural Audio Datasets For World Models / Luis Vitor Zerkowski, Luiz Velho
日本語で読む → - 論文自律飛行ロボティクス
ニューラルプリミティブ:プリミティブベース模倣学習による効率的なエンドツーエンドローカルプランナー
未知の障害物環境での自律飛行において、模倣学習を用いたエンドツーエンドのローカルプランナーを提案し、センサ入力を多項式係数に直接マッピングすることで、リアルタイムで滑らかで衝突のない軌道を生成する。
原題: Neural-Primitive: An Efficient End-to-end Local Planner with Primitive-based Imitation Learning for Autonomous Flight / Zhitao Liu, Guangtong Xu, Zihan Wang 他
日本語で読む → - 論文画像改ざん検出画像認識
GAP-SAM: グローバルアーティファクト事前情報による汎用的なAI生成画像改ざん位置特定
AI生成画像の改ざん位置を特定する手法で、画像とそのVAE再構成からグローバルなアーティファクト情報を抽出し、SAM3の特徴ピラミッドに注入することで、セマンティック境界への過学習を抑えつつ高い汎化性能を実現した。
原題: GAP-SAM: A Global Artifact Prior for Generalizable AI-Generated Image Manipulation Localization / Haozhen Yan, Siyuan Shan, Zijian Yu 他
日本語で読む → - 論文セキュリティ/マルチモーダルRAG画像認識
Vis-Poison: マルチモーダル検索拡張生成における視覚知識の毒化攻撃
画像自体を攻撃ペイロードとして用い、キャプション等のテキストを改変せずにマルチモーダルRAGシステムを欺く新たな毒化攻撃を提案し、ブラックボックス環境で高い成功率を実証した。
原題: Vis-Poison: Poisoning Visual Knowledge in Multimodal Retrieval-Augmented Generation / Rujin Liang, Zhongpu Chen, Yuhao Lei 他
日本語で読む → - 論文ワールドモデルAI
形態パラメータ一般化のためのグラフ演算子ワールドモデル
連続制御におけるワールドモデルを、リンク長や質量などの形態パラメータが変化しても汎化できるよう、グラフ構造と演算子分解を用いて構築した。
原題: Graph-Operator World Models for Morphology-Parameter Generalization in Continuous Control / Xu Yang, Yiqin Yang, Qianchuan Zhao
日本語で読む → - 論文医用画像/変形予測AI
解剖学情報を組み込んだニューラルネットワーク:損失とアーキテクチャにおける解剖学的事前知識の符号化と、ガイドワイヤ誘発性大動脈腸骨変形のSE(3)定式化
解剖学的に妥当な予測を強制するため、損失項に軟らかい解剖学的制約を、アーキテクチャに硬い制約を組み込んだAINNを提案し、ガイドワイヤ挿入時の大動脈腸骨変形をSE(3)上の曲線としてモデル化して2D血管造影から3D予測を学習する。
原題: Anatomy-Informed Neural Networks: Encoding Anatomic Priors in Loss and Architecture, with an SE(3) Formulation of Guidewire-Induced Aortoiliac Deformation / David P. Stonko
日本語で読む → - 論文マニピュレーションロボティクス
姿勢不確実性下での物体取得と保持のためのハイブリッドローラージャミンググリッパ
ローラーの回転で物体を引き込み、その後真空による粒状ジャミングで剛性を高めて保持する、取得と保持を一体化したハイブリッドグリッパを提案し、840回の把持実験で高い成功率を実証した。
原題: Hybrid Roller-Jamming Gripper for Object Acquisition and Retention Under Pose Uncertainty / Yijie Ren, Guillaume Gourmelen, Hiroyasu Iwata
日本語で読む → - 論文セキュリティ/触覚cs.CR
ゴーストタック:物理的接触なしに触覚センサーを操作する
電磁干渉を用いて触覚センサーの出力を遠隔から操作する攻撃手法を提案し、ロボットの触覚認識を欺くことを実証した。
原題: GhostTac: Manipulating Tactile Sensors without Physical Contact / Kun Wang, Xuancun Lu, Ruochen Zhou 他
日本語で読む → - 論文制御ロボティクス
微分平坦な固定翼航空システムの軌道追従のための非線形モデル予測制御
微分平坦性に基づく軌道生成と非線形モデル予測制御を統合し、風を考慮したサンプリング戦略を導入して、固定翼UAVの複雑な軌道追従精度とロバスト性を向上させた。
原題: Nonlinear Model Predictive Control for Trajectory Tracking of Differentially Flat Fixed-Wing Aerial Systems / Nishanth Bobbili, Pratyaksh Rao, Luca Morando 他
日本語で読む → - 論文操作/能動的知覚ロボティクス
PhysCaP: 物理情報に基づく探索によるコード駆動ポリシーエージェントの接地
ロボット操作における能動的知覚のため、物理特性を推定し探索行動を計画するコード駆動ポリシーエージェントを提案。
原題: PhysCaP: Grounding Code-as-Policy Agent with Physics-Informed Exploration / Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang 他
日本語で読む → - 論文オフライン強化学習機械学習
オフライン強化学習のためのポリシー抽出の分離
オフライン強化学習では、アクターと批評家を同時に訓練する従来の手法が、固定データによる過大評価やOOD行動の問題を引き起こす。本論文では、アクターを行動分布のモデリングに限定し、推論時に批評家が候補行動を再ランク付けする「分離ポリシー抽出」パラダイムを提案し、性能向上を実証した。
原題: Decoupling Policy Extraction for Offline Reinforcement Learning / Xuyao Lin, Yixiang Shan, Jinru Duan 他
日本語で読む → - 論文自動運転画像認識
VLAベースのエンドツーエンド自動運転のための協調的マルチモーダル相互作用
VLAモデルを用いた自動運転において、異種センサ間の効果的なマルチモーダル相互作用と複数軌道計画を統合し、安全性と解釈可能性を向上させるシステムを提案した。
原題: A Collaborative Multi-Modality Interaction for VLA-based End-to-End Autonomous Driving / Jingtao Sun, Xiaohai He, Yike Zhang 他
日本語で読む → - 論文自動運転テストロボティクス
自動運転システムのためのスケーラブルな分散シミュレーションベーステスト
自動運転システムの大規模なシナリオテストを、Kubernetesクラスタ上で分散実行するためのDevOps駆動のフレームワークを提案し、200シナリオの評価で逐次実行と比べて8倍以上の高速化を実証した。
原題: Scalable Distributed Simulation-Based Testing for Automated Driving Systems / Christian Geller, Benedikt Haas, Lutz Eckstein
日本語で読む → - 論文セキュリティ/公平性機械学習
アンカリングバイアス:継続学習下のMLLMに対する持続的な公平性バックドア攻撃
マルチモーダル大規模言語モデル(MLLM)に、継続学習後も持続する公平性侵害バックドアを注入する攻撃手法PFBAを提案した。
原題: Anchoring Bias: A Persistent Fairness Backdoor Attack against MLLMs under Continual Learning / Yuyang Luo, Kai Shu
日本語で読む → - 論文構成論/計画ロボティクス
永続的カテゴリモデリングによるロボットの生涯再構成:統合タスク駆動の共同設計・検証・計画
ロボットを圏論的な抽象回路としてモデル化し、SMTソルバーで設計と実行時の構成を同時に合成する枠組みを提案。環境変化に応じてロボットが自身の不適合を検知し、新しい構成を自律的に再設計する。
原題: Lifelong Robot Recomposition via Persistent Categorical Modeling for Unified Task-Driven Co-Design, Verification, and Planning / Steven Swanbeck, Mitch Pryor
日本語で読む → - 論文sim2realロボティクス
シミュレーションから実世界への性能証明書のためのベッティング
実世界の試行結果を予測するためにシミュレーション結果を賭けとして利用し、実世界の結果に基づいて賭け金を増減させることで、任意の時点で有効な性能証明書(平均値の信頼区間)を生成するフレームワークを提案した。
原題: Betting for Sim-to-Real Performance Certificates / Yujia Chen, Bowen Weng
日本語で読む → - 論文双腕操作/動作計画ロボティクス
ハード制約を伴う高速な協調双腕動作計画
双腕ロボットが剛体を扱う際に必要な両手先間の相対変換を常に満たす高速な動作計画手法を提案し、シミュレーションと実機で検証した。
原題: Fast Coordinated Bimanual Motion Planning With Hard Constraints / Borna Paro, Luka Petrović, Ivan Marković
日本語で読む → - 論文VLA/安全性AI
SafeBranch: 身体化エージェントのための分岐ペア安全性アライメント
身体化エージェントの安全性を高めるため、安全違反を起こした軌道を巻き戻して安全な代替行動とペアにし、その分岐ペアで学習するフレームワークを提案。タスク成功率を保ちつつ安全性を大幅に向上させた。
原題: SafeBranch: Branch-Pair Safety Alignment for Embodied Agents / Hyunse Lee, Jiwoo Jeong, Haneul Lee 他
日本語で読む → - 論文連合学習/セキュリティcs.CR
連合学習のための鍵付き来歴透かしと相補的格子ベース安全集約
連合学習におけるデータ漏洩、不正再利用、悪意ある勾配操作を防ぐため、鍵付き来歴透かしと格子ベースのゼロ知識安全集約を組み合わせたフレームワークを提案した。
原題: Keyed Provenance Watermarking with Complementary Lattice-Based Secure Aggregation for Federated Learning / Xinyun Liu, Zhi Lu, Yu Chen 他
日本語で読む →