論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/2 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文解釈可能性自然言語
知っているのに聞かれた時だけ言う:LLM内部診断とMinerva-7Bの分裂的認知
言語モデルの内部表現を解析・操作する「LLM内部診断」を提案し、Minerva-7Bがリスクを内部で区別しながら行動には反映しないこと、誤った前提に従いつつ内部には真実を保持することを示した。
原題: Knowing, and Saying It Only When Asked: LLM Endognostics and the Schizognosis of Minerva-7B / Fabrizio Davide, Francesco Collova
日本語で読む → - 論文歩行ロボティクス
足場制約地形におけるヒューマノイドのためのワールドモデル拡張視覚歩行
本研究では、不連続な足場制約地形でのヒューマノイド歩行を改善するため、リカレントワールドモデルとPPOポリシーを共同訓練するWM-LOCOを提案し、シミュレーションと実機で高い成功率を達成した。
原題: World-Model-Augmented Visual Locomotion for Humanoids on Foothold-Constrained Terrain / Yuxi Liu, Lijun Han, Ziming Wang 他
日本語で読む → - 論文データエンジン/操作学習画像認識
RoboTok: 人間のデモンストレーション検索と器用な操作学習のためのインターネット規模データエンジン
クエリ動画から関連する人間の操作デモをウェブ動画から検索し、器用なロボットポリシーの訓練に利用するデータエンジンを提案。3D手の軌跡に基づく潜在動作空間を学習し、視点や外観の変化に頑健な検索を実現。
原題: RoboTok: An Internet-Scale Data Engine for Human Demonstration Retrieval and Dexterous Manipulation Learning / Howard Qian, Yiting Chen, Yunfei Xie 他
日本語で読む → - 論文セグメンテーション/エッジAI/宇宙ロボティクスロボティクス
資源制約のある宇宙ロボティクス向けハードウェア高速化インスタンスセグメンテーションと重要度解析
月面探査ロボット向けに、量子化キャリブレーション手法AVISとDPU上のYOLOベースセグメンテーションモデルを導入し、低照度・計算資源制約・放射線故障下でのリアルタイム推論を実現。ソフトウェアレベルの重要度解析で故障影響を推定し、精度損失の69.8%回復と消費電力5.7Wを達成した。
原題: Hardware-Accelerated Instance Segmentation for Resource-Constrained Space Robotics with Criticality Analysis / Siddhant Shete, Hilmi Dogu Kücüker, Udo Frese 他
日本語で読む → - 論文歩行ロボティクス
FOCUS: 堅牢な人型プロプリオセプティブオドメトリのための足部観測信頼度
二値の接触判定に頼らず、シミュレーションから学習した連続的な足部FK信頼度をEKFに統合し、人型ロボットのオドメトリ精度を向上させる手法を提案した。
原題: FOCUS: Foot Observation Confidence for Robust Humanoid Proprioceptive Odometry / Kaixin Feng, Angsong Li, Shaopeng Zhang 他
日本語で読む → - 論文3Dプリンティングcs.GR
WildFab: 実世界モデルからの多軸3Dプリンティング
実世界の複雑な3Dモデル(ソリッドとシェルの組み合わせや非多様体構造を含む)を直接処理し、多軸3Dプリンティングのための空間ツールパスと衝突回避動作を計算するフレームワークを提案。ニューラル符号なし距離場と正則化一般化巻き数場を組み合わせたハイブリッド表現を用いる。
原題: WildFab: Multi-Axis 3D Printing from Models in the Wild / Jiasheng Qu, Zhikai Shen, Chenyu Xu 他
日本語で読む → - 論文HRI/オントロジーHCI
対話型人間-ロボット相互作用における矛盾の特定と解決のための基盤オントロジー構築
人間とロボットの対話中の矛盾を体系的に定義・表現するための基盤オントロジーを、活動理論に基づいて構築する研究。
原題: Towards a Foundational Ontology for Identifying and Resolving Contradictions in Dialogue-based Human-Robot Interactions / Maitreyee Tewari, Michele Persiani
日本語で読む → - 論文自動運転ロボティクス
代理学習から運転判断へ:将来認識型自動運転プランナー評価のための転移ベースフレームワーク
将来情報を用いた自動運転プランナーの性能向上主張を検証するための分析フレームワークPDTを提案し、代理指標の改善が実際の運転判断改善に転移するかを評価する。
原題: From Proxy Learning to Driving Decisions: A Transfer-Based Framework for Evaluating Future-Aware Autonomous Driving Planners / Yikai Wu
日本語で読む → - 論文VLAロボティクス
ShieldVLA: 視覚言語行動モデルのための実行可能性を考慮した安全アライメント
視覚言語行動モデルに対し、ハミルトン・ヤコビ到達可能性に基づく安全クリティックを学習させ、安全領域内での報酬最大化と危険時の回復を分離するファインチューニング手法を提案。安全性コストを平均57%削減し、タスク成功率も向上させた。
原題: ShieldVLA: Feasibility-Aware Safety Alignment for Vision-Language-Action Models / Manan Tayal, Akshay Nambi
日本語で読む → - 論文LLMエージェントAI
SkillGLoW: 手続き的ファミリーのスキル統合による長期的タスクストリーム上の自己改善エージェント
LLMエージェントが長期的なタスク群で自己改善する際、タスク間で共有される解決手順を「手続き的ファミリー」として集約・圧縮し、タスク固有の詳細は再生成するスキル管理手法SkillGLoWを提案した。
原題: SkillGLoW: Procedural-Family Skill Consolidation for Self-Improving Agents on Long-Horizon Task Streams / Ao Yan, Xin Zhang, Jiawei Du 他
日本語で読む → - 論文マニピュレーションロボティクス
結果ボトルネックによる操作十分表現の学習
行動条件付き結果ボトルネックを用いて、操作に十分な確率的表現を学習し、把持選択や適応に応用した研究。
原題: Learning Manipulation-Sufficient Representations via Outcome Bottlenecks / Md Selim Sarowar, Sungho Kim
日本語で読む → - 論文マニピュレーションロボティクス
リアルタイム動力学に基づくトルクサンプリングMPPIによるコンプライアントで力認識のマニピュレーション
MPPIベースのタスク空間制御フレームワークを提案し、剛体動力学をリアルタイムMPCで解き、安全制約を課すことで、非構造環境での正確な運動・力制御とコンプライアントな物理的相互作用を実現した。GPU並列化を活用したトルクサンプリング方式により、166Hz以上の更新レートを達成し、7自由度マニピュレータで実証した。
原題: Real-Time Dynamics-Based Torque-Sampling MPPI for Compliant and Force Aware Manipulation / Euncheol Im, Taehyun Kim, Yonghwan Oh 他
日本語で読む → - 論文VLA/転移学習ロボティクス
ZETA: テーブルトップ操作におけるゼロショット・クロスエンボディメントVLA転移の統制研究
異なるロボット形態へのゼロショット転移を体系的に評価するため、厳密な定義と統制ベンチマークを導入し、状態表現・事前学習の多様性・補助学習・対象形態の露出の影響を分析した。
原題: ZETA: A Controlled Study of Zero-Shot Cross-Embodiment VLA Transfer for Tabletop Manipulation / Mi Yan, Wenhao Zhang, Zhiqi Zhang 他
日本語で読む → - 論文機構学math.AG
線形並進ばねネットワークの平衡点
非線形代数の手法を用いて、2次元・3次元における最大5ノードの剛体線形並進ばねネットワークの平衡点をすべて解き、解の総数に関する次数の上限を与えた。
原題: Equilibria for Networks of Linear Translational Springs / Luke Oeding, Ethan Clayton, Jackson Elsea 他
日本語で読む → - 論文VLAロボティクス
静かなる妨害:LLM搭載ロボットシステムに対する内部状態トリガーバックドア攻撃
LLMで制御されるロボットに、外部刺激ではなくロボット自身の過去の行動履歴をトリガーとする隠れたバックドアを埋め込めることを示し、通常時は性能を保ちつつ特定条件下で停止や衝突を引き起こせることを実験で明らかにした。
原題: Silent Sabotage: Internal State Triggered Backdoor Attacks on LLM-Powered Robotic Systems / Doniyorkhon Obidov, Shivayogi Akki, Tan Chen 他
日本語で読む → - 論文画像フォレンジック画像認識
テキスト中心画像フォレンジックのための証拠誘導型検出・位置特定・説明システム
テキスト改ざん画像の真偽判定、改ざん領域の特定、証拠に基づく説明を統合したシステムを提案し、ACM Multimedia 2026のチャレンジで2位を獲得した。
原題: Evidence-Guided Detection, Localization and Explanation for Text-Centric Image Forensics / Peifeng Liu, Bin Li, Qingsong Zhang 他
日本語で読む → - 論文セグメンテーション画像認識
エンコーダは実際に何を決めているのか?樹木のジョイントセグメンテーションとステレオ深度における視覚バックボーンの制御比較
同一条件で視覚バックボーンを比較し、樹木のセグメンテーションと深度推定において畳み込み・ハイブリッドがTransformerより優れ、パラメータ数が品質を予測しないことを示した。
原題: What Does the Encoder Actually Decide? A Controlled Comparison of Vision Backbones on Joint Tree Segmentation and Stereo Depth / Yida Lin, Bing Xue, Mengjie Zhang 他
日本語で読む → - 論文水中ロボティクスロボティクス
水中ロボティクスの民主化を進めるMini-Girona I-AUV:RAMI 2025での成果
約5万ドルで製作可能な低コスト水中介入AUV「Mini-Girona」を開発し、学生競技会RAMI 2025で2位を獲得した設計と性能を報告する論文。
原題: Advancing Accessible Underwater Robotics: The Mini-Girona I-AUV at RAMI 2025 / Taqi Hamoda, Bilal Ahmed, Deborah Ele-Ojo 他
日本語で読む → - 論文マニピュレーションロボティクス
MS-MEM: 不確実性・外乱を考慮した行動選択によるマルチスキル操作強化マッピング
棚などの閉鎖的で散らかった環境でのシーン理解を高めるため、能動視点選択・物体押し・把持を統合し、不確実性を考慮したマッピングと外乱制約付き行動選択を提案した。
原題: MS-MEM: Multi-Skill Manipulation-Enhanced Mapping via Uncertainty- and Disturbance-Aware Action Selection / Yitian Shi, Jesper Mücke, Nils Dengler 他
日本語で読む → - 論文マニピュレーションロボティクス
HINT: 長期的ロボット操作のための人間意図の注入
本論文は、長期的なロボット操作タスクにおいて、人間の意図を視覚的・注意機構を通じて行動ポリシーに伝達するフレームワークHINTを提案し、意図理解とタスク成功率を向上させる。
原題: HINT: Human-Intent Inception for Long-Horizon Robot Manipulation / Mingyu Mei, Haojie Xu, Shihao Jin 他
日本語で読む → - 論文VLA画像認識
LookStep: 言語的先見とイベント駆動メモリによる効率的な視覚言語ナビゲーション
視覚言語ナビゲーションのための、言語ラベルによる将来状態予測とイベント駆動型メモリを組み合わせた効率的なエンドツーエンドフレームワークを提案。
原題: LookStep: Efficient Vision-Language Navigation with Linguistic Foresight and Event Driven Memory / Kun-Yang Yu, Yingzhe Li, Hongyu Xu 他
日本語で読む → - 論文VLA/アクションチャンキングロボティクス
停止タイミングの学習:VLAにおける内部クロスアテンション動態を用いた適応的アクションチャンキング
固定長のアクションチャンキングの限界を克服するため、アクションエキスパート内のクロスアテンションのエントロピー上昇を検出し、実行中に動的にチャンク長を調整するトレーニング不要の手法を提案した。
原題: Knowing When to Stop: Adaptive Action Chunking via Internal Cross-Attention Dynamics in VLAs / Runze Xu, Xiaolong Shan, Shuang Dai 他
日本語で読む → - 論文制御ロボティクス
ロボットマニピュレータの古典PIDによる大域的整定可能性について
不確かなMIMO非線形システムに対し、チャネルごとの相対次数に応じた拡張PID制御器を設計し、適切なパラメータ選択で半大域的安定性と目標値への整定を保証する手法を提案した。
原題: On Global Regulatability of Robot Manipulators by Classical PID / Cheng Zhao, Jingru Zhu, Lei Guo
日本語で読む → - 論文脳波デコード機械学習
EEG-VID: タスク誘導型潜在予測事前学習による脳波デコードと支援的ターゲット選択
脳波デコードのためのタスク誘導型潜在予測事前学習フレームワークを提案し、セッションや被験者の変化に対する頑健性を向上させた。
原題: EEG-VID: Task-Guided Latent Predictive Pretraining for EEG Decoding and Assistive Target Selection / Guanzhong Sun, Junyi Ma, Yuxuan Wu 他
日本語で読む → - 論文生物移動physics.bio-ph
マッドスキッパーは尾の突き上げを利用して様々な湿り気の泥上での移動を助ける
マッドスキッパーが様々な湿り気の泥上で移動する際、通常の松葉杖歩行に加えて尾の突き上げを用いて推進力と揚力を得ることを観察した。
原題: Mudskippers use tail thrusting to help crutching to move on mud of various wetness / Divya Ramesh, Gargi Sadalgekar, Jiangqi Tan 他
日本語で読む → - 論文画像再照明画像認識
HELIOS: 真夜中から正午まで、屋外都市シーンの連続的な再照明
ペア画像を使わずに、実世界の未ラベルデータから昼夜間の照明を連続的に変換する再照明手法HELIOSを提案した。
原題: HELIOS: From midnight to noon, continuous outdoor urban scene relighting / Hala Djeghim, Nathan Piasco, Luis Roldão 他
日本語で読む → - 論文VLAロボティクス
EmbodiedSkills: VLAエージェントの統合フレームワーク
VLAモデルを長期的タスクに適用するための、実行提案としてのスキル判断を検証する統合フレームワークを提案。
原題: EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents / Wei Wang, Wenqiao Zhang, Yutong Lin 他
日本語で読む → - 論文シーングラフロボティクス
DSG: 変化する屋内環境における身体化エージェントのための動的3Dシーングラフ構築
物体の移動を検出し空間関係を推論することで、動的な屋内環境でも最新の3Dシーングラフを構築するフレームワークを提案した。
原題: DSG: Dynamic 3D Scene Graph Construction for Embodied Agents in Changing Indoor Environments / Ming Liao, Chao Ye, Jianing Fei 他
日本語で読む → - 論文自動運転ロボティクス
学習型軌道スコアリングのための多様なサンプル設計
自動運転の軌道選択スコアラーを訓練する際、安全な軌道ばかりの提案では境界付近の学習が不十分な問題に対し、人間軌道を横方向・縦方向に摂動させた多様なサンプルを生成して学習データを設計し、スコアリング精度を向上させた。
原題: Designing Versatile Samples for Learned Trajectory Scoring / Yaguang Li, Jiaru Zhang, Chuheng Wei 他
日本語で読む → - 論文位置姿勢推定画像認識
重力事前情報に基づく変換分離とポーズ最適化による高効率・高ロバストな絶対位置姿勢推定
重力方向を事前情報として利用し、6自由度の絶対位置姿勢推定を4自由度問題に分解して効率化し、さらにポーズ最適化で精度を高める手法を提案した。
原題: Efficient and Robust Absolute Pose Estimation via Gravity-Prior-Driven Transformation Decoupling and Pose Refinement / Hu Cao, Qianyi Yang, Xinyi Li 他
日本語で読む →