論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文強化学習機械学習
観測に基づく自己予測強化学習による視覚連続制御
視覚ベースの連続制御タスクにおいて、潜在空間での自己予測と観測空間での予測を組み合わせた新しい表現学習手法を提案し、サンプル効率を向上させた。
原題: Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control / Xinwei Liu, Junyuan Liang, Jianting Zhang 他
日本語で読む → - 論文ロボット化学/安全性ロボティクス
SAFE-CHEM: 不確実性を考慮したポリシー切り替えによる堅牢なロボット化学
化学実験ロボットの安全性向上のため、学習ポリシーの不確実性をオンラインで推定し、閾値を超えた場合にルールベースのバックアップ制御へ自動切り替えするハイブリッド制御フレームワークを提案した。
原題: SAFE-CHEM: Uncertainty-Aware Policy Switching for Robust Robotic Chemistry / Laura Jones, Shazil Shahzad, Ayesha Sana 他
日本語で読む → - 論文マニピュレーションロボティクス
NestDex: コパイロット支援遠隔操作による入れ子型ポリシー学習を用いた器用な操作
器用な操作のデモ収集を容易にするため、学習済みの手先スキルを遠隔操作に組み込んだ入れ子型ポリシー学習フレームワークを提案し、実機実験でその有効性を示した。
原題: NestDex: Nested Policy Learning with Copilot Assisted Teleoperation for Dexterous Manipulation / James Zhao, Jinhe Tang, Mingyuan Ba 他
日本語で読む → - 論文水中ロボット/視覚ナビゲーションロボティクス
リアルタイム自律UUV運用のための視覚ベース制御フレームワーク
水中ロボット(UUV)向けに、動的で視覚的に困難な環境下でのリアルタイムな自己位置推定、自律航法、3Dマッピングを統合した視覚ベースのフレームワークを提案し、シミュレーションと実機実験で有効性を検証した。
原題: A Vision-based Control Framework for Real-time Autonomous UUV Operations / Erik Tjærand Frøland, Marco Job, Md Ether Deowan 他
日本語で読む → - 論文群制御ロボティクス
大規模アセンブリのメイクスパン最適化のための協調マルチロボット分解計画
複数ロボットによる分解作業を効率化するため、タスクと動作計画を統合したCoMuDiを提案し、時間制約の伝播とST-RRT*プランナーにより全体の完了時間を最小化する。
原題: Coordinated Multi-Robot Disassembly for Makespan Optimization of Large-Scale Assemblies / Niklas Hargus, Andreas Orthey, Marc Toussaint
日本語で読む → - 論文連続体ロボットロボティクス
支持型連続体ロボットのアクティブ剛性制御
支持型連続体ロボットの負荷応答を調整するため、閉ループ構造の制約を考慮したタスク空間剛性制御フレームワークを提案し、シミュレーションと実験で有効性を検証した。
原題: Active Stiffness Control of a Supportive Continuum Robot / Rana Danesh, Farrokh Janabi-Sharifi, Farhad Aghili
日本語で読む → - 論文空中ロボット/エンドエフェクタロボティクス
空中レイアウト:天井への精密な飛行中マーキングのためのコンプライアントでアクチュエータ付きエンドエフェクタの設計と制御
天井にミリメートル精度で線を描くため、Gough-Stewart機構を備えた新しいスマートエンドエフェクタを搭載した空中ロボットシステムを提案し、設計と実験でその有効性を実証した。
原題: Aerial Layouting: Design and Control of a Compliant and Actuated End-Effector for Precise In-flight Marking on Ceilings / Christian Lanegger, Marco Ruggia, Marco Tognon 他
日本語で読む → - 論文動作計画ロボティクス
モデル予測制御によるドア通過のための移動マニピュレータの動作計画
移動マニピュレータがドアを開けて通過するための、動的に実現可能で衝突のない軌道を生成するフレームワークを提案。ロボットとドアを結合した動的システムとしてモデル予測制御で最適化する。
原題: Motion Planning for Mobile Manipulators Navigating Doorways via Model Predictive Control / Kasra Sinaei, Kasun Weerakoon, Christopher Bradley 他
日本語で読む → - 論文操作/触覚ロボティクス
視覚-触覚フォアサイトの解きほぐし:ワールドアクションモデルのためのオラクル誘導インターフェース発見
接触を伴う操作タスクにおいて、将来の視覚・触覚情報を予測するワールドアクションモデルのインターフェース設計を、成功軌道から得た理想的な未来情報を用いて切り分けて評価し、非対称な位相整合メモリが有効であることを示した。
原題: Disentangling Visuo-Tactile Foresight: Oracle-Guided Interface Discovery for World Action Models / Zihang Yao, Chaoyue Ding, Yingying Yu
日本語で読む → - 論文タスク計画AI
GraphThink: グラフ強化LLM思考による長期的身体性タスク計画
LLMベースの身体性エージェントの計画における幻覚や長期タスクへの汎化不足を解決するため、タスクグラフとシーングラフを統合したフレームワークを提案。ALFREDベンチマークで最先端性能を達成した。
原題: GraphThink: Graph-Enhanced LLM Thinking for Long-Horizon Embodied Task Planning / Chen Li, Sijie Cheng, Yuelin Zhang 他
日本語で読む → - 論文VLA/失敗検出ロボティクス
GUARD: 拡散型VLAのための不確実性とアブレーションに基づくリスク検出
拡散型視覚言語行動ポリシーが視覚・言語の証拠に弱く基づく予測を行う際の失敗を、テスト時に検出する手法GUARDを提案。事前学習済みポリシーを変更せず、KVキャッシュのアブレーションとデノイジング応答の比較から診断ストリームを導出し、軽量な時間分類器で失敗を検出する。
原題: GUARD: Grounding Uncertainty and Ablation-Based Risk Detection for Diffusion-Based VLAs / Suhas Hegde, Jitendra Yasaswi Bharadwaj Katta
日本語で読む → - 論文モーションリターゲティングロボティクス
接触を狙う: 動的モーションリターゲティングのための接触暗黙的多重シューティング
動的に実現可能な全身軌道を生成するため、微分可能なシミュレータを非線形計画法に組み込んだ接触暗黙的直接シミュレーションベース多重シューティング(DSMS)を提案し、RL訓練の加速と実機へのゼロショット転送を実証した。
原題: Shooting for Contact: Contact-Implicit Multiple Shooting for Dynamic Motion Retargeting / Sergio A. Esteban, Jason H. K. Siu, Derrick Mach 他
日本語で読む → - 論文医療ロボティクスロボティクス
EndoWAM: 汎用内視鏡ナビゲーションのための接地された世界行動モデル
内視鏡ナビゲーションのための世界行動モデルを初めて提案し、将来の目標領域予測と行動生成を統合することで、変形や視点変化に対するロバスト性を向上させた。
原題: EndoWAM: A Grounded World-Action Model for Generalizable Endoscopic Navigation / Jinsong Lin, Zikang Pan, Wanhao Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
TWINS: 体表面接触を伴う操作学習のための触覚ウェアラブル同型アームネットワークシステム
本論文は、操作者の腕と胸部に触覚センサを備えたウェアラブルデバイスと、同じ関節構成・寸法を持つロボットを用いて、体表面接触を伴う操作のデモ収集・模倣学習・実行を可能にするシステムTWINSを提案する。
原題: TWINS: A Tactile Wearable Isomorphic Arm Networked System for Contact-Rich Manipulation Learning / Takahide Kitamura, Masaki Murooka, Natsuki Yamanobe 他
日本語で読む → - 論文データセット画像認識
鉄道車両の運行環境監視のためのマルチセンサーデータセット
鉄道運行環境のAI認識システム開発用に、700万件以上の高品質アノテーションを含むマルチセンサーデータセットを構築し公開した。
原題: A Multi-Sensor Dataset for Monitoring the Operational Environment of Rail Vehicles / Claudio Diotallevi, Rodrigo Gudiño, Zaharia Pachalieva 他
日本語で読む → - 論文VLAロボティクス
Track4Action: 世界中心の3Dトラッカーを視覚言語行動ポリシーに蒸留する
行動ラベルにはロボットの動作指示しか含まれないが、デモ動画のフレーム遷移には3D世界の変化が含まれる。この遷移を凍結した3Dトラッカーから蒸留し、推論時にトラッカー不要のVLAポリシーを学習するフレームワークを提案。シミュレーションと実機で精度が向上した。
原題: Track4Action: Distilling World-Centric 3D Tracker into Vision-Language-Action Policies / Chenyi Wang, Xinkai Wang, Bokai Lin 他
日本語で読む → - 論文医療ロボティクスロボティクス
RoSE:内視鏡ステント試験用のロボット軟性食道
生体模倣型のロボット軟性食道(RoSE)を開発し、悪性食道狭窄による嚥下障害治療用ステントの留置試験を行い、ステントの径方向力と移動への影響を評価した。
原題: RoSE: A Robotic Soft Esophagus for Endoprosthetic Stent Testing / Dipankar Bhattacharya, Sherine Jesna V. A., Leo K. Cheng 他
日本語で読む → - 論文VLAロボティクス
LiLa-WAM: ロボット操作のための軽量潜在推論ワールドアクションモデル
将来の状態をコンパクトな潜在空間で推論する軽量なワールドアクションモデルを提案し、単一GPUで学習可能にした。視覚遷移トークンという言語不要のタスク表現も導入し、シミュレーションと実機で高い成功率を達成した。
原題: LiLa-WAM: Lightweight Latent Reasoning World-Action Model for Robotic Manipulation / Fan Yang, Yuting Su, Xiaobo Wang 他
日本語で読む → - 論文VLA/敵対的攻撃AI
見えざる脅威:拡散モデルによる視覚言語行動モデルへの無制限ロボット攻撃
拡散モデルを用いて視覚的に自然な敵対的パッチを生成し、VLAモデルのロボット制御を攻撃する手法を提案。ホワイトボックスとブラックボックスの両設定で有効で、シミュレーションと実世界で既存手法を上回る性能を示した。
原題: Hidden in Plain Sight: Diffusion-Based Unrestricted Robotic Attacks on Vision-Language-Action Models / Jiahui Han, Yuhui Yao, Xin Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
PathCover: 点群に対するランダム反復空間分割による経路に沿った高速凸分解
点群データから直接、障害物のない凸ポリトープ列を高速に生成する新しいフレームワークを提案し、実時間での移動ロボットの軌道計画を可能にした。
原題: PathCover: A Fast Convex Decomposition along a Path via Randomized Iterative Space Partitioning (RISP) on Point Clouds / Kunal S. Narkhede, Abhijeet M. Kulkarni, Guoquan Huang 他
日本語で読む → - 論文VLAロボティクス
長期的計画のための明示的言語メモリを備えた視覚言語行動モデル
長期的なタスクにおけるVLAモデルの課題を解決するため、高レベルVLMと低レベルVLAを分離し、明示的な言語メモリモジュールを導入して時間的一貫性とエラー修正を実現する階層的アーキテクチャを提案した。
原題: Explicit Language Memory for Long-Horizon Planning in Vision-Language-Action Models / Houze Xu, Jizhong Li, Ziyi Ye
日本語で読む → - 論文触覚HCI
肩と肘へのMcKibben型表面触覚を用いた直感的な手の位置誘導
McKibben型アクチュエータによる表面触覚を肩と肘に提示し、6種類の動作を直感的に誘導する手の位置誘導システムを提案・検証した。
原題: Intuitive Hand Positional Guidance Using McKibben-Based Surface Tactile Sensations to Shoulder and Elbow / Kenta Yokoe, Yuki Funabora, Tadayoshi Aoyama
日本語で読む → - 論文触覚機械学習
Tactus: 低コスト圧力アレイからのオープンボキャブラリ物体認識
低コストの抵抗式圧力センサのみを用いて、テキストクエリに基づく物体認識を実現するモデルTactusを提案。少量データとマスク付きオートエンコーダ事前学習で、教師ありCNNと同等以上の精度を達成した。
原題: Tactus: Open-Vocabulary Object Recognition from Low-Cost Pressure Arrays / Abdul Basit Tonmoy
日本語で読む → - 論文自動運転ロボティクス
ニューロシンボリック安全ガードによるエンドツーエンド自動運転の群れ制御
学習済みのエンドツーエンド運転エージェントに、明示的な安全ルールでコマンドを検証・修正する軽量モジュールを追加し、安全違反を減らす手法を提案した。
原題: Herding End-to-End Autonomous Driving via Neuro-Symbolic Safety Guards / Simón Patiño Idarraga, Erick Silva, Rehana Yasmin 他
日本語で読む → - 論文検証・テストcs.SE
JTA: 安全重要ソフトウェアのシナリオベース検証のための共同テスタビリティアーキテクチャ
本論文は、安全重要ソフトウェアの検証能力を、シナリオ・テストシステム・被試験システムの3要素を統合的に分析・設計するためのアーキテクチャ「JTA」を提案し、ArduPilotのフェイルセーフ検証への適用例を示している。
原題: JTA: Joint Testability Architecture for Scenario-Based Validation of Safety-Critical Software / Wenyao Xue, Jiandi Wang, Yichen Wang
日本語で読む → - 論文エルゴード制御ロボティクス
ErgoSurf:未知表面のカバレッジのためのエルゴード制御
触覚センシングのみを用いて未知の表面形状をリアルタイムに再構築しながら、エルゴード制御により系統的な表面カバレッジを実現する新しいオンラインフレームワークを提案した。
原題: ErgoSurf: Ergodic Control for the Coverage of Unknown Surfaces / Stefan Schneyer, Timo Bachmann, Maged Iskandar 他
日本語で読む → - 論文最適化/制御ロボティクス
Hölder符号付き距離:ロボティクスのための微分可能・符号付き・並列化可能な距離指標
凸多面体間の距離を計算する新しい微分可能な符号付き距離関数を提案し、閉形式で計算できるため収束問題がなくGPU並列化に適していることを示した。
原題: H\"older Signed Distance: A Differentiable, Signed, Parallelizable Metric for Robotics / Felipe Bartelt, Ali Umut Kaypak, Anthony Tzes 他
日本語で読む → - 論文自己教師あり学習画像認識
Vernata: LiDAR点群表現の自己教師あり学習
屋外LiDAR点群のための自己教師あり学習フレームワークVernataを提案。マルチモーダル・マルチティーチャー蒸留により、ラベルなしデータから汎用特徴を学習し、セグメンテーション性能を大幅に向上させた。
原題: Vernata: Self-Supervised Learning of LiDAR Point Representations / Oliver Lemke, Alexander Liniger, Abel Gawel 他
日本語で読む → - 論文システムズエンジニアリングロボティクス
SysML駆動の自律UAV設計のためのモデルベースシステムズエンジニアリングフレームワーク
自律UAVの開発をSysMLで構造化し、要件から論理アーキテクチャ、ROS 2ソフトウェア実装までを体系的にマッピングするMBSEフレームワークを提案した論文。
原題: Model-Based Systems Engineering Framework for SysML-Driven Design of Autonomous UAVs / Deekshitha Angadi, Naveena Budda, Vikas Agarwal 他
日本語で読む → - 論文マルチエージェント協調ロボティクス
SyncPlan: 明示的同期と適応的修正による長期的LLM協調
LLMベースのマルチエージェント協調において、効率と適応性のトレードオフを解決するため、明示的な同期プリミティブとプラン陳腐化検出器を備えた計画・実行・修正フレームワークを提案した。
原題: SyncPlan: Long-Horizon LLM Coordination with Explicit Synchronization and Adaptive Correction / Shen You, Xiaoming Zhu, Weining Weng 他
日本語で読む →