論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文sim2realロボティクス
物理整合的な物体間推論による高密度クラッタ環境のReal-to-Sim
単視点RGB-D画像から、接触グラフと微分可能剛体シミュレーションを用いて物理的に整合した3Dシーンを再構成し、接触の多いマニピュレーションを可能にする手法を提案。
原題: Real-to-Sim for Highly Cluttered Environments via Physics-Consistent Inter-Object Reasoning / Tianyi Xiang, Jiahang Cao, Sikai Guo 他
日本語で読む → - 論文VLAロボティクス
階層的マニピュレーション政策のための世界モデルのスケーリング
大規模事前学習済み世界モデルを高レベルプランナーとして用い、VLAを低レベル実行者とする階層的フレームワークを提案。未知物体や新規状況での汎化性能を大幅に向上させた。
原題: Scaling World Model for Hierarchical Manipulation Policies / Qian Long, Yueze Wang, Jiaxi Song 他
日本語で読む → - 論文ナビゲーションロボティクス
CoReLIN: 制約ベース推論によるゼロショット生涯対話型ナビゲーション
LLMとシーングラフを用いて、移動ロボットが障害物を移動させ経路を切り開きながら連続的な物体配置タスクをこなす生涯対話型ナビゲーション手法を提案。
原題: CoReLIN: Constraint-based Reasoning for Zero-shot Lifelong Interactive Navigation / Apoorva Vashisth, Manav Kulshrestha, Pranav Bakshi 他
日本語で読む → - 論文自動運転テストロボティクス
衝突への道:自動運転システムのための二段階衝突シナリオテスト手法
自動運転システムの安全性評価に向け、まず「コンフリクト」と呼ばれる衝突に至る前段階の危険状況を探索し、その後それらを変異させて実際の衝突を誘発する二段階のシナリオテスト手法を提案した。
原題: From Conflicts to Collisions: A Two-Stage Collision Scenario-Testing Approach for Autonomous Driving Systems / Siyuan Chen, Fuyuan Zhang, Hua Qi 他
日本語で読む → - 論文ナビゲーションロボティクス
ReasonNavi: 人間に着想を得たゼロショット身体性ナビゲーションのためのグローバル地図推論
トップダウン地図を部屋分割と候補ノードに離散化し、MLLMに多段階で推論させて指示に合う目標を選び、決定論的プランナで経路生成するゼロショットナビゲーション手法を提案。
原題: ReasonNavi: Human-Inspired Global Map Reasoning for Zero-Shot Embodied Navigation / Yuzhuo Ao, Anbang Wang, Yu-Wing Tai 他
日本語で読む → - 論文HRI/健康増進HCI
関係性家電:家庭での健康増進のための冷蔵庫内ロボット
冷蔵庫内に人型ロボット頭部を設置し、おやつ選択時に健康推奨を行う対話型ロボットのパイロット研究。参加者はロボットを説得力があり社会的に魅力的と感じ、おやつ選択への意識が高まった。
原題: Relational Appliances: A Robot in the Refrigerator for Home-Based Health Promotion / Timothy Bickmore, Mehdi Arjmand, Yunus Terzioglu
日本語で読む → - 論文VLAロボティクス
VLAモデルのための汎用的な自己修正・終了フレームワーク
VLAモデルの把持時の空間的ずれと終了判定の欠如を解決するため、学習不要の軽量な自己修正制御ループVLA-SCTを提案し、LIBEROベンチマークで成功率を向上させた。
原題: From Knowing to Doing Precisely: A General Self-Correction and Termination Framework for VLA models / Wentao Zhang, Aolan Sun, Wentao Mo 他
日本語で読む → - 論文マルチエージェント強化学習/自動運転ロボティクス
TSC: 相互作用運転のためのトポロジー条件付きシュタッケルベルク型マルチエージェント強化学習
軌跡の編み込み関係から動的な優先度グラフを抽出し、局所的なリーダー・フォロワー関係に基づくシュタッケルベルク型協調方策をCTDEで学習する、通信不要の分散型自動運転フレームワークを提案。
原題: TSC: Topology-Conditioned Stackelberg Coordination for Multi-Agent Reinforcement Learning in Interactive Driving / Xiaotong Zhang, Gang Xiong, Yuanjing Wang 他
日本語で読む → - 論文群制御cs.MA
生涯マルチエージェント経路探索における混合ガイダンスグラフの辺方向と重みの最適化
生涯マルチエージェント経路探索において、辺の重みだけでなく方向も最適化する混合ガイダンスグラフ最適化手法を提案し、エージェントの移動をより厳密に誘導する。
原題: Optimization of Edge Directions and Weights for Mixed Guidance Graphs in Lifelong Multi-Agent Path Finding / Yulun Zhang, Varun Bhatt, Matthew C. Fontaine 他
日本語で読む → - 論文VLAロボティクス
グローバル事前分布と局所一貫性を活用したデュアルメモリ拡張VLAモデルによる効率的なロボットマニピュレーション
タスクレベルの事前分布メモリと実行履歴の一貫性メモリを組み合わせ、拡散ベースのVLAモデルの推論効率と時間的一貫性を改善した手法OptimusVLAを提案。複数のシミュレーションベンチマークで成功率を大幅に向上させた。
原題: Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation / Zaijing Li, Bing Hu, Rui Shao 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
FR-GESTURE: ファーストレスポンダー操作のためのジェスチャー型ヒューマンロボットインタラクション向けRGBDデータセット
災害現場で活動するファーストレスポンダーがUGVをジェスチャーで操作するための12種類のコマンドを定義し、2視点・7距離から撮影した3312組のRGBDデータセットを構築してベースライン評価を行った論文。
原題: FR-GESTURE: An RGBD Dataset For Gesture-based Human-Robot Interaction In First Responder Operations / Konstantinos Foteinos, Georgios Angelidis, Aggelos Psiris 他
日本語で読む → - 論文ナビゲーションロボティクス
RA-Nav: 予測不能な環境における空中ロボットのためのセマンティックセグメンテーションに基づくリスク認識ナビゲーションシステム
セマンティックセグメンテーションで障害物を分類し、突然動き出す障害物のリスクを推定して安全な経路を計画する空中ロボット向けナビゲーション手法を提案。
原題: RA-Nav: A Risk-Aware Navigation System Based on Semantic Segmentation for Aerial Robots in Unpredictable Environments / Ziyi Zong, Xin Dong, Jinwu Xiang 他
日本語で読む → - 論文触覚ロボティクス
TaCo: 異種触覚データの可逆・非可逆コーデックのベンチマーク
触覚データの圧縮手法30種を5データセットで評価する初のベンチマークTaCoを提案し、触覚データで学習した可逆・非可逆コーデックも開発した。
原題: TaCo: A Benchmark for Lossless and Lossy Codecs of Heterogeneous Tactile Data / Zhengxue Cheng, Yan Zhao, Keyu Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
外科手術ロボット把持におけるセンサレス高精度力制御のためのハイブリッドオフライン・オンライン強化学習
腱駆動手術器具の把持力を、遠位センサなしで高精度に制御するため、物理モデルとオフライン・オンライン強化学習を組み合わせたフレームワークを提案し、シミュレーションと実機で有効性を示した。
原題: Hybrid Offline-Online Reinforcement Learning for Sensorless, High-Precision Force Regulation in Surgical Robotic Grasping / Edoardo Fazzari, Omar Mohamed, Khalfan Hableel 他
日本語で読む → - 論文超冗長ロボット肢ロボティクス
汎用超冗長ロボット肢による人間のバランス補助
汎用超冗長ロボット肢を用いて人間のバランスを保つ階層型フレームワークを提案し、10名の被験者実験で姿勢の不安定性が低減することを示した。
原題: Augmenting Human Balance with Generic Supernumerary Robotic Limbs / Xuanyun Qiu, Dorian Verdel, Hector Cervantes-Culebro 他
日本語で読む → - 論文VLAロボティクス
DM0: フィジカルAIに向けた身体性ネイティブな視覚-言語-行動モデル
身体性を後付けでなく最初から統合し、大規模事前学習からフローマッチング行動専門家と空間Chain-of-Thoughtで操作とナビゲーションを統一的に学習するVLAフレームワークDM0を提案。
原題: DM0: An Embodied-Native Vision-Language-Action Model towards Physical AI / En Yu, Haoran Lv, Jianjian Sun 他
日本語で読む → - 論文照明制御/視覚SLAMロボティクス
ロボット知覚のための適応照明制御
照明の影響を分解する再照明モデルとオフライン最適化・模倣学習を組み合わせ、視覚SLAMのための閉ループ照明制御フレームワークを提案した。
原題: Adaptive Illumination Control for Robot Perception / Yash Turkar, Shekoufeh Sadeghi, Karthik Dantu
日本語で読む → - 論文ソーシャルロボットロボティクス
ソーシャルロボットのためのニューラルネットワークによる視線制御システムの開発
人間の社会的状況における視線行動データをLSTMとTransformerで学習し、ソーシャルロボットNaoの視線制御に応用して評価した研究。
原題: Developing Neural Network-Based Gaze Control Systems for Social Robots / Ramtin Tabatabaei, Alireza Taheri
日本語で読む → - 論文マニピュレーションロボティクス
その価格は正しくない:ニューロシンボリック手法が構造化長期的操作タスクでVLAを上回り、エネルギー消費も大幅に低い
構造化された長期的操作タスクにおいて、PDDLベースのニューロシンボリック手法がファインチューニングされたVLAモデルより高い成功率と汎化性能を示し、訓練エネルギーも約2桁少ないことを実験的に示した。
原題: The Price Is Not Right: Neuro-Symbolic Methods Outperform VLAs on Structured Long-Horizon Manipulation Tasks with Significantly Lower Energy Consumption / Timothy Duggan, Pierrick Lorang, Hong Lu 他
日本語で読む → - 論文関節物体生成画像認識
PAct: 部分分解による単視点関節物体生成
単一画像から関節物体を部分ごとに分解し、形状・構成・関節運動を生成するフィードフォワード手法を提案。
原題: PAct: Part-Decomposed Single-View Articulated Object Generation / Qingming Liu, Xinyue Yao, Shuyuan Zhang 他
日本語で読む → - 論文自動運転ロボティクス
PlanTRansformer:目標条件付きTransformerによる予測と計画の統合
自動運転における軌道予測と計画を統合するため、目標条件付き予測と動的実現可能性を組み込んだガウス混合Transformerフレームワークを提案し、教師-生徒学習で意図のマスキングに対応した。
原題: PlanTRansformer: Unified Prediction and Planning with Goal-conditioned Transformer / Constantin Selzer, Fabina B. Flohr
日本語で読む → - 論文VLAロボティクス
ALOE: 視覚言語行動モデルの事後学習のための行動レベルオフポリシー評価
実世界の人間参加型強化学習でVLAモデルを改善するため、現在のポリシーを直接評価するオフポリシー評価フレームワークALOEを提案し、4つの実世界マニピュレーションタスクで検証した。
原題: ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training / Rushuai Yang, Hecheng Wang, Zhichao Wu 他
日本語で読む → - 論文模倣学習ロボティクス
生成的基盤モデルによる単一の人間実演からの模倣学習スケーリング
単一の人間実演からReal2Genで操作方策を学習し、シミュレーションで大量データを生成して流マッチング方策を訓練、実世界にゼロショット展開する。
原題: Scaling Single Human Demonstrations for Imitation Learning using Generative Foundational Models / Nick Heppert, Minh Quang Nguyen, Abhinav Valada
日本語で読む → - 論文状態推定ロボティクス
外部測位なしで高速飛行するUAVのための視覚のみによる状態推定:A2RLドローンレースファイナリストのアプローチ
単眼カメラとIMUのみを用い、VIOのドリフトを新たな数理モデルで補正することで、GNSS拒否環境での高速・動的飛行でも正確なUAV状態推定を実現した。
原題: Vision-only UAV State Estimation for Fast Flights Without External Localization Systems: A2RL Drone Racing Finalist Approach / Filip Novák, Matěj Petrlík, Matej Novosad 他
日本語で読む → - 論文SLAMロボティクス
3D基盤モデルによる分散協調SLAMのループ閉じ込み
3D基盤モデルを活用し、視点差が大きいロボット間でも画像ペアから相対姿勢を推定してループ閉じ込みを行う、分散協調SLAMの手法を提案した。
原題: 3D Foundation Model-Based Loop Closing for Decentralized Collaborative SLAM / Pierre-Yves Lajoie, Benjamin Ramtoula, Daniele De Martini 他
日本語で読む → - 論文群制御ロボティクス
モジュール型飛行システムのためのダウンウォッシュを考慮した構成最適化
多数の同型モジュール型飛行ロボットに対し、モジュール間のダウンウォッシュ干渉を制約として考慮しつつ、タスクに応じた組み立て構成を生成・最適選択するフレームワークを提案した。
原題: Downwash-aware Configuration Optimization for Modular Aerial Systems / Mengguang Li, Heinz Koeppl
日本語で読む → - 論文群制御ロボティクス
内部化された形態形成:局所トークン交換によるモジュール系の成長・複製・再生の自己組織化モデル
隣接モジュール間の局所的な整数トークン交換のみで、成長・自己分裂・切断後の再生といった複雑な形態形成が創発する自己組織化モデルを提案し、六角格子上のシミュレーションで実証した。
原題: Internalized Morphogenesis: A Self-Organizing Model for Growth, Replication, and Regeneration via Local Token Exchange in Modular Systems / Takeshi Ishida
日本語で読む → - 論文遠隔操作ロボティクス
人間中心のAR評価のための高忠実度ロボットマニピュレータ遠隔操作フレームワーク
人間の自然な動きをキャプチャしロボットマニピュレータで正確に再現するリアルタイム遠隔操作プラットフォームARBotを開発し、AR評価用の軌道データセットを公開した。
原題: A High-Fidelity Robotic Manipulator Teleoperation Framework for Human-Centered Augmented Reality Evaluation / Harsh Chhajed, Tian Guo
日本語で読む → - 論文群制御ロボティクス
SkySim: 大規模言語モデルによるドローン群の自然言語制御のためのROS2ベースシミュレーション環境
LLMによる高レベル計画と人工ポテンシャル場による安全フィルタを分離し、自然言語でドローン群を安全に制御できるROS2/Gazeboシミュレータを提案・検証した。
原題: SkySim: A ROS2-based Simulation Environment for Natural Language Control of Drone Swarms using Large Language Models / Aditya Shibu, Marah Saleh, Mohamed Al-Musleh 他
日本語で読む → - 論文マニピュレーションロボティクス
意図と実行のギャップを活用:視覚運動ポリシーにおける暗黙的インピーダンスの学習
遠隔操作のマスタ指令とスレーブ応答のズレをノイズではなく力覚情報として活用し、意図クローニングにより暗黙的なインピーダンス制御を実現する枠組みを提案した。
原題: Mind the Gap: Learning Implicit Impedance in Visuomotor Policies via Intent-Execution Mismatch / Cuijie Xu, Shurui Zheng, Zihao Su 他
日本語で読む →