論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
URF: 接触を考慮した安定操作のための統合ロボット制御ポリシーフレームワーク
ロボット操作の学習ポリシーが、コンプライアントな動作予測とインピーダンス・アドミッタンス制御を統合するフレームワークを提案し、剛体接触時の不安定さを低減して成功率を向上させた。
原題: URF: A Unified Robot Control-Policy Framework for Stable Contact Aware Manipulation / Jiyou Shin, Youngjin Seo, Jaeseog Won 他
日本語で読む → - 論文協調知覚/V2Xロボティクス
見通し外へ:複雑シナリオにおけるV2X協調知覚のハイブリッド検証
複数エージェントのセンサ情報をベイズ融合して占有グリッドを生成し、自車の視野外まで認識範囲を拡張するV2X協調知覚フレームワークを提案。シミュレーションと実車実験を組み合わせたハイブリッド検証で、ラウンドアバウト環境における視野範囲と占有セル再現率の大幅な向上を実証した。
原題: Beyond Line of Sight: Hybrid Validation of V2X Collective Perception in Complex Scenarios / Markos Antonopoulos, Anastasia Bolovinou, Bill Roungas 他
日本語で読む → - 論文動作計画ロボティクス
連続時間ガウス信念木による動作計画
連続時間の確率システムと不確実性を考慮し、信念伝播と安全検証を統合したサンプリングベースの動作計画手法を提案。
原題: Continuous-Time Gaussian Belief Trees for Motion Planning / Rayan Mazouz, Qi Heng Ho, Zachary N. Sunberg 他
日本語で読む → - 論文3Dセマンティックセグメンテーション画像認識
不確実性誘導のテスト時最適化によるプライバシー保護型の深度のみのオープンボキャブラリ3Dセマンティックセグメンテーション
RGB画像を使わず深度情報のみでオープンボキャブラリの3Dセマンティックセグメンテーションを行う際、不確実性をガイドに用いてテスト時に最適化し、精度を向上させる手法を提案した。
原題: Privacy-Preserving Depth-Only Open-Vocabulary 3D Semantic Segmentation Via Uncertainty-Guided Test-Time Optimization / Xuying Huang, Sicong Pan, Maren Bennewitz
日本語で読む → - 論文マニピュレーションロボティクス
VT-WAM: 接触を伴う操作のための視覚-触覚ワールドアクションモデル
接触を伴う操作タスク向けに、視覚予測・触覚変形予測・行動予測を統合したフレームワークを提案し、実世界6タスクで高い成功率を達成した。
原題: VT-WAM: Visual-Tactile World Action Model for Contact-Rich Manipulation / Shuai Tian, Yupeng Zheng, Yuhang Zheng 他
日本語で読む → - 論文状態推定ロボティクス
SE(3)上の不変確率フィルタリングによるシリアル剛体マニピュレータの慣性-エンコーダ状態推定
シリアル剛体マニピュレータの状態推定のための不変拡張カルマンフィルタ(IEKF)をSE(3)上で開発し、誤差ダイナミクスの群アフィン性を利用して真の誤差共分散を正確に扱う。リンクごとのIEKFをチェーン状に構成し、計算コストをリンク数に線形に抑えつつ、リアプノフ関数による安定性証明も行った。
原題: Invariant Stochastic Filtering on SE(3) for Inertial-Encoder State Estimation of Serial Rigid Manipulators / S. Yaqubi, J. Mattila
日本語で読む → - 論文群制御ロボティクス
最小センシングプラットフォームにおける創発的適応レヴィウォークによる分散型スケーラブル探査
50g未満のナノUAV向けに、疎な局所センシングとレヴィウォークを組み合わせた軽量な探査コントローラを提案し、通信なしで多機体探査をスケーラブルに実現した。
原題: Decentralized Scalable Exploration via Emergent Adaptive L\'evy Walks on Minimal-Sensing Platforms / Wai Lun Leong, Teo Swee Huat Rodney
日本語で読む → - 論文システム/基盤モデル配信ロボティクス
ROSA: ロボット工場向けロボティクス基盤モデル配信システム
ロボット工場向けに、複数ロボットが共有GPUプールで基盤モデルを効率的に利用できる配信システムを提案し、工場生産性を最大12倍向上させた。
原題: ROSA: A Robotics Foundation Model Serving System for Robot Factories / Wenqi Jiang, Jason Clemons, Rowland O'Flaherty 他
日本語で読む → - 論文ナビゲーション/知覚計画ロボティクス
注意のための記憶:視覚・言語・動作マップを用いた言語条件付き再知覚
ロボットが持つ永続的な地図の記憶を活用し、限られた知覚予算で何を再観察すべきかを決定する「再知覚」問題を扱い、記憶に基づくスケジューリングがオラクル並みの性能を達成することを示した論文。
原題: Memory for Attention: Language-Conditioned Re-Perception with a Vision--Language--Motion Map / Dibyendu Ghosh
日本語で読む → - 論文教育ロボットロボティクス
Teachy Mini:高等教育向け知識ベース生成型ソーシャルロボットの開発と予備評価
大規模言語モデルを搭載したソーシャルロボットに知識ベース設計を適用し、高等教育向けチュータリングシステム「Teachy Mini」を開発・評価した。予備実験で、責任あるチュータリング行動の向上が確認された。
原題: Teachy Mini: Development and Preliminary Evaluation of a Knowledge-Based Generative Social Robot for Higher Education / Stephan Vonschallen, Karim Kaufmann, Dominique Oberle 他
日本語で読む → - 論文群制御ロボティクス
視覚言語モデルを活用したUAVトリアージと災害対応のためのシステム工学フレームワーク
災害対応において、視覚言語モデル(VLM)を人間とUAVの協調エージェントとして組み込むアーキテクチャを提案し、モデルベースシステム工学(MBSE)を用いて設計・実装した。
原題: A Systems Engineering Framework for Vision-Language-Enabled UAV Triage and Disaster Response / Swapnil Saha, Bhuvan Rajanasiriyur Jagadeesha, Karishma Patnaik 他
日本語で読む → - 論文水中ロボティクス/位置推定ロボティクス
水中デッドレコニングにおける展開可能な状況トリガー共分散スケジューリング
水中ロボットの位置推定において、状況に応じてフィルタのノイズパラメータを切り替える手法を提案し、実験で精度向上を確認した。
原題: Underwater Dead Reckoning with Deployable Situation-Triggered Covariance Scheduling / Akshay Naik, Ramavarapu S. Sreenivas, Dustin Nottage 他
日本語で読む → - 論文長期計画/ポリシー統合ロボティクス
RoboHarness: メモリ駆動による異種ロボットポリシーの統合オーケストレーションによる長期的計画
複数の異なるロボット制御システム(VLA、RL、TAMPなど)を再利用可能なスキルとして統合し、実行メモリとオンライン証拠を用いて能力境界を推定し、長期的タスクを能力に応じて分解・ルーティングするフレームワークを提案。ポリシー切り替え時の分布ミスマッチをメモリブリッジで緩和し、ゼロショット長期計画とOOD堅牢性を向上させた。
原題: RoboHarness: Memory-Driven Orchestration of Heterogeneous Robot Policies for Long-Horizon Planning / Jinbang Huang, Yuanzhao Hu, Zhiyuan Li 他
日本語で読む → - 論文モデル予測制御制御
残差適応型コンサバティブMPPI制御
モデルと実機のずれ(残差)に応じて安全制約や探索温度をオンライン調整するサンプリングベースMPC手法を提案し、シミュレーションで安全性と成功率を向上させた。
原題: Residual-Conservative Model Predictive Path Integral Control / Hyung-Jin Yoon, Hunmin Kim
日本語で読む → - 論文触覚/ニューロモーフィックロボティクス
GelNeuro: センシングと計算を統合したニューロモーフィック触覚システムによるテクスチャ認識
GelSight Miniベースの光学触覚センサとニューロモーフィックSoCを直接接続し、スパイキングCNNでテクスチャを認識する統合システムを提案。物理チップ上で96.3%の精度を達成し、消費電力は従来比で3桁以上低い。
原題: GelNeuro: A Sensing-Computing Integrated Neuromorphic Tactile System for Texture Recognition / Luoyang Bian, Xinpan Meng, Zhenghua Ma 他
日本語で読む → - 論文自動運転/シナリオ生成AI
Chat2Scenic: 自動運転シナリオ生成のための反復RAGベースフレームワーク
規制文書から自動運転テスト用のシナリオスクリプトを自動生成する、反復型RAGフレームワークを提案。チャットインターフェースで対話的にシナリオを洗練でき、既存手法より高い成功率を達成。
原題: Chat2Scenic: An Iterative RAG-Based Framework for Scenario Generation in Autonomous Driving / Yuan Gao, Wenting Miao, Mattia Piccinini 他
日本語で読む → - 論文ナビゲーションロボティクス
GemNav: マルチモーダル大規模言語モデルを用いた離散トークン視覚ロボットナビゲーション
凍結したマルチモーダル大規模言語モデルをLoRAで適応させ、離散トークンでウェイポイントを生成するデータ効率の良い視覚ナビゲーションポリシーを提案。8.7時間のデータで未見環境へのゼロショット転移を実証した。
原題: GemNav: Discrete-Token Visual Robot Navigation using a Multimodal Large Language Model / Peter Bohm, Saimunur Rahman, Abdelwahed Khamis 他
日本語で読む → - 論文3D生成画像認識
PixGS: 画素空間拡散による直接3Dガウシアンスプラット生成
3Dガウシアンスプラットを直接生成する単一ステージのパイプラインを提案し、損失のある潜在空間圧縮を回避しつつ、2D生成事前知識を活用して高品質な3Dアセットを高速生成する。
原題: PixGS: Pixel-Space Diffusion for Direct 3D Gaussian Splat Generation / Cao Duy, Phong Nguyen-Ha
日本語で読む → - 論文群制御ロボティクス
競合型マルチエージェント強化学習によるネット搭載ドローン群での俊敏な標的の迎撃
ネットを運ぶドローン群が俊敏な標的ドローンを迎撃する問題を競合型MARLとして定式化し、MAPPOと優先度付き自己対戦を用いて協調戦術を学習させる手法を提案した。
原題: Intercepting an Agile Target with Net-Carrying Drones using Competitive Multi-Agent Reinforcement Learning / Timothée Gavin, Murat Bronz
日本語で読む → - 論文HRIロボティクス
ソーシャルロボットの不可避性を主張するのをやめよう
本論文は、将来の人間とロボットの社会が不可避であるという前提で研究を進めることに反対し、実際の社会的ニーズや技術開発を優先すべきだと主張する。
原題: Stop Pretending Social Robots Are Inevitable / Serge Thill
日本語で読む → - 論文自動運転/シミュレーション機械学習
TerraZero: ゼロデモンストレーション自己対戦スケールのための手続き型運転シミュレーション
強化学習スケールで高速かつ現実的な地図構造に基づく多様な運転シナリオを生成する手続き型シミュレータと自己対戦学習スタックを提案し、ゼロデモンストレーションで汎化する運転ポリシーを訓練した。
原題: TerraZero: Procedural Driving Simulation for Zero-Demonstration Self-Play at Scale / Zhouchonghao Wu, Akshay Rangesh, Weixin Li 他
日本語で読む → - 論文弾性物体操作ロボティクス
Sling2Sim2Real: 非破壊スリングショットポリシー学習のためのワンショット弾性システム同定
弾性物体操作のシミュレーション環境を実世界の弾性特性に合わせるため、単一の非破壊的相互作用から弾性パラメータを同定し、シミュレーションでポリシー学習を行うフレームワークを提案した。
原題: Sling2Sim2Real: One-Shot Elastic System Identification for Non-Destructive Slingshot Policy Learning / Wonjae Kang, Geonwoo Kim, Minseok Song 他
日本語で読む → - 論文医療ロボティクスロボティクス
血管内動脈瘤修復のためのモジュール式ロボットカテーテル
腹部大動脈瘤の分岐部へのアクセスを改善するため、4自由度の2セグメント屈曲可能なカテーテルと拡張可能な腱駆動プラットフォームを開発し、シミュレーションと血管ファントム実験で評価した。
原題: Modular Robotic Catheters for Endovascular Aneurysm Repair / Alex Ranne, Jinshi Zhao, Ali Anil Demircali 他
日本語で読む → - 論文データ収集/身体化AIロボティクス
身体化操作のためのデータピラミッド:サーベイ
実ロボットデータからシミュレーションデータまで、身体化エージェントの学習に使われる5つのデータ源をピラミッド構造で整理し、各データの特性と組み合わせ方を分析したサーベイ論文。
原題: Data Pyramid for Embodied Manipulation: A Survey / Yifan Ye, Yankai Fu, Yaoxu Lv 他
日本語で読む → - 論文マニピュレーションロボティクス
LENS: LLMによる環境簡略化ガイドによるクラッタ環境での計画と制御
LLMを用いてシーン内の物体をタスクに応じて統合・削除し、動的な抽象化を自動生成することで、既存の計画・制御手法の性能をクラッタ環境で向上させる手法を提案した。
原題: LENS: LLM-guided Environment Simplification for Planning and Control in Clutter / Aileen Liao, Rachel Holladay, Dinesh Jayaraman 他
日本語で読む → - 論文状態推定ロボティクス
Chalito: 四足ロボットのフィルタリングベース状態推定のための拡張可能なライブラリ
四足ロボットの状態推定アルゴリズムを公平に比較・評価するための、拡張可能なMATLAB/Pythonライブラリ「Chalito」を提案した。URDFからロボットモデルを直接読み込み、複数のフィルタ手法をサポートし、シミュレーションと実データの両方で動作する。
原題: Chalito: An Extensible Library for Filtering-Based State Estimation in Quadruped Robots / Hilton Marques Souza Santana, João Carlos Virgolino Soares, Marco Antonio Meggiolaro 他
日本語で読む → - 論文自動運転/知覚画像認識
FlashBEV: IOを考慮した高速かつメモリ効率の高い正確なBEV変換
カメラベースの3D知覚におけるBEV変換の計算を、中間テンソルの生成を避ける再計算と融合実行により高速化・省メモリ化する手法を提案した。
原題: FlashBEV: Fast and Memory-Efficient Exact BEV Transformation with IO-Awareness / Shunsuke Yokokawa, Hironori Kasahara
日本語で読む → - 論文マニピュレーションロボティクス
SkillPlug: 教師なしスキル抽出によるロボット操作の少数ショット適応
既存の視覚運動模倣ポリシーにスキル条件付けモジュールを追加し、マルチタスクのデモから共有可能なスキルライブラリを自己教師ありで抽出することで、新しいタスクへの少数ショット適応を効率化するフレームワークを提案した。
原題: SkillPlug: Unsupervised Skill Mining for Few-Shot Adaptation in Robotic Manipulation / Zi-han Ding, Ziwei Wang
日本語で読む → - 論文変形物体操作ロボティクス
BoxTwin: ビデオから弾塑性関節物体の動力学を学習する
ビデオから弾塑性関節物体の動力学を学習するデジタルツインフレームワークを提案し、手動折りたたみや双腕操作実験で長期的な塑性変形挙動を正確に再現した。
原題: BoxTwin: Learning Elastoplastic Articulated Object Dynamics from Videos / Heng Zhang, Gehan Zheng, Kaifeng Zhang 他
日本語で読む → - 論文世界モデルロボティクス
想像上のロールアウトは動的ではなく運動学的である:長期的世界モデル失敗の診断
世界モデルの長期的失敗は運動学的誤差によるものであり、動的誤差ではないことを示す診断手法を提案し、DreamerV3で検証した。
原題: Imagined Rollouts are Kinematic, Not Dynamic: A Diagnosis of Long-Horizon World-Model Failure / Finn Rasmus Schäfer, Korbinian Moller, Yuan Gao 他
日本語で読む →