論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文3D物体検出画像認識
PIRATR: 3D点群におけるトランスフォーマを用いたロボティクス向けパラメトリック物体推論
遮蔽のある3D点群から6自由度姿勢とクラス固有のパラメータ(例: グリッパ開口幅)を同時推定するエンドツーエンド検出フレームワークを提案し、フォークリフトでの実LiDARスキャンに合成学習のみで汎化できることを示した。
原題: PIRATR: Parametric Object Inference for Robotic Applications with Transformers in 3D Point Clouds / Michael Schwingshackl, Fabio F. Oberweger, Mario Niedermeyer 他
日本語で読む → - 論文マニピュレーション制御
インフラ運用保守における関節部品のロボットマニピュレーションのためのエネルギー考慮型強化学習
インフラ点検・保守で扉やバルブなどの関節部品を操作する際に、消費エネルギーを制約付きマルコフ決定過程で明示的に扱い、PointNetベースの汎用知覚と制約付きSoft Actor-Criticで省エネかつ高成功率な操作を実現した。
原題: Energy-Aware Reinforcement Learning for Robotic Manipulation of Articulated Components in Infrastructure Operation and Maintenance / Xiaowen Tao, Yinuo Wang, Haitao Ding 他
日本語で読む → - 論文VLA画像認識
ABot-M0: 行動多様体学習によるロボットマニピュレーションのためのVLA基盤モデル
異種ロボットデータを統合した大規模データセットUniACTを構築し、行動が低次元多様体上に存在するという仮説に基づくAction Manifold Learningで効率的なVLA基盤モデルを実現した。
原題: ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning / Yandan Yang, Shuang Zeng, Tong Lin 他
日本語で読む → - 論文VLA画像認識
DriveWorld-VLA: 自動運転のための視覚-言語-行動と潜在空間世界モデルの統合
VLAと世界モデルを潜在空間で統合し、行動条件付きの想像を特徴量レベルで行う自動運転フレームワークを提案。NAVSIMなどで最高性能を達成。
原題: DriveWorld-VLA: Unified Latent-Space World Modeling with Vision-Language-Action for Autonomous Driving / Feiyang jia, Lin Liu, Ziying Song 他
日本語で読む → - 論文安全制御制御
安全クリティカルシステムのためのロバストテイラー・ラグランジュ制御
テイラー展開とラグランジュ剰余を用いて制御入力が現在時刻に現れるようにし、実装時の離散化時間のみをパラメータとして安全性制約の実行可能性を保証するロバスト制御法を提案した。
原題: Robust Taylor-Lagrange Control for Safety-Critical Systems / Wei Xiao, Christos Cassandras, Anni Li
日本語で読む → - 論文ニューラルマッピングロボティクス
TACO: 継続的ニューラルマッピングのための時間的合意最適化
過去のモデルスナップショットを時間的近傍とみなし、リプレイなしで重み付き合意を取ることで、動的環境に適応する継続的ニューラルマッピング手法を提案。
原題: TACO: Temporal Consensus Optimization for Continual Neural Mapping / Xunlan Zhou, Hongrui Zhao, Negar Mehr
日本語で読む → - 論文自動運転/強化学習ロボティクス
ハミルトン・ヤコビ到達可能性と強化学習による自転車との安全なインタラクション
自動運転車が自転車と安全かつ効率的に相互作用するため、ハミルトン・ヤコビ到達可能性解析と深層Q学習を組み合わせ、安全性を考慮した報酬設計と自転車の反応モデルを導入したフレームワークを提案。
原題: Interacting safely with cyclists using Hamilton-Jacobi reachability and reinforcement learning / Aarati Andrea Noronha, Jean Oh
日本語で読む → - 論文水中検査ロボティクス
低コスト水中管内自己位置調整と検査のための最小センシングロボット
IMU・圧力センサ・2つのソナーだけを搭載した自由遊泳型水中ロボットが、既知半径の水没管内で自己中心調整を行い、安定して走破できる手法を提案。
原題: Low-Cost Underwater In-Pipe Centering and Inspection Using a Minimal-Sensing Robot / Kalvik Jakkala, Jason O'Kane
日本語で読む → - 論文マニピュレーションロボティクス
残差フロー誘導による強化学習:器用なマニピュレーションのための適応手法
事前学習済みのフローマッチング方策を、残差行動と潜在ノイズ分布を同時最適化する強化学習で微調整し、器用なマニピュレーションを効率的に適応させる手法を提案。
原題: RFS: Reinforcement Learning with Residual Flow Steering for Dexterous Manipulation / Entong Su, Tyler Westenbroek, Anusha Nagabandi 他
日本語で読む → - 論文実世界オンライン学習/システムロボティクス
USER: 実世界オンライン方策学習のための統合拡張可能システム
実世界のロボット群をGPUと同様に扱うハードウェア抽象化と非同期学習基盤を提供し、オンライン模倣・強化学習やVLAモデルを長期実験で効率的に訓練できるシステムを構築した。
原題: RLinf-USER: A Unified and Extensible System for Real-World Online Policy Learning in Embodied AI / Hongzhi Zang, Shu'ang Yu, Hao Lin 他
日本語で読む → - 論文VLAロボティクス
CLUE: 注意機構を用いた言語視覚理解によるクロスモーダル曖昧性解消
VLMのクロスモーダル注意を空間的に接地した信号に変換し、参照曖昧性を検出して質問すべきタイミングを判断する対話型視覚接地モデルを提案。
原題: CLUE: Crossmodal disambiguation via Language-vision Understanding with attEntion / Mouad Abrini, Mohamed Chetouani
日本語で読む → - 論文物体ナビゲーションロボティクス
ユーザー中心物体ナビゲーション:個人の習慣を統合したパーソナライズド物体探索ベンチマーク
個人の物体配置習慣を組み込んだ物体ナビゲーションの新ベンチマークUcONを提案し、習慣検索モジュールで習慣を活用することで成功率が向上することを示した。
原題: User-Centric Object Navigation: A Benchmark with Integrated User Habits for Personalized Embodied Object Search / Hongcheng Wang, Jinyu Zhu, Hao Dong
日本語で読む → - 論文3次元再構成画像認識
S-MUSt3R: スライディングマルチビュー3次元再構成
大規模なRGB動画から単眼3次元再構成を行うため、基盤モデルMUSt3Rを再学習なしで拡張し、系列分割とループ閉じ込め最適化で長いシーケンスに対応させた手法。
原題: S-MUSt3R: Sliding Multi-view 3D Reconstruction / Leonid Antsfeld, Boris Chidlovskii, Yohann Cabon 他
日本語で読む → - 論文自動運転データセットロボティクス
HetroD: 異種交通環境における自動運転のための高忠実度ドローンデータセットとベンチマーク
歩行者・自転車・二輪車などが混在する異種交通環境を対象に、ドローンで収集した大規模データセットと、予測・計画・シミュレーションの標準ベンチマークを構築した。
原題: HetroD: A High-Fidelity Drone Dataset and Benchmark for Autonomous Driving in Heterogeneous Traffic / Yu-Hsiang Chen, Wei-Jer Chang, Christian Kotulla 他
日本語で読む → - 論文sim2realロボティクス
multipanda_ros2:マルチマニピュレータシステムのためのリアルタイムROS2フレームワークによるSim-to-Realギャップの橋渡し
複数のFrankaロボットを単一プロセスで1kHz制御できるオープンソースROS2アーキテクチャを提案し、MuJoCoシミュレーションと実機の慣性パラメータ同定を組み合わせてsim2realギャップを低減する手法を示した。
原題: Bridging the Sim-to-Real Gap with multipanda ros2: A Real-Time ROS2 Framework for Multimanual Systems / Jon Škerlj, Seongjin Bien, Abdeldjallil Naceri 他
日本語で読む → - 論文医療ロボティクスロボティクス
頸椎手術支援のための協調操作ロボットシステムに関する初期実験フィードバック
頸椎手術のドリル作業を支援する協調操作ロボットシステムについて、8名の外科医が14回のドリルを行い、計画軌道に対する位置・姿勢の誤差を評価した。
原題: Primary Experimental Feedback on a Co-manipulated Robotic System for Assisted Cervical Surgery / Seifeddine Sellemi, Abdelbadia Chaker, Tanguy Vendeuvre 他
日本語で読む → - 論文全身操作ロボティクス
ヒューマノイド操作インターフェース:ロボット不要の実演による全身操作
ポータブルな装着型デバイスで人間の全身動作を計測し、階層的な学習パイプラインを通じてヒューマノイドの多様な全身操作スキルを実環境で獲得するフレームワークを提案。
原題: Humanoid Manipulation Interface: Humanoid Whole-Body Manipulation from Robot-Free Demonstrations / Ruiqian Nai, Boyuan Zheng, Junming Zhao 他
日本語で読む → - 論文継続学習/物体認識/ドローン画像認識
屋内ドローンのためのリプレイベース継続的物体認識
屋内ドローン向けの時系列一貫性を保った14,400フレームのデータセットを構築し、限られたメモリ予算下でリプレイベースのクラス増分学習手法を評価した。
原題: Learning on the Fly: Replay-Based Continual Object Perception for Indoor Drones / Sebastian-Ion Nae, Mihai-Eugen Barbu, Sebastian Mocanu 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
TextOp: テキストでリアルタイムに動くヒューマノイドの動作生成と制御
テキスト指示を逐次受け取りながら、上位の拡散モデルで動作軌道を生成し下位の追従制御で実機ヒューマノイドを動かす、対話的に指示変更できる枠組みを提案した。
原題: TextOp: Real-time Interactive Text-Driven Humanoid Robot Motion Generation and Control / Weiji Xie, Jiakun Zheng, Jinrui Han 他
日本語で読む → - 論文組み込みセキュリティcs.CR
RVDebloater: モードベースのロボティックビークル向け適応型ファームウェアデブロート
ロボティックビークルなどモードごとに動作する組み込み機器を対象に、実行時に不要なファームウェア関数を動的に除去して攻撃面を削減する手法を提案し、実機とシミュレータで評価した。
原題: RVDebloater: Mode-based Adaptive Firmware Debloating for Robotic Vehicles / Mohsen Salehi, Karthik Pattabiraman
日本語で読む → - 論文VLA画像認識
LIBERO-X:視覚言語行動モデルの堅牢性を測るリトマス試験
VLAモデルの汎化・堅牢性を細かく評価するため、難易度を段階付けた評価プロトコルと多様な人間操作データを備えた新ベンチマークLIBERO-Xを提案した。
原題: LIBERO-X: Robustness Litmus for Vision-Language-Action Models / Guodong Wang, Chenkai Zhang, Qingjie Liu 他
日本語で読む → - 論文ナビゲーション画像認識
屋内・屋外のギャップを埋める:最後の数メートルに向けた視覚中心の指示誘導型身体性ナビゲーション
正確な座標に頼らず、一人称視覚と指示のみで屋外から屋内へシームレスに移動する新しいナビゲーションタスクを提案し、画像ベースのプロンプトで意思決定する視覚中心フレームワークと初のオープンソースデータセットを構築した。
原題: Bridging the Indoor-Outdoor Gap: Vision-Centric Instruction-Guided Embodied Navigation for the Last Meters / Yuxiang Zhao, Yirong Yang, Yanqing Zhu 他
日本語で読む → - 論文VLAロボティクス
信頼できる視覚-言語-行動モデルのための行動誤差分布の再形成
連続行動VLAモデルの学習に最小誤差エントロピー(MEE)目的関数を導入し、MSEと組み合わせることで成功率とロバスト性を向上させた研究。
原題: Reshaping Action Error Distributions for Reliable Vision-Language-Action Models / Shuanghao Bai, Dakai Wang, Cheng Chi 他
日本語で読む → - 論文LiDAR認識eess.SP
3フレームRGBスキャン符号化によるリアルタイム2D LiDAR物体検出
連続する3つの2D LiDARスキャンをRGBチャネルとして重ねてYOLOv8nに入力し、屋内サービスロボット向けにカメラ不要でリアルタイムな物体検出を実現した。
原題: Real-Time 2D LiDAR Object Detection Using Three-Frame RGB Scan Encoding / Soheil Behnam Roudsari, Alexandre S. Brandão, Felipe N. Martins
日本語で読む → - 論文群制御ロボティクス
内部化された形態形成:局所トークン交換によるモジュール系の成長・複製・再生の自己組織化モデル
隣接モジュール間の局所的な整数トークン交換のみで、成長・自己分裂・切断後の再生といった複雑な形態形成が創発する自己組織化モデルを提案し、六角格子上のシミュレーションで実証した。
原題: Internalized Morphogenesis: A Self-Organizing Model for Growth, Replication, and Regeneration via Local Token Exchange in Modular Systems / Takeshi Ishida
日本語で読む → - 論文知覚/3D位置推定画像認識
自律レース向けUNetベースのキーポイント回帰による3Dコーン位置推定
UNetを用いてコーンのキーポイントを検出し、自律レースにおける3D位置推定精度を従来手法から大幅に改善した研究。
原題: UNet-Based Keypoint Regression for 3D Cone Localization in Autonomous Racing / Mariia Baidachna, James Carty, Aidan Ferguson 他
日本語で読む → - 論文遠隔操作ロボティクス
人間中心のAR評価のための高忠実度ロボットマニピュレータ遠隔操作フレームワーク
人間の自然な動きをキャプチャしロボットマニピュレータで正確に再現するリアルタイム遠隔操作プラットフォームARBotを開発し、AR評価用の軌道データセットを公開した。
原題: A High-Fidelity Robotic Manipulator Teleoperation Framework for Human-Centered Augmented Reality Evaluation / Harsh Chhajed, Tian Guo
日本語で読む → - 論文群制御ロボティクス
SkySim: 大規模言語モデルによるドローン群の自然言語制御のためのROS2ベースシミュレーション環境
LLMによる高レベル計画と人工ポテンシャル場による安全フィルタを分離し、自然言語でドローン群を安全に制御できるROS2/Gazeboシミュレータを提案・検証した。
原題: SkySim: A ROS2-based Simulation Environment for Natural Language Control of Drone Swarms using Large Language Models / Aditya Shibu, Marah Saleh, Mohamed Al-Musleh 他
日本語で読む → - 論文安全制御ロボティクス
SQ-CBF: スーパークワドリックの安全フィルタリングのための符号付き距離関数による数値的安定化
スーパークワドリックの陰関数を直接使うと勾配が不安定になる問題を指摘し、符号付き距離関数をバリア候補として用いる安全フィルタリング手法を提案した。
原題: SQ-CBF: Signed Distance Functions for Numerically Stable Superquadric-Based Safety Filtering / Haocheng Zhao, Lukas Brunke, Oliver Lagerquist 他
日本語で読む → - 論文移動支援ロボットHCI
視覚障害者のグループツアーを支援するロボット
視覚障害者が晴眼者と共にグループツアーに参加する際の課題を調査し、移動ロボットによる支援システムを設計・試作して科学博物館で実証実験を行った。
原題: Robot-Assisted Group Tours for Blind People / Yaxin Hu, Masaki Kuribayashi, Allan Wang 他
日本語で読む →