論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
MOSAIC: 異種ロボットチームの知的連携のためのモジュール式スケーラブル自律性
単一オペレータの監督下で異種ロボットチームが科学探査を行うためのスケーラブルな自律性フレームワークを提案し、月面探査模擬実験で1台故障時でもタスクの82.3%を完了した。
原題: MOSAIC: Modular Scalable Autonomy for Intelligent Coordination of Heterogeneous Robotic Teams / David Oberacker, Julia Richter, Philip Arm 他
日本語で読む → - 論文分散ロボティクスロボティクス
BlazeAIoT: エッジ・フォグ・クラウドを横断する分散ロボティクス向けモジュール型多層プラットフォーム
エッジ・フォグ・クラウドにまたがる分散ロボティクスを統合するモジュール型プラットフォームBlazeAIoTを提案し、ナビゲーションや大規模メッセージ処理のシナリオでリアルタイム性能を検証した。
原題: BlazeAIoT: A Modular Multi-Layer Platform for Real-Time Distributed Robotics Across Edge, Fog, and Cloud Infrastructures / Cedric Melancon, Julien Gascon-Samson, Maarouf Saad 他
日本語で読む → - 論文マニピュレーションロボティクス
CoLA-Flow Policy: 連続潜在行動フローマッチングによる時間的に一貫した模倣学習
行動系列を時間的に一貫した潜在軌道にエンコードし、連続潜在空間でフローマッチングを行うことで、高速推論と滑らかで安定した長期的ロボットマニピュレーションを実現した模倣学習フレームワーク。
原題: CoLA-Flow Policy: Temporally Coherent Imitation Learning via Continuous Latent Action Flow Matching for Robotic Manipulation / Wu Songwei, Jiang Zhiduo, Sun Wandong 他
日本語で読む → - 論文制御/LLMロボティクス
宇宙機制御のための自律推論:グループ相対方策最適化を用いた大規模言語モデルフレームワーク
推論可能な大規模言語モデルとグループ相対方策最適化(GRPO)を組み合わせ、線形系から宇宙機の姿勢制御まで多様な制御問題で安定化方策を学習する手法を提案した。
原題: Autonomous Reasoning for Spacecraft Control: A Large Language Model Framework with Group Relative Policy Optimization / Amit Jain, Richard Linares
日本語で読む → - 論文6D姿勢推定画像認識
クロス視点知覚による細粒度対応学習で実現するオープンボキャブラリ6D物体姿勢推定
オープンボキャブラリ6D姿勢推定において、対象物体を背景から分離し、二視点特徴の融合とパッチ間相関行列による空間制約付きマッチングを行うFiCoPを提案し、REAL275とToyota-Lightで精度を大幅に改善した。
原題: Learning Fine-Grained Correspondence with Cross-Perspective Perception for Open-Vocabulary 6D Object Pose Estimation / Yu Qin, Shimeng Fan, Fan Yang 他
日本語で読む → - 論文物理的ヒューマンロボットインタラクションロボティクス
超冗長ロボット身体との人間工学的物理インタラクションのための姿勢バーチャルフィクスチャ
超冗長ロボット身体(SRB)との物理的インタラクション中に非人間工学的な姿勢を検出すると、抵抗感を与えて姿勢改善を促す制御フレームワークを提案し、14名の被験者実験で有効性を示した。
原題: Postural Virtual Fixtures for Ergonomic Physical Interactions with Supernumerary Robotic Bodies / Theodora Kastritsi, Marta Lagomarsino, Arash Ajoudani
日本語で読む → - 論文VLAロボティクス
視覚プロンプトを用いた視覚-言語-行動モデルによるオフロード自動運転
オフロード自動運転向けに、セマンティックセグメンテーションを視覚プロンプトとして使い自己整合性付き思考連鎖で推論するVLAフレームワークOFF-EMMAを提案し、軌道計画精度を改善した。
原題: A Vision-Language-Action Model with Visual Prompt for OFF-Road Autonomous Driving / Liangdong Zhang, Yiming Nie, Haoyang Li 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
WaveMan: ヒューマノイドロボットのためのミリ波による部屋規模の人間インタラクション知覚
ミリ波センシングを用いて、ユーザーの位置に依存せずプライバシーを守りながら部屋規模で人間のインタラクションを認識するシステムを提案し、未学習の位置でも高精度を実現した。
原題: WaveMan: mmWave-Based Room-Scale Human Interaction Perception for Humanoid Robots / Yuxuan Hu, Kuangji Zuo, Boyu Ma 他
日本語で読む → - 論文航空管制/強化学習機械学習
オンライン行動スタッキングによる航空管制の強化学習性能向上
強化学習で航空管制を学習する際、推論時に基本行動を組み合わせて複合的な管制指示を生成するオンライン行動スタッキングを提案し、小さな行動空間でも実用的な性能を実現した。
原題: Online Action-Stacking Improves Reinforcement Learning Performance for Air Traffic Control / Ben Carvell, George De Ath, Eseoghene Benjamin 他
日本語で読む → - 論文sim2realロボティクス
データ駆動型テラメカニクスによる月面ローバー向けリアルタイムシミュレータ
月面ローバーの走行を高忠実度で再現するため、実験とシミュレーションから得たデータで滑りと沈下の回帰モデルを構築し、リアルタイムで動作するテラメカニクスシミュレータを実現した。
原題: Data-Driven Terramechanics Approach Towards a Realistic Real-Time Simulator for Lunar Rovers / Jakob M. Kern, James M. Hurrell, Shreya Santra 他
日本語で読む → - 論文筋電位/意図検出ロボティクス
ReactEMG Stroke:健常者から脳卒中患者への筋電位意図検出の少数ショット適応
健常者の大規模sEMGデータで事前学習したモデルを、脳卒中患者ごとの少量データで微調整することで、キャリブレーション負担を減らしつつ意図検出精度と頑健性を向上させる手法を提案した。
原題: ReactEMG Stroke: Healthy-to-Stroke Few-shot Adaptation for sEMG-Based Intent Detection / Runsheng Wang, Katelyn Lee, Xinyue Zhu 他
日本語で読む → - 論文自己適応ロボティクス
SUNSET:ROSベースの自己適応のためのセンサフュージョン意味セグメンテーション例題
ROS2上で動作するセンサフュージョン意味セグメンテーションパイプラインを例題として提供し、故障注入により自己適応アプローチの評価を可能にする。
原題: SUNSET - A Sensor-fUsioN based semantic SegmEnTation exemplar for ROS-based self-adaptation / Andreas Wiedholz, Rafael Paintner, Alwin Hoffmann 他
日本語で読む → - 論文sim2realロボティクス
サイバーフィジカルモビリティラボにおけるゼロショットMARLベンチマーク
シミュレーション・デジタルツイン・実機を統合したCPM Lab上で、MARLによる自動運転車両の運動計画ポリシーのゼロショットsim-to-real転送を評価する再現可能なベンチマークを提案し、性能劣化の要因を分析した。
原題: Zero-Shot MARL Benchmark in the Cyber-Physical Mobility Lab / Julius Beerwerth, Jianye Xu, Simon Schäfer 他
日本語で読む → - 論文モデルベース強化学習AI
オブジェクト中心の世界モデルとモンテカルロ木探索の融合
物体間の相互作用をグラフニューラルネットで捉えるオブジェクト中心の世界モデルを構築し、モンテカルロ木探索による計画と組み合わせた強化学習手法ObjectZeroを提案した。
原題: Object-Centric World Models Meet Monte Carlo Tree Search / Rodion Vakhitov, Leonid Ugadiarov, Aleksandr Panov
日本語で読む → - 論文VLAロボティクス
V-VLAPS: 価値誘導型ビジョン・言語・行動モデルプランニング
VLAモデルの計画に軽量な価値ヘッドを追加し、モンテカルロ木探索を高価値な分岐へ誘導することで、長期タスクや分布シフト下での性能を改善する手法を提案。
原題: V-VLAPS: Value-Guided Planning for Vision-Language-Action Models / Ke Ren, Ali Salamatian, Kieran Pattison 他
日本語で読む → - 論文位置推定画像認識
惑星探査の地空ロボットチーム向けドメイン汎化クロスビュー位置推定のための視覚基盤モデル
視覚基盤モデルによるセマンティックセグメンテーションと大量の合成データを活用し、地上ローバーが限られた視野の単眼RGB画像から航空マップ上で自己位置を推定するクロスビュー二重エンコーダ手法を提案。実世界の探査アナログ施設で取得したデータセットも公開した。
原題: Vision Foundation Models for Domain Generalisable Cross-View Localisation in Planetary Ground-Aerial Robotic Teams / Lachlan Holden, Feras Dayoub, Alberto Candela 他
日本語で読む → - 論文行動計画機械学習
JEPA世界モデルによる価値誘導型行動計画
JEPA世界モデルの表現空間を整形し、目標条件付き価値関数を状態埋め込み間の距離で近似することで、行動計画の性能を向上させる手法を提案した。
原題: Value-guided action planning with JEPA world models / Matthieu Destrade, Oumayma Bounou, Quentin Le Lidec 他
日本語で読む → - 論文VLAロボティクス
CLARE: 自律的アダプタルーティングと拡張による視覚-言語-行動モデルの継続学習
VLAモデルに軽量アダプタを追加し、層ごとの特徴類似度に基づいて必要な箇所だけを自律的に拡張することで、過去データやタスクIDなしに破滅的忘却を防ぎながら新タスクを継続学習するフレームワークを提案。
原題: CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion / Ralf Römer, Yi Zhang, Yuming Li 他
日本語で読む → - 論文強化学習機械学習
RN-D: オンポリシー強化学習のための離散化カテゴリカルアクター
連続制御のオンポリシー強化学習において、ガウス分布アクターの代わりに各行動次元を離散ビン上の分布として表現するカテゴリカルアクターと正則化ネットワークを組み合わせ、ベンチマークで最先端性能を達成した。
原題: RN-D: Discretized Categorical Actors for On-Policy Reinforcement Learning / Yuexin Bian, Jie Feng, Tao Wang 他
日本語で読む → - 論文オフライン強化学習機械学習
静的データセットを超えて:検証済み合成遷移による堅牢なオフライン方策最適化
二重再帰ワールドモデルで合成遷移を生成し、VAE・感度分析・MCドロップアウトの階層的不確実性フィルタで検証することで、オフライン強化学習の性能を向上させる手法MoReBRACを提案した。
原題: Beyond Static Datasets: Robust Offline Policy Optimization via Vetted Synthetic Transitions / Pedram Agand, Mo Chen
日本語で読む → - 論文UAVセンシング/物理情報機械学習機械学習
物理制約付きノイズ除去オートエンコーダによるデータ希少な山火事UAVセンシング
UAVの低コストセンサのドリフトや遅延を補正するため、物理制約をネットワーク構造に組み込んだノイズ除去オートエンコーダを提案し、少ない飛行データで高精度な濃度推定を実現した。
原題: Physics-Constrained Denoising Autoencoders for Data-Scarce Wildfire UAV Sensing / Abdelrahman Ramadan, Zahra Dorbeigi Namaghi, Emily Taylor 他
日本語で読む → - 論文マニピュレーションロボティクス
関節物体のオンライン推定と操作
視覚事前情報と固有感覚を因子グラフで統合し、未知の関節物体の関節状態をオンライン推定しながら操作する手法を提案。実機で75%の成功率を達成。
原題: Online Estimation and Manipulation of Articulated Objects / Russell Buchanan, Adrian Röfer, João Moura 他
日本語で読む → - 論文VLA画像認識
Fast-ThinkAct: 言語化可能な潜在プランニングによる効率的な視覚-言語-行動推論
推論トレースを潜在的な思考連鎖に蒸留し、推論VLAの推論遅延を最大89.3%削減しつつ長期的プランニングや適応性能を維持する手法を提案。
原題: Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning / Chi-Pin Huang, Yunze Man, Zhiding Yu 他
日本語で読む → - 論文教育・シミュレーションロボティクス
EduSim-LLM:大規模言語モデルとロボットシミュレーションを統合した初心者向け教育プラットフォーム
自然言語指示をCoppeliaSim上のロボット行動列に変換する教育プラットフォームを構築し、直接制御と自律制御の2つの対話モデルで多ロボット協調や運動計画を評価した。
原題: EduSim-LLM: An Educational Platform Integrating Large Language Models and Robotic Simulation for Beginners / Shenqi Lu, Liangwei Zhang
日本語で読む → - 論文3Dセグメンテーション画像認識
CropNeRF: ニューラル放射場に基づく作物カウントフレームワーク
多視点画像とNeRFを組み合わせ、3Dインスタンスセグメンテーションで作物を正確に数える手法を提案し、綿花・リンゴ・ナシのデータセットで有効性を示した。
原題: CropNeRF: A Neural Radiance Field-Based Framework for Crop Counting / Md Ahmed Al Muzaddid, William J. Beksi
日本語で読む → - 論文医療ロボティクスロボティクス
小線源治療用OncoReachスタイレット:設計評価とパイロット研究
子宮頸がんの組織内小線源治療において、直針の直線的経路の制限を克服するため、標準的な15G/13G針に適合する手動操作可能な腱駆動式ステアラブルスタイレットを開発し、設計パラメータの評価とファントムを用いたパイロット研究でその有効性を示した。
原題: The OncoReach Stylet for Brachytherapy: Design Evaluation and Pilot Study / Pejman Kheradmand, Kent K. Yamamoto, Emma Webster 他
日本語で読む → - 論文点群処理画像認識
低遅延空間データ伝送のためのリアルタイムLiDAR点群高密度化
複数のLiDAR入力と高解像度カラー画像を組み合わせ、CNNによるジョイントバイラテラルフィルタでリアルタイムに高密度深度マップを生成する手法を提案した。
原題: Real-Time LiDAR Point Cloud Densification for Low-Latency Spatial Data Transmission / Kazuhiko Murasaki, Shunsuke Konagai, Masakatsu Aoki 他
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
構造化・非構造化空域における間隔確保のためのTransformerベースマルチエージェント強化学習
相対極座標状態空間でTransformerエンコーダを訓練し、多様な交通パターンと交差角に適応する航空機の間隔確保手法を提案。単一エンコーダ構成が深い構成より優れ、衝突リスクをほぼゼロにした。
原題: Transformer-based Multi-agent Reinforcement Learning for Separation Assurance in Structured and Unstructured Airspaces / Arsyi Aziz, Peng Wei
日本語で読む → - 論文物理的HRIロボティクス
物理的ヒューマンロボットインタラクションのための双方向コミュニケーションシステムBRIDGE
自然言語でロボットの軌道(位置・速度・力)をリアルタイムに修正でき、ロボットも言葉で応答する双方向コミュニケーションシステムを開発し、高齢者18名の実験で対話性と透明性の評価が向上することを示した。
原題: Bidirectional Human-Robot Communication for Physical Human-Robot Interaction / Junxiang Wang, Cindy Wang, Rana Soltani Zarrin 他
日本語で読む → - 論文ソフトロボティクスロボティクス
大型重量物把持のための油圧駆動ソフトロボットグリッパの設計手法
油圧駆動のソフトグリッパを設計し、数理モデルと有限要素解析に基づいて20kgの物体を把持できることを実験で示した。
原題: Design Methodology of Hydraulically-driven Soft Robotic Gripper for a Large and Heavy Object / Ko Yamamoto, Kyosuke Ishibashi, Hiroki Ishikawa 他
日本語で読む →