論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文人間ロボット協調ロボティクス
人間とロボットの協調の探求:困難なタスクにおける対話モダリティの分析
受動的、反応的、能動的な3つの対話モードを比較し、能動的なロボット支援がユーザー体験を向上させることを示した研究。
原題: Exploring Human-Robot Collaboration: Analysis of Interaction Modalities in Challenging Tasks / Simone Arreghini, Cristina Iani, Alessandro Giusti 他
日本語で読む → - 論文マニピュレーションロボティクス
安全で操縦可能なロボット器用操作のための幾何学的運動方策
異種幾何空間上の目的と制約を統一的に扱う、安全な構成空間加速度を計算する幾何学的枠組みを提案し、高次方策による低次元の残留動作注入を可能にした。23自由度のロボットハンドで92.5%の把握成功率を達成。
原題: Safe and Steerable Geometric Motion Policies for Robotic Dexterous Manipulation / Albert Wu, Riccardo Bonalli, Thomas Lew 他
日本語で読む → - 論文VLA/検証画像認識
Pre-VLA: 信頼性の高い視覚言語行動・ワールドモデル展開のための先制ランタイム検証
VLAモデルや生成ワールドモデルの行動生成の不確実性に対処するため、物理実行や想像の前に行動の妥当性を検証する統一ランタイム検証アーキテクチャを提案した。
原題: Pre-VLA: Preemptive Runtime Verification for Reliable Vision-Language-Action and World-Model Rollouts / Zhen Sun, Yongjian Guo, Haoran Sun 他
日本語で読む → - 論文自動運転/3Dラベリング/VLM画像認識
視覚言語モデルを用いた車両情報推定による自動運転向け3Dラベリングの改善
自動運転の3Dラベリング精度向上のため、視覚言語モデルで車両のメーカー・モデル・世代を推定し、正確な3Dバウンディングボックス寸法を出力する手法を提案。手動ラベリングの時間削減と品質向上を実証した。
原題: Improving 3D Labeling in Self-Driving by Inferring Vehicle Information using Vision Language Models / Steven Chen, Shivesh Khaitan, Nemanja Djuric
日本語で読む → - 論文イベントカメラ/クロスモーダル学習画像認識
REALM: RGBとイベントを整列する潜在多様体によるクロスモーダル知覚
イベントカメラのデータをRGB基盤モデルの潜在空間に写像するフレームワークを提案し、事前学習済みのRGBバックボーンをイベントデータに活用して、深度推定やセマンティックセグメンテーションなどのタスクを実現する。
原題: REALM: An RGB- and Event-Aligned Latent Manifold for Cross-Modal Perception / Vincenzo Polizzi, David B. Lindell, Jonathan Kelly
日本語で読む → - 論文ナビゲーションロボティクス
安全性制約付き強化学習と訓練後到達可能性検証によるロボットナビゲーション
移動ロボットの安全なナビゲーションのために、CVaR制約付き強化学習でリスクに敏感な方策を訓練し、訓練後にテイラーモデル解析で到達可能集合を検証する枠組みを提案した。
原題: Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation / Qisong He, Xinmiao Huang, Jinwei Hu 他
日本語で読む → - 論文ロボットスキル学習ロボティクス
幾何学的ロボット表面作業のための転移可能な運動スキルの学習
ロボットの表面作業(塗装や溶接など)において、幾何学的な経路計画と実行レベルの専門的動作を分離し、CADモデルと軌道データから速度や姿勢の調整ルールを学習するフレームワークを提案した。
原題: Learning Transferable Motor Skills for Geometry-Aware Robotic Surface Tasks / Miroslav David, Karla Stepanova, Robert Babuska
日本語で読む → - 論文ナビゲーションロボティクス
MASt3R-Nav: 相対3DマップにおけるWayPixelナビゲーション
画像ペア間の相対3D座標系でのピクセル対応に基づくピクセル相対接続性マップを提案し、これをコストマップとして用いて制御器を訓練することで、高精度な視覚ナビゲーションを実現した。
原題: MASt3R-Nav: WayPixel Navigation in Relative 3D Maps / Vansh Garg, Rohit Jayanti, Krish Pandya 他
日本語で読む → - 論文環境モニタリングロボティクス
ガストモグラフィを用いたドローンによる火山ガスマッピングの実現
ドローンのダウンウォッシュで乱される火山ガス計測を、リモートセンシングとモデルベースのガストモグラフィ再構成で克服し、正確なガス分布マッピングを実証した論文。
原題: Towards Drone-based Mapping of Volcanic Gases using Gas Tomography / Marius Schaab, Niklas Karbach, Antonia Rabe 他
日本語で読む → - 論文VLAロボティクス
X-DiffVLA: クロスエンボディ拡散行動ヘッドを備えた視覚言語行動モデル
異なるエンドエフェクタを持つロボット間で知識を転移できる拡散ベースのVLAモデルを提案し、エンボディフォーシングと形態学的ツリー拡散により性能を向上させた。
原題: X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models / Boyu Li, Chaoyi Xu, Haoqi Yuan 他
日本語で読む → - 論文マニピュレーションロボティクス
ShapeGrasp: 視覚と触覚を統合した形状補完と把持の同時実行によるロボット操作の向上
単一のRGB-D画像から物体の完全な3D形状を推定し、物理シミュレーションで把持計画を行い、実際の把持試行から得られる触覚情報で形状を更新する反復的な把持・補完パイプラインを提案。実機で2種類のグリッパーを用いて評価し、高い把持成功率と形状再構成精度を達成した。
原題: ShapeGrasp: Simultaneous Visuo-Haptic Shape Completion and Grasping for Improved Robot Manipulation / Lukas Rustler, Matej Hoffmann
日本語で読む → - 論文群制御ロボティクス
PIMbot: マルチロボット強化学習への敵対的操作のための自己適応型攻撃フレームワーク
マルチロボット強化学習の社会ジレンマ環境において、報酬チャネルのインセンティブ操作とエージェント自身の行動ポリシー操作を適応的に組み合わせて結果を操作する攻撃フレームワークPIMbotを提案し、シミュレーションと実機で有効性を検証した。
原題: PIMbot: A Self-Adaptive Attack Framework for Adversarial Manipulation of Multi-Robot Reinforcement Learning / Zexin Li, Ziliang Zhang, Hyoseung Kim 他
日本語で読む → - 論文VLAロボティクス
ELAN4D: 身体中心の4D監視による視覚言語行動モデルのプラグアンドプレイ適応
ロボットのキーポイントの未来の3D軌跡を予測する補助分岐をVLAモデルに追加し、外乱下での汎化性能を向上させるフレームワークを提案した。
原題: ELAN4D: Embodiment-Centric 4D Supervision for Vision-Language-Action Models via Plug-and-Play Adaptation / Zeyuan He, Bowen Yang, Zhirui Fang 他
日本語で読む → - 論文シミュレーションロボティクス
農業用UAVシミュレータ「Droneulator」:RotorPyとGodot 4によるポータブルな統合環境
農業用UAV研究のためのポータブルなシミュレータを提案。RotorPyで動力学、Godot 4で描画・センサ生成を行い、ROS 2互換パイプラインで統合。3D再構築、局所計画、強化学習の3つのワークフローで検証した。
原題: Droneulator: A Portable UAV Simulator for Agricultural Workflows with RotorPy and Godot 4 / Jacob Swindell, Michael Lowen, Marija Popovic 他
日本語で読む → - 論文3Dアバター生成画像認識
マルチビュー生成なしで一貫性を実現する3Dガウシアンヘッドアバター
ランダムな2D画像のみから、マルチビューや3Dデータを使わずに高品質な3Dガウシアンヘッドアバターを生成する手法を提案。
原題: Multi-view Consistent 3D Gaussian Head Avatars 'without' Multi-view Generation / Aviral Chharia, Fernando De la Torre
日本語で読む → - 論文姿勢推定画像認識
ComPose: カテゴリレベル物体姿勢推定のための統合的補完・姿勢フレームワーク
部分点群の不完全性に着目し、形状補完と姿勢推定を統合したフレームワークを提案。キーポイントベースの段階的補完と幾何学的関係符号化により、頑健な姿勢推定を実現した。
原題: ComPose: A Unified Completion-Pose Framework for Robust Category-Level Object Pose Estimation / Huan Ren, Yihan Chen, Chuxin Wang 他
日本語で読む → - 論文経路計画ロボティクス
凸ニューラルRRT*:高品質なロボット経路計画のための高速かつ信頼性の高い学習誘導サンプリング
ニューラルネットワークで高品質経路の近傍領域を予測し、その凸包領域にサンプリングを集中させることで、計算時間を大幅に削減しつつ経路長も改善するRRT*の拡張手法を提案した。
原題: Convex-Neural RRT*: Fast and Reliable Learning-Guided Sampling for High-Quality Robot Path Planning / Hichem Cheriet, Badra Khellat Kihel, Samira Chouraqui 他
日本語で読む → - 論文シーン生成ロボティクス
ゾーングラフパラダイムによる複雑な屋内シーン生成の空間意味論の統合
複雑な非凸形状の屋内空間を生成するため、ゾーングラフという新しい表現と強化学習を組み合わせたフレームワークZoneMaestroを提案し、データセットとベンチマークも構築した。
原題: Orchestrating Spatial Semantics via a Zone-Graph Paradigm for Intricate Indoor Scene Generation / Meisheng Zhang, Shizhao Sun, Yang Zhao 他
日本語で読む → - 論文sim2realロボティクス
浮遊廃棄物回収用ASVにおける統合認識を備えた強化学習制御のSim-to-Real転移とロバスト性評価
浮遊ゴミ回収用の自律水上艇(ASV)に対し、カメラベースの偏光認識と軽量DRL制御を組み合わせ、シミュレーションのみで訓練した制御器を実機に直接適用するシステムを構築し、sim-to-real転移の評価手法と実地試験結果を示した。
原題: Sim-to-Real Transfer and Robustness Evaluation of Reinforcement Learning Control with Integrated Perception on an ASV for Floating Waste Capture / Luis F. W. Batista, Stéphanie Aravecchia, Cédric Pradalier
日本語で読む → - 論文触覚ロボティクス
ヒューマノイドロボットにおける身体的感情タッチ戦略のマッピング
iCubロボットを用いて、参加者が8つの感情を自由・腕のみ・胴体のみの3条件で表現し、身体部位と空間的制約がタッチ位置と動態に与える影響を調査した研究。
原題: Mapping Embodied Affective Touch Strategies on a Humanoid Robot / Qiaoqiao Ren, Omar Eldardeer, Francesca Cocchella 他
日本語で読む → - 論文3D再構成画像認識
拡散モデル誘導による都市シーン再構成の汎用高品質化手法
都市シーンの3D再構成において、視点が大きくずれると画質が劣化する問題を、拡散モデルの生成的先験知識を活用して数分で修正する汎用的な手法GenReを提案した。
原題: Diffusion-guided Generalizable Enhancer for Urban Scene Reconstruction / Henry Che, Jingkang Wang, Yun Chen 他
日本語で読む → - 論文制御ロボティクス
報酬設計と終了条件によるRLベースのクアッドローター制御の性能調整のためのヒューリスティック手法
報酬構造と終了条件を調整することで、RLベースのクアッドローター制御の応答速度を直感的にチューニングできる手法を提案した。
原題: A Heuristic Approach for Performance Tuning in RL-based Quadrotor Control via Reward Design and Termination Conditions / Fausto Mauricio Lagos Suarez, Akshit Saradagi, Vidya Sumathy 他
日本語で読む → - 論文視覚的位置認識画像認識
DisPlace: 複数参照を用いた視覚的位置認識のための識別的場所射影
複数の参照走行から得た記述子を融合して、場所の識別性を高めつつ環境変化による変動を抑える新しい視覚的位置認識手法を提案した。
原題: DisPlace: Discriminative Place Projections for Multi-Reference Visual Place Recognition / Dhyey Manish Rajani, Michael Milford, Tobias Fischer
日本語で読む → - 論文能動知覚/安全制御ロボティクス
制御バリア関数による3Dガウススプラッティング場における競合認識型能動知覚と制御
3Dガウススプラッティングで表現された環境において、安全性と情報獲得の競合を扱う能動知覚・制御フレームワークを提案。CBFによる安全制約と知覚バリア関数による視点選択を統合したQPで解決する。
原題: Conflict-Aware Active Perception and Control in 3D Gaussian Splatting Fields via Control Barrier Functions / Amirhossein Mollaei Khass, Athanasios Cosse, Vivek Pandey 他
日本語で読む → - 論文遠隔操作ロボティクス
動的環境下におけるマニピュレータのリアルタイムVR遠隔操作フレームワークの研究
VRを用いたマニピュレータ遠隔操作で、動的障害物や衝突リスクに対応するリアルタイム制御フレームワークを提案し、GPU加速IKと軌道最適化を統合して安全な動作生成を実現した。
原題: A study on a Real-Time VR-Based Teleoperation Framework for Manipulator in Dynamic Environment / InGyu Choi, GeonYeong Go, SunWoo Ahn 他
日本語で読む → - 論文強化学習機械学習
適応的Qチャンキングによるオフラインからオンラインへの強化学習
オフラインからオンラインへの強化学習において、状態ごとに最適なアクションチャンクサイズを適応的に選択する手法を提案し、固定サイズの既存手法より高い成功率を達成した。
原題: Adaptive Q-Chunking for Offline-to-Online Reinforcement Learning / Nandiraju Gireesh, Yuanliang Ju, He Wang
日本語で読む → - 論文マニピュレーションロボティクス
オンライン慣性推定と凸レンチ最適化による産業用双腕ボックスハンドリング
未知の質量・重心を持つ箱を双腕ロボットで安定に持ち上げるため、接触力から慣性をオンライン推定し、摩擦制約付きのSOCPで力を最適化する手法を提案・実機検証した。
原題: Industrial Dual-Arm Box Handling via Online Inertial Estimation and Convex Wrench Optimization / Kenzhi Iskandar Wong, Lin Yang, Qian Ying Lee 他
日本語で読む → - 論文マニピュレーションロボティクス
GSAM: 関節物体操作のための汎用かつ安全なロボットフレームワーク
関節物体の操作において、視覚による運動学パラメータ推定とVLMによる常識推論で認識を洗練し、衝突回避の制約を統合した安全な軌道計画を行うフレームワークを提案した。
原題: GSAM: A Generalizable and Safe Robotic Framework for Articulated Object Manipulation / Beichen Shao, Mengying Xie, Heng Su 他
日本語で読む → - 論文シミュレーションロボティクス
SubTGraph: ロボット自律性検証のための制御可能なトポロジー変動を備えた大規模地下環境合成
地下環境の大規模シミュレーションベンチマークを生成するフレームワークSubTGraphを提案し、ユーザー指定の構造制約からダイクストラ法を用いて多様な地下世界を手続き的に合成する。
原題: SubTGraph: Large-Scale Subterranean Environment Synthesis with Controllable Topological Variability for Robotic Autonomy Validation / F. Labra Caso, A. Saradagi, S. Fredriksson 他
日本語で読む → - 論文姿勢推定ロボティクス
対称性アノテーション不要の学習戦略による汎用・実動部品姿勢推定
対称性アノテーションを必要とせず、自己教師あり学習で部品の姿勢推定を行うフレームワークを提案した。
原題: Generalizable and Actionable Parts Pose Estimation with Symmetry Annotation-Free Learning Strategy / Wenxiao Chen, Xueyu Yuan, Liu Liu 他
日本語で読む →