論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文視覚基盤モデル適応ロボティクス
RepSAM: 表現ガイド適応による基盤モデルとロボット視覚の橋渡し
基盤モデルSAMのロボット視覚への適用時、層ごとの表現ずれを分析し、CKA指標に基づくランク配分と多モーダル融合で高効率なファインチューニングを実現。パラメータを大幅削減しつつ、ロボット操作成功率も向上させた。
原題: RepSAM: Bridging Foundation Models to Robotic Vision via Representation-Guided Adaptation / Wenhui Chu
日本語で読む → - 論文自動運転ロボティクス
SARAD: LLMベースの衝突予測を備えた安全意識型ハイブリッド強化学習による自動運転
自動運転の意思決定において、LLMと強化学習を組み合わせ、衝突予測モジュールを導入して安全性と効率性を両立させる新しいフレームワークを提案した。
原題: SARAD: LLM-Based Safety-Aware Hybrid Reinforcement Learning with Collision Prediction for Autonomous Driving / Kangyu Wu, Peng Cui, Guoxi Chen 他
日本語で読む → - 論文シミュレーションロボティクス
農業用UAVシミュレータ「Droneulator」:RotorPyとGodot 4によるポータブルな統合環境
農業用UAV研究のためのポータブルなシミュレータを提案。RotorPyで動力学、Godot 4で描画・センサ生成を行い、ROS 2互換パイプラインで統合。3D再構築、局所計画、強化学習の3つのワークフローで検証した。
原題: Droneulator: A Portable UAV Simulator for Agricultural Workflows with RotorPy and Godot 4 / Jacob Swindell, Michael Lowen, Marija Popovic 他
日本語で読む → - 論文自動運転/シナリオ生成ロボティクス
時空間論理によるニューロシンボリックシナリオ生成の誘導
自動運転の安全性評価のため、時空間論理仕様を満たす重要シナリオを拡散モデルで生成するフレームワークSTRELGenを提案。
原題: Guiding Neuro-Symbolic Scenario Generation with Spatio-Temporal Logic / Lorenzo Bonin, Francesco Giacomarra, Luca Bortolussi 他
日本語で読む → - 論文歩行cs.NE
不整地での四足歩行制御のためのニューロモルフィック強化学習
不整地を歩く四足ロボットの制御に、平衡伝播法を用いた局所学習可能なPPOフレームワークを提案し、従来の誤差逆伝播を使わずに同等の性能を達成した。
原題: Neuromorphic Reinforcement Learning for Quadruped Locomotion Control on Uneven Terrain / Zhuangyu Han, Abhronil Sengupta
日本語で読む → - 論文イベントカメラ/クロスモーダル学習画像認識
REALM: RGBとイベントを整列する潜在多様体によるクロスモーダル知覚
イベントカメラのデータをRGB基盤モデルの潜在空間に写像するフレームワークを提案し、事前学習済みのRGBバックボーンをイベントデータに活用して、深度推定やセマンティックセグメンテーションなどのタスクを実現する。
原題: REALM: An RGB- and Event-Aligned Latent Manifold for Cross-Modal Perception / Vincenzo Polizzi, David B. Lindell, Jonathan Kelly
日本語で読む → - 論文自動運転/3Dラベリング/VLM画像認識
視覚言語モデルを用いた車両情報推定による自動運転向け3Dラベリングの改善
自動運転の3Dラベリング精度向上のため、視覚言語モデルで車両のメーカー・モデル・世代を推定し、正確な3Dバウンディングボックス寸法を出力する手法を提案。手動ラベリングの時間削減と品質向上を実証した。
原題: Improving 3D Labeling in Self-Driving by Inferring Vehicle Information using Vision Language Models / Steven Chen, Shivesh Khaitan, Nemanja Djuric
日本語で読む → - 論文探索ロボティクス
VLMガイドによる自律フロンティア探索
視覚言語モデル(VLM)を用いて、ロボットの探索戦略を高レベルで決定し、従来の幾何学的ヒューリスティックを置き換えることで、マップカバレッジを最大24%向上させる新しい探索パイプラインを提案した。
原題: Autonomous Frontier-Based Exploration with VLM Guidance / Aarush Aitha, Avideh Zakhor
日本語で読む → - 論文マニピュレーションロボティクス
SECOND-Grasp: 意味的接触に基づく器用な把持
物理的に安定した把持と意味的なタスク理解を統合する、言語ガイド付きの器用な把持フレームワークを提案した。
原題: SECOND-Grasp: Semantic Contact-guided Dexterous Grasping / Han Yi Shin, Heeju Ko, Jaewon Mun 他
日本語で読む → - 論文能動マッピング画像認識
異方性可視性場による不確実性駆動の3Dガウシアンスプラッティング能動マッピング
3Dガウシアンスプラッティング(3DGS)の未観測領域の不確実性を定量化する異方性可視性場を導入し、能動マッピングを実時間で行うフレームワークを提案した。
原題: Uncertainty-driven 3D Gaussian Splatting Active Mapping via Anisotropic Visibility Field / Shangjie Xue, Jesse Dill, Dhruv Ahuja 他
日本語で読む → - 論文模倣学習/拡散ポリシー/説明可能性ロボティクス
SADP: 基盤モデル生成デモから学習するサブゴール認識拡散ポリシーによる説明可能なロボット
基盤モデルでサブゴール注釈付きデモを自動生成し、そのデータで拡散ポリシーを訓練することで、ロボットが実行中のサブタスクを説明可能にしつつ成功率も向上させる手法を提案した。
原題: SADP: Subgoal-Aware Diffusion Policy for Explainable Robots Learned from Foundation Model Generated Demonstrations / Site Hu, Takato Horii
日本語で読む → - 論文マニピュレーションロボティクス
オンライン慣性推定と凸レンチ最適化による産業用双腕ボックスハンドリング
未知の質量・重心を持つ箱を双腕ロボットで安定に持ち上げるため、接触力から慣性をオンライン推定し、摩擦制約付きのSOCPで力を最適化する手法を提案・実機検証した。
原題: Industrial Dual-Arm Box Handling via Online Inertial Estimation and Convex Wrench Optimization / Kenzhi Iskandar Wong, Lin Yang, Qian Ying Lee 他
日本語で読む → - 論文水中航法ロボティクス
AI支援による自律型水中ビークル航法の進歩
自律型水中ビークル(AUV)の航法精度向上のため、慣性航法システムとドップラー速度ログ、カメラを統合するセンサフュージョン技術と、AI駆動の学習アプローチによる慣性デッドレコニング改善を解説した章。
原題: AI-Aided Advancements in Autonomous Underwater Vehicle Navigation / Guy Damari, Zeev Yampolsky, Nadav Cohen 他
日本語で読む → - 論文能動知覚/安全制御ロボティクス
制御バリア関数による3Dガウススプラッティング場における競合認識型能動知覚と制御
3Dガウススプラッティングで表現された環境において、安全性と情報獲得の競合を扱う能動知覚・制御フレームワークを提案。CBFによる安全制約と知覚バリア関数による視点選択を統合したQPで解決する。
原題: Conflict-Aware Active Perception and Control in 3D Gaussian Splatting Fields via Control Barrier Functions / Amirhossein Mollaei Khass, Athanasios Cosse, Vivek Pandey 他
日本語で読む → - 論文物体検出ロボティクス
UAV検出のためのデュアルインターバル動作手がかりによる自己運動とターゲットダイナミクスの分離
UAV映像での物体検出において、ホモグラフィによるグローバルモーション補償と短期的・長期的な動作手がかりを統合する軽量な動作誘導注意機構を提案し、自己運動の影響を抑えて検出精度を向上させた。
原題: Decoupling Ego-Motion from Target Dynamics via Dual-Interval Motion Cues for UAV Detection / Liuyang Wang, Feitian Zhang
日本語で読む → - 論文VLAロボティクス
故障認識型ロボット制御のためのヘルス条件付き視覚言語行動モデル
ロボットの物理的な劣化(関節の劣化やアクチュエータ故障など)に対応するため、健康状態ベクトルを入力として受け取り、劣化した関節でもタスクを完了できるように適応する視覚言語行動(VLA)モデルを提案した。
原題: Health-Conditioned Vision-Language-Action Models for Malfunction-Aware Robot Control / Hüseyin Arslan, Özgür Erkent
日本語で読む → - 論文群制御ロボティクス
不確実性を考慮したマルチUAVシステム向け3D位置補正
マルチUAVの自己位置推定を、隣接機との距離情報と信頼度スコアを融合して補正する分散型の軽量手法を提案。コールドスタートや妨害時でも精度を維持する。
原題: Uncertainty-Aware 3D Position Refinement for Multi-UAV Systems / Hosam Alamleh, Damir Pulatov
日本語で読む → - 論文自動運転画像認識
VECTOR-Drive: 密結合された視覚言語と軌道エキスパートルーティングによるエンドツーエンド自動運転
エンドツーエンド自動運転のための、視覚言語モデルと軌道予測を密結合したVLAフレームワークを提案し、共有アテンションとセマンティックルーティングにより高い運転スコアを達成した。
原題: VECTOR-Drive: Tightly Coupled Vision-Language and Trajectory Expert Routing for End-to-End Autonomous Driving / Rui Zhao, Jianlin Yu, Zhenhai Gao 他
日本語で読む → - 論文視覚的位置認識画像認識
DisPlace: 複数参照を用いた視覚的位置認識のための識別的場所射影
複数の参照走行から得た記述子を融合して、場所の識別性を高めつつ環境変化による変動を抑える新しい視覚的位置認識手法を提案した。
原題: DisPlace: Discriminative Place Projections for Multi-Reference Visual Place Recognition / Dhyey Manish Rajani, Michael Milford, Tobias Fischer
日本語で読む → - 論文遠隔操作ロボティクス
動的環境下におけるマニピュレータのリアルタイムVR遠隔操作フレームワークの研究
VRを用いたマニピュレータ遠隔操作で、動的障害物や衝突リスクに対応するリアルタイム制御フレームワークを提案し、GPU加速IKと軌道最適化を統合して安全な動作生成を実現した。
原題: A study on a Real-Time VR-Based Teleoperation Framework for Manipulator in Dynamic Environment / InGyu Choi, GeonYeong Go, SunWoo Ahn 他
日本語で読む → - 論文VLAロボティクス
Afford-VLA: 内在化されたアフォーダンスによる行動整合的な視覚プランニング
VLAモデルにタスク条件付きアフォーダンスを内部生成・利用する視覚プランニング機構を導入し、行動予測と密結合させることで操作性能を向上させた。
原題: Afford-VLA: Action-Aligned Visual Planning via Internalized Affordance / Runze Wang, Yuqian Fu, Yu Li 他
日本語で読む → - 論文データセット画像認識
LRDDv3: 距離情報と熱画像を備えた高解像度長距離ドローン検出データセット
長距離ドローン検出のための高解像度RGB画像と熱画像を含む大規模データセットを構築し、距離情報も提供する。
原題: LRDDv3: High-Resolution Long-Range Drone Detection Dataset with Range Information and Thermal Data / Knut Peterson, Zaid Mayers, Azmain Yousuf 他
日本語で読む → - 論文マニピュレーションロボティクス
可変トポロジートラスシステムによる物体操作
可変トポロジートラス(VTT)ロボットを用いた物体操作戦略を提案し、位置と力を同時に制御するハイブリッド制御フレームワークを導入した。実験により、VTTシステムでの一貫した物体操作が可能であることを実証した。
原題: Object Manipulation of the Variable Topology Truss system / Andrew Jang-Ho Bae, Myeongjin Choi, Haorui Li 他
日本語で読む → - 論文リハビリテーション機器/生体模倣設計ロボティクス
緊張構造を利用した松葉杖:予張力自己張力モジュールによるコンプライアンスが地面反力プロファイル、速度、労力、快適性、知覚安定性を改善
剛性・ばね式の既存松葉杖と比較し、生体模倣のテンセグリティ構造モジュールを備えた松葉杖が、機械試験と人間試験で荷重率低減、労力・快適性・疼痛・使いやすさの改善を示した。
原題: Tensegrity crutches with compliance from a pre-stressed self-tensile module improve ground reaction force profiles, speed, effort, comfort, and perceived stability / Jingxian Gu, Joanna Spyra, Andrew Walski 他
日本語で読む → - 論文水中ロボティクスロボティクス
サイクル分解型の頭足類模倣パルスジェットロボット:高容量排出と抗力低減グライディング
頭足類のパルスジェット推進を模倣し、剛柔ハイブリッドな折り紙構造の外套膜を持つロボットを開発。排出・滑空・再充填のサイクルを分解して性能を評価した。
原題: Cycle-resolved Cephalopod-Inspired Pulsed-Jet Robot With High-Volume Expulsion and Drag-Reduced Gliding / Yiyuan Zhang, Anye Zhong, Junkai Chen 他
日本語で読む → - 論文3D物体検出画像認識
TriBand-BEV: 高さ認識BEVと高解像度特徴融合によるリアルタイムLiDARのみの3D歩行者検出
LiDAR点群を3つの高さ帯域を持つ軽量な2D BEV表現に変換し、2D検出として3D物体検出を解くリアルタイム手法を提案。KITTIで高速かつ高精度を達成。
原題: TriBand-BEV: Real-Time LiDAR-Only 3D Pedestrian Detection via Height-Aware BEV and High-Resolution Feature Fusion / Mohammad Khoshkdahan, Alexey Vinel
日本語で読む → - 論文VLA/強化学習/人間介入ロボティクス
UniSteer: 人間のガイダンスを活用したVLA適応のための統合ノイズステアリング
拡散型VLAモデルの実世界適応を効率化するため、人間の修正行動をノイズ空間の強化学習に統合するフレームワークUniSteerを提案。実機実験で成功率を平均66分で20%から90%に向上させた。
原題: UniSteer: Unified Noise Steering for Efficient Human-Guided VLA Adaptation / Junjie Lu, Xinyao Qin, Yuhua Jiang 他
日本語で読む → - 論文姿勢推定制御
双対クォータニオンによる視覚姿勢推定の可観測性条件とフィルタ設計
6自由度の視覚ターゲット追跡に対して、双対クォータニオンを用いた可観測性解析とLie群UKFを提案し、P$n$Pソルバーと比較して精度と遮蔽耐性が向上することを示した。
原題: Observability Conditions and Filter Design for Visual Pose Estimation via Dual Quaternions / Nicholas B. Andrews, Kristi A. Morgansen
日本語で読む → - 論文データ生成/移動操作ロボティクス
HumanoidMimicGen: 全身計画による移動操作のためのデータ生成
ヒューマノイドの移動と操作を模倣学習で訓練するためのデータを自動生成する手法を提案。少数の実演から全身スキルを適応させ、多様なシーンで安定したデータを生成し、実データのみで訓練した場合より20%性能が向上した。
原題: HumanoidMimicGen: Data Generation for Loco-Manipulation via Whole-Body Planning / Kevin Lin, Ajay Mandlekar, Caelan Reed Garrett 他
日本語で読む → - 論文群制御ロボティクス
シミュレーション情報を活用した拡散モデルによる分散型マルチロボット動作計画
各ロボットが局所観測から衝突回避軌道を生成する分散型マルチロボット動作計画において、隣接ロボットの将来軌道を拡散モデルで予測し、その予測を安全制約として自身の軌道計画に活用する新しいフレームワークを提案した。
原題: Simulation-Informed Diffusion for Decentralized Multi-robot Motion Planning / Jinhao Liang, Sven Koenig, Ferdinando Fioretto
日本語で読む →