論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文群制御ロボティクス
MARS-Dragonfly: モジュール型空中ロボットシステムの機敏で頑健な飛行制御
モジュール型空中ロボットシステム(MARS)の制御を、力・トルク等価でポリトープ制約を持つ仮想クアッドロータと二段階予測割り当てパイプラインを用いて実現し、多様な構成での安定飛行を可能にした。
原題: MARS-Dragonfly: Agile and Robust Flight Control of Modular Aerial Robot Systems / Rui Huang, Zhiqian Cai, Siyu Tang 他
日本語で読む → - 論文モーション生成ロボティクス
MotionBricks: モジュール型潜在生成モデルとスマートプリミティブによるスケーラブルなリアルタイムモーション生成
大規模なモーション生成をリアルタイムで行うためのフレームワークを提案し、35万以上のモーションクリップを単一モデルで扱い、速度指令やスタイル選択などの細かい制御を可能にするスマートプリミティブを導入した。
原題: MotionBricks: Scalable Real-Time Motions with Modular Latent Generative Model and Smart Primitives / Tingwu Wang, Olivier Dionne, Michael De Ruyter 他
日本語で読む → - 論文ドローン制御ロボティクス
QuadAgent: 視覚言語ガイドによるクアッドローター俊敏飛行のための応答性エージェントシステム
視覚と言語の入力に基づいてクアッドローターを俊敏に飛行させる、訓練不要のエージェントシステムを提案。非同期マルチエージェント構成で高次推論と低次制御を分離し、シミュレーションと実機で有効性を実証した。
原題: QuadAgent: A Responsive Agent System for Vision-Language Guided Quadrotor Agile Flight / Ao Zhuang, Feng Yu, Tianbao Zhang 他
日本語で読む → - 論文群制御ロボティクス
断続的通信環境における解析的信念統合によるロバストなマルチエージェント目標追跡
通信が制限された環境で、エージェント間の信念マップを正確かつ効率的に統合するため、KLダイバージェンス最適化の閉形式解を導出し、計算量を削減しつつノイズを抑制する手法を提案した。
原題: Robust Multi-Agent Target Tracking in Intermittent Communication Environments via Analytical Belief Merging / Mohamed Abdelnaby, Samuel Honor, Kevin Leahy
日本語で読む → - 論文強化学習ロボティクス
生の状態軌跡からの能動的報酬機械推論
報酬機械を生の状態軌跡から直接学習する手法を提案し、報酬やラベル、ノードの観測なしで学習可能な条件を示し、能動学習による効率改善も行う。
原題: Active Reward Machine Inference From Raw State Trajectories / Mohamad Louai Shehab, Antoine Aspeel, Necmiye Ozay
日本語で読む → - 論文着陸制御ロボティクス
傾斜プラットフォームへのマルチロータUAV着陸のための軽量トグル式接着プロトタイプ
波による傾斜や風の影響を受ける船舶への着陸成功率を高めるため、モーター駆動のコルクスクリューで面ファスナーに接着する軽量な着脱可能な接着機構を提案し、実験で成功率を40%から80%に向上させた。
原題: A Lightweight Toggleable Adhesion Prototype for Multirotor UAV Landing on Tilting Platforms / Teighin Nordholt, Melissa Greeff
日本語で読む → - 論文自動運転/VLA画像認識
UniDriveVLA:自動運転のための理解・知覚・行動計画の統合
自動運転向けのVLAモデルにおいて、空間知覚と意味推論の競合を解消するため、Mixture-of-Transformersによる専門家分離を導入した統合モデルUniDriveVLAを提案し、nuScenesとBench2Driveで最先端性能を達成した。
原題: UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving / Yongkang Li, Lijun Zhou, Sixu Yan 他
日本語で読む → - 論文姿勢推定ロボティクス
イベントカメラとニューロモルフィックハードウェアを用いた効率的な宇宙機姿勢推定
イベントカメラとニューロモルフィックプロセッサを組み合わせ、宇宙機の6自由度姿勢推定を低遅延・低消費電力で実現するパイプラインを提案・実証した。
原題: Efficient Onboard Spacecraft Pose Estimation with Event Cameras and Neuromorphic Hardware / Arunkumar Rathinam, Jules Lecomte, Jost Reelsen 他
日本語で読む → - 論文自動運転/ベンチマークロボティクス
EagleVision: 高速自動運転レースにおけるクロスドメイン知覚のためのマルチタスクベンチマーク
高速自動運転レース向けに、LiDARベースの3D検出と軌道予測を統合したマルチタスクベンチマークを新たに構築し、都市・シミュレータ・実レース間のドメイン転移性能を評価した。
原題: EagleVision: A Multi-Task Benchmark for Cross-Domain Perception in High-Speed Autonomous Racing / Zakhar Yagudin, Murad Mebrahtu, Ren Jin 他
日本語で読む → - 論文自動運転/歩行者インタラクションロボティクス
歩行者と自動運転車の「チキンゲーム」
自動運転車が歩行者に無条件に道を譲ると停止問題が起きるため、ゲーム理論のSequential Chickenモデルを用いて、実際の自動運転車と人間の被験者で実験し、歩行者の行動がこのモデルでよく説明できることを示した。
原題: Pedestrians play chicken with an autonomous vehicle / Rakshit Soni, Charles Fox
日本語で読む → - 論文ポーズ推定画像認識
Sylvester形式を用いた高効率な閉形式ポーズ推定手法
ポーズ推定の非線形最小二乗問題を多項式系に帰着させ、Sylvester形式を用いた閉形式解法を提案し、計算時間を短縮しつつ精度を維持することを示した。
原題: Efficient closed-form approaches for pose estimation using Sylvester forms / Jana Vráblíková, Ezio Malis, Laurent Busé
日本語で読む → - 論文触覚/品質検査画像認識
VitaTouch: 製造業におけるロボット品質検査のための特性認識型視覚-触覚-言語モデル
視覚情報だけでは困難な材料特性の推定と自然言語による属性記述を実現するため、視覚・触覚・言語を統合したモデルVitaTouchを提案し、データセットVitaSetを構築して性能を評価した。
原題: VitaTouch: Property-Aware Vision-Tactile-Language Model for Robotic Quality Inspection in Manufacturing / Junyi Zong, Qingxuan Jia, Meixian Shi 他
日本語で読む → - 論文遠隔操作ロボティクス
XRロボット遠隔操作のためのマルチビュー3Dテレプレゼンスシステム
3台のカメラから点群を生成し、手首カメラの高解像度映像を組み合わせることで、XRロボット遠隔操作の視覚体験を向上させるシステムを提案・評価した論文。
原題: A Multi-View 3D Telepresence System for XR Robot Teleoperation / Enes Ulas Dincer, Manuel Zaremski, Alexandra Nick 他
日本語で読む → - 論文VLAロボティクス
ProGAL-VLA: 予測的推論による視覚言語行動モデルの接地整合
視覚言語行動モデルが指示を無視する問題に対し、3Dエンティティ中心グラフとシンボリックサブゴール計画、接地整合損失を導入し、指示感度と曖昧さ検出を向上させた。
原題: ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models / Nastaran Darabi, Amit Ranjan Trivedi
日本語で読む → - 論文ナビゲーションロボティクス
AURA: 実世界の都市ナビゲーションのためのマルチモーダル共有自律
都市環境での長期的なナビゲーションを、人間の高レベル指示とAIの低レベル制御に分解する共有自律フレームワークAURAを提案。大規模データセットと実世界実験で、人間の操作負担を減らしつつナビゲーション安定性を向上させることを示した。
原題: AURA: Multimodal Shared Autonomy for Real-World Urban Navigation / Yukai Ma, Honglin He, Selina Song 他
日本語で読む → - 論文安全フィルタ/学習制御ロボティクス
ポントリャーギンの最大原理による予測的安全フィルタ学習のための境界サンプリング
安全制約を守るためのフィルタ学習において、危険境界付近の軌道をポントリャーギンの最大原理で特定し、効率的にデータ収集する手法を提案。自動車レースの共有制御実験で学習効率と安全性が向上した。
原題: Boundary Sampling to Learn Predictive Safety Filters via Pontryagin's Maximum Principle / James Dallas, Thomas Lew, John Talbot 他
日本語で読む → - 論文SLAM/協調マッピングロボティクス
MR.ScaleMaster: クラウドソースの単眼ビデオからのスケール一貫性のある協調マッピング
単眼カメラ映像をクラウドソースで集めて協調的に3次元再構成する際に生じるスケール崩壊とスケールドリフトという2つの問題を解決するシステムを提案した。
原題: MR.ScaleMaster: Scale-Consistent Collaborative Mapping from Crowd-Sourced Monocular Videos / Hyoseok Ju, Giseop Kim
日本語で読む → - 論文自律航法ロボティクス
ニューラル支援による移動中の自己方位整定
自律型海洋プラットフォームの初期方位推定を、モデルベース手法と同じ入力でニューラルネットワークを用いて高速かつ高精度に行う手法を提案した。実データで精度53%向上、整定時間67%短縮を達成。
原題: Neural-Assisted in-Motion Self-Heading Alignment / Zeev Yampolsky, Felipe O. Silva, Adriano Frutuoso 他
日本語で読む → - 論文VLAロボティクス
実現可能な行動近傍事前分布による視覚言語行動モデルのファインチューニング強化
ロボット操作では各状態にほぼ等価な行動の近傍が存在するが、既存のVLA訓練はこれを無視する。本研究では、この近傍構造をガウス事前分布でモデル化する正則化を導入し、サンプル効率と成功率を向上させた。
原題: Boosting Vision-Language-Action Finetuning with Feasible Action Neighborhood Prior / Haochen Niu, Kanyu Zhang, Shuyu Yin 他
日本語で読む → - 論文トラッキングロボティクス
マルチオブジェクト追跡におけるランク付き割当問題を解くグラフニューラルネットワーク手法
マルチオブジェクト追跡のデータ関連付けで生じるランク付き割当問題を、二部グラフを用いたグラフニューラルネットワーク(RAPNet)で解く手法を提案し、Gibbsサンプラーより高精度であることを示した。
原題: A Graph Neural Network Approach for Solving the Ranked Assignment Problem in Multi-Object Tracking / Robin Dehler, Martin Herrmann, Jan Strohbeck 他
日本語で読む → - 論文ベンチマーク/事故理解画像認識
CrashSight: 事故現場理解と推論のための位相認識型・インフラ中心ビデオベンチマーク
路側カメラ映像を用いた事故理解のための大規模ビジョン言語ベンチマークを構築し、既存のVLMが時間的・因果的推論に課題があることを示した。
原題: CrashSight: A Phase-Aware, Infrastructure-Centric Video Benchmark for Traffic Crash Scene Understanding and Reasoning / Rui Gan, Junyi Ma, Pei Li 他
日本語で読む → - 論文操作ロボティクス
ウィグル&ゴー!ゼロショット動的ロープ操作のためのシステム同定
ロープの動きを観察して物理パラメータを推定し、そのパラメータを用いて最適化によりロボットの動作を予測することで、実世界でゼロショットの動的ロープ操作を可能にする2段階フレームワークを提案した。
原題: Wiggle and Go! System Identification for Zero-Shot Dynamic Rope Manipulation / Arthur Jakobsson, Abhinav Mahajan, Karthik Pullalarevu 他
日本語で読む → - 論文歩行ロボティクス
足位置マップと安定性報酬を用いた四足ロボットの複雑地形歩行学習
四足ロボットの複雑地形歩行を強化学習で行う際、高さマップに足位置マップを統合し、動的安定性報酬を導入することで、正確で安定した歩行を実現した。
原題: Learning Locomotion on Complex Terrain for Quadrupedal Robots with Foot Position Maps and Stability Rewards / Matthew Hwang, Yubin Liu, Ryo Hakoda 他
日本語で読む → - 論文医用ロボティクス画像認識
SAMe: ロボット超音波のための意味的解剖マッピングエンジン
ロボット超音波の走査開始を支援するため、臨床症状から標的臓器を特定し、患者の外観画像から解剖学的表現を構築して、6自由度のプローブ初期化状態を生成する意味的解剖マッピングエンジンSAMeを提案した。
原題: SAMe: A Semantic Anatomy Mapping Engine for Robotic Ultrasound / Jing Zhang, Duojie Chen, Wentao Jiang 他
日本語で読む → - 論文オドメトリロボティクス
BIEVR-LIO: バンプ画像強化ボクセルマップによる堅牢なLiDAR-慣性オドメトリ
LiDAR-慣性オドメトリの精度低下や発散を防ぐため、ボクセルごとの高さ画像として表面を表現する高解像度マップと、幾何学的に情報量の多い領域に焦点を当てた点サンプリング戦略を提案した。
原題: BIEVR-LIO: Robust LiDAR-Inertial Odometry through Bump-Image-Enhanced Voxel Maps / Patrick Pfreundschuh, Turcan Tuna, Cedric Le Gentil 他
日本語で読む → - 論文3Dシーン理解画像認識
PLAF: ピクセル単位の言語整合特徴抽出による効率的な3Dシーン理解
2Dでピクセル単位の高精度な言語整合特徴を抽出し、冗長性を削減する効率的な保存・検索方式を設計することで、オープンボキャブラリ3Dシーン理解を実現するフレームワークを提案した。
原題: PLAF: Pixel-wise Language-Aligned Feature Extraction for Efficient 3D Scene Understanding / Junjie Wen, Junlin He, Fei Ma 他
日本語で読む → - 論文群制御ロボティクス
DC-Ada: 異種マルチロボットチームのための報酬のみを用いた分散センサ適応
事前学習済みの共有ポリシーを固定し、ロボットごとの観測変換を報酬のみで適応させることで、センサ構成の異なるロボットへの展開を可能にする手法を提案した。
原題: DC-Ada: Reward-Only Decentralized Sensor Adaptation for Heterogeneous Multi-Robot Teams / Saad Alqithami
日本語で読む → - 論文群制御ロボティクス
角度と自己変位計測を用いたマルチロボットシステムの3次元相対位置推定
ロボット間の内角と自己変位の計測に基づく3次元相対位置推定の新しい枠組みを提案し、線形アルゴリズムとMAP推定器を組み合わせてノイズ下での精度を向上させた。
原題: 3-D Relative Localization for Multi-Robot Systems with Angle and Self-Displacement Measurements / Chenyang Liang, Liangming Chen, Baoyi Cui 他
日本語で読む → - 論文MRインタラクションHCI
ポイント&グラスプ:確率的キューの統合による手の届かない物体の柔軟な選択
MR環境で手の届かない物体を選択する際、ポインティング方向と握りジェスチャを確率的に統合する新しい手法を提案し、精度と速度を向上させた。
原題: Point & Grasp: Flexible Selection of Out-of-Reach Objects Through Probabilistic Cue Integration / Xuejing Luo, Hee-Seung Moon, Christian Holz 他
日本語で読む → - 論文群制御ロボティクス
HECTOR: 継続的時相タスク下でのロボット群に対する人間中心の階層的協調と監督
大規模ロボット群を人間が効率的に監督・操作するための階層的な協調・監督スキームを提案し、動的環境でのタスク追加・変更に対応する。
原題: HECTOR: Human-centric Hierarchical Coordination and Supervision of Robotic Fleets under Continual Temporal Tasks / Shen Wang, Yinhang Luo, Jie Li 他
日本語で読む →