論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文SLAM画像認識
VBGS-SLAM: 変分ベイズガウススプラッティングによる同時位置推定と地図構築
3Dガウススプラッティングを用いたSLAMにおいて、カメラ姿勢とシーン地図の不確実性を変分ベイズ推論で明示的に扱うことで、初期化への敏感さや忘却問題を軽減し、追跡性能とロバスト性を向上させた手法を提案した。
原題: VBGS-SLAM: Variational Bayesian Gaussian Splatting Simultaneous Localization and Mapping / Yuhan Zhu, Yanyu Zhang, Jie Xu 他
日本語で読む → - 論文海中ロボットロボティクス
DINO-Explorer: 自己運動補償型セマンティック予測符号化による能動的海底探査
海中ロボットが自己運動による見た目の変化を抑えつつ、生態学的に重要な事象をオンラインで検出するための新奇性認識フレームワークを提案した論文。
原題: DINO-Explorer: Active Underwater Discovery via Ego-Motion Compensated Semantic Predictive Coding / Yuhan Jin, Nayari Marie Lessa, Mariela De Lucas Alvarez 他
日本語で読む → - 論文ロボット学習ロボティクス
学習のためのチューニング:コントローラゲインがロボットポリシー学習をどう形作るか
ロボットの操作ポリシー学習における位置コントローラのゲイン設定が、学習アルゴリズム(模倣学習、強化学習、sim-to-real転移)に与える影響を体系的に調査し、最適なゲイン選択はタスクの特性ではなく学習パラダイムに依存することを示した論文。
原題: Tune to Learn: How Controller Gains Shape Robot Policy Learning / Antonia Bronars, Younghyo Park, Pulkit Agrawal
日本語で読む → - 論文位置認識画像認識
MPTF-Net: LiDAR位置認識のためのマルチビュー・ピラミッドTransformer融合ネットワーク
LiDARベースの位置認識において、NDTによるBEV表現とレンジ画像を多スケールのTransformerで融合し、高精度かつ高速な位置認識を実現した。
原題: MPTF-Net: Multi-view Pyramid Transformer Fusion Network for LiDAR-based Place Recognition / Shuyuan Li, Zihang Wang, Xieyuanli Chen 他
日本語で読む → - 論文移動操作ロボティクス
ANCHOR: 物理的に基盤を置いた閉ループフレームワークによる堅牢な家庭サービス移動操作
家庭環境での移動操作ロボットの実行失敗を、物理世界との不整合として捉え、物理的アンカーに基づくタスク計画、操作性を考慮したベース位置合わせ、最小責任層での階層的復旧を統合した閉ループフレームワークANCHORを提案する。
原題: ANCHOR: A Physically Grounded Closed-Loop Framework for Robust Home-Service Mobile Manipulation / Jinhao Jiang, Shengyu Fang, Sibo Zuo 他
日本語で読む → - 論文SLAM/協調マッピングロボティクス
MR.ScaleMaster: クラウドソースの単眼ビデオからのスケール一貫性のある協調マッピング
単眼カメラ映像をクラウドソースで集めて協調的に3次元再構成する際に生じるスケール崩壊とスケールドリフトという2つの問題を解決するシステムを提案した。
原題: MR.ScaleMaster: Scale-Consistent Collaborative Mapping from Crowd-Sourced Monocular Videos / Hyoseok Ju, Giseop Kim
日本語で読む → - 論文強化学習機械学習
水中自律航法のための強化学習におけるタスク特化サブネットワークの発見
事前学習済みのマルチタスク強化学習ネットワークの内部構造を解析し、タスク間の識別に使われる重みが全体の約1.5%で、その85%が入力層のコンテキスト変数ノードに接続していることを発見した。
原題: Task-specific Subnetwork Discovery in Reinforcement Learning for Autonomous Underwater Navigation / Yi-Ling Liu, Melvin Laux, Mariela De Lucas Alvarez 他
日本語で読む → - 論文群制御ロボティクス
対話強化型長期間協調視覚言語ナビゲーション DeCoNav
複数ロボットが対話で情報交換し、動的にタスクを再割り当て・再計画しながら長期間の協調ナビゲーションを行う枠組みを提案し、ベンチマークで成功率を大幅に向上させた。
原題: DeCoNav: Dialog enhanced Long-Horizon Collaborative Vision-Language Navigation / Sunyao Zhou, Yunzi Wu, Tianhang Wang 他
日本語で読む → - 論文継続学習/視覚位置認識ロボティクス
生涯航空自律性に向けて:動的環境における継続的視覚位置認識のための幾何学的メモリ管理
動的環境下での長期的な航空自律性を目指し、視覚位置認識モデルの継続学習における破滅的忘却を防ぐため、静的衛星アンカーと動的経験リプレイバッファを組み合わせた異種メモリフレームワークを提案した。
原題: Towards Lifelong Aerial Autonomy: Geometric Memory Management for Continual Visual Place Recognition in Dynamic Environments / Xingyu Shao, Zhiqiang Yan, Liangzheng Sun 他
日本語で読む → - 論文SLAMロボティクス
コンパクトなキーフレーム最適化によるマルチエージェントガウススプラッティングSLAM
マルチエージェントSLAMにおいて、3Dガウス表現の通信負荷を削減するため、冗長なガウスを除去する圧縮ステップと、中央集権的なループ閉じ込み計算を導入し、データ転送量を最大95%削減するフレームワークを提案した。
原題: Compact Keyframe-Optimized Multi-Agent Gaussian Splatting SLAM / Monica M. Q. Li, Pierre-Yves Lajoie, Jialiang Liu 他
日本語で読む → - 論文ベンチマーク/事故理解画像認識
CrashSight: 事故現場理解と推論のための位相認識型・インフラ中心ビデオベンチマーク
路側カメラ映像を用いた事故理解のための大規模ビジョン言語ベンチマークを構築し、既存のVLMが時間的・因果的推論に課題があることを示した。
原題: CrashSight: A Phase-Aware, Infrastructure-Centric Video Benchmark for Traffic Crash Scene Understanding and Reasoning / Rui Gan, Junyi Ma, Pei Li 他
日本語で読む → - 論文VLA/操作ロボティクス
CodeGraphVLP: コードによる計画とセマンティックグラフ状態を組み合わせた非マルコフ型視覚言語行動モデル
長期的なロボット操作タスクにおいて、セマンティックグラフ状態とコードベースのプランナーを組み合わせ、視覚言語行動モデルの実行を支援する階層的フレームワークを提案した。
原題: CodeGraphVLP: Code-as-Planner Meets Semantic-Graph State for Non-Markovian Vision-Language-Action Models / Khoa Vo, Sieu Tran, Taisei Hanyu 他
日本語で読む → - 論文触覚HCI
不均一な層状構造がヒトの柔らかさ知覚を調整できる
3Dプリントした層状構造体を用いて、層の硬さ分布が触覚的な柔らかさ知覚に与える影響を心理物理実験で調べた。最外層の柔らかさが最も強く知覚に影響し、深部の層の影響は減衰することを示した。
原題: Heterogeneous Layered Structures Can Modulate Human Softness Perception / Yuno Higuchi, Yosuke Iwashita, Yuji Ohgi 他
日本語で読む → - 論文自動運転/通信ロボティクス
インテリジェント車両のためのグリッドマップ効率的伝送手法の解析
パッチベースのグリッドマップを圧縮アルゴリズムを用いて効率的に伝送するパイプラインを提案し、車内およびV2X通信での性能を実世界実験で解析した。
原題: Analysis of Efficient Transmission Methods of Grid Maps for Intelligent Vehicles / Robin Dehler, Dominik Authaler, Aryan Thakur 他
日本語で読む → - 論文データセットロボティクス
VRUD: 混在交通における複雑な車両と脆弱な道路利用者の相互作用のためのドローンデータセット
都市部の無秩序な環境での自動運転研究のために、ドローンで撮影した脆弱な道路利用者(VRU)と車両の相互作用データセットVRUDを構築した。
原題: VRUD: A Drone Dataset for Complex Vehicle-VRU Interactions within Mixed Traffic / Ziyu Wang, Hongrui Kou, Cheng Wang 他
日本語で読む → - 論文最適化/接触ロボティクス
構成による相補性: 線形相補性制約付き二次計画問題を解くリー群アプローチ
ロボティクスにおける接触問題をモデル化する線形相補性制約付き二次計画問題(LCQP)を、相補性制約がリー群を形成する性質を利用してオン多様体最適化で解く新しいソルバーを提案した。
原題: Complementarity by Construction: A Lie-Group Approach to Solving Quadratic Programs with Linear Complementarity Constraints / Arun L. Bishop, Micah I. Reich, Zachary Manchester
日本語で読む → - 論文制御制御
縮約法を用いたリー群上のニューラルロバスト制御(拡張版)
リー群上で動く力学系に対し、ロバスト制御縮約計量とニューラルフィードバック制御器を同時学習し、多様体の幾何学的制約を保ちつつ外乱に対する軌道の管を保証する制御器を合成する手法を提案した。クアッドローターの制御器設計を事例として、数値シミュレーションで性能を評価した。
原題: Neural Robust Control on Lie Groups Using Contraction Methods (Extended Version) / Yi Lok Lo, Longhao Qian, Hugh H. T. Liu
日本語で読む → - 論文ソフトロボティクス/適応機構ロボティクス
ZipFold: スケーラブルな適応ロボットのためのモジュール式アクチュエータ
3Dプリントされた柔軟なストリップを折りたたみ・ジッパー状に結合して、コンパクトで柔軟な状態と拡張された準剛体状態を切り替えられるアクチュエータを提案し、4モジュールの適応歩行ロボットで実証した。
原題: ZipFold: Modular Actuators for Scaleable Adaptive Robots / Niklas Hagemann, Daniela Rus
日本語で読む → - 論文自動運転/VLA画像認識
UniDriveVLA:自動運転のための理解・知覚・行動計画の統合
自動運転向けのVLAモデルにおいて、空間知覚と意味推論の競合を解消するため、Mixture-of-Transformersによる専門家分離を導入した統合モデルUniDriveVLAを提案し、nuScenesとBench2Driveで最先端性能を達成した。
原題: UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving / Yongkang Li, Lijun Zhou, Sixu Yan 他
日本語で読む → - 論文安全性評価ロボティクス
JailWAM: ロボット制御におけるワールドアクションモデルの脱獄
ワールドアクションモデル(WAM)の安全性リスクを評価する初の脱獄フレームワークJailWAMを提案。視覚軌跡マッピングとリスク判別器、二重経路検証により、悪意ある指示による不安全なロボット動作を効率的に検出する。
原題: JailWAM: Jailbreaking World Action Models in Robot Control / Hanqing Liu, Songping Wang, Jiahuan Long 他
日本語で読む → - 論文VLAAI
Rule-VLN:意味推論と幾何補正による知覚とコンプライアンスの橋渡し
ルール遵守ナビゲーションのための大規模都市ベンチマークRule-VLNを構築し、事前学習済みエージェントに安全意識を付与するゼロショットモジュールSNRMを提案した。
原題: Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification / Jiawen Wen, Penglei Sun, Wenjie Zhang 他
日本語で読む → - 論文音源定位eess.AS
ASAP: 平面マイクロホンアレイの3次元音源方向推定のための方位角優先ストリップ探索法
平面マイクロホンアレイでの3次元音源方向推定を高速化するため、方位角を優先的に絞り込む2段階探索手法を提案した。
原題: ASAP: An Azimuth-Priority Strip-Based Search Approach to Planar Microphone Array DOA Estimation in 3D / Ming Huang, Shuting Xu, Leying Yang 他
日本語で読む → - 論文運動計画ロボティクス
未知非線形ダイナミクス下での予測到達可能性に基づく階層的運動計画と制御
未知の非線形システムに対して、区分的アフィンモデルと到達制御理論を用いた階層的計画・制御フレームワークを提案し、オンラインで運動生成を行う。
原題: Hierarchical Motion Planning and Control under Unknown Nonlinear Dynamics via Predicted Reachability / Zhiquan Zhang, Melkior Ornik
日本語で読む → - 論文VLA/触覚/マニピュレーションロボティクス
視覚言語行動モデルへの物理フィードバック統合のためのモジュール型感覚ストリーム
視覚言語行動モデル(VLA)に触覚やトルクなどの複数の物理センサ信号を統合するモジュール型フレームワークを提案し、実世界実験で性能向上を実証した。
原題: Modular Sensory Stream for Integrating Physical Feedback in Vision-Language-Action Models / Jimin Lee, Huiwon Jang, Myungkyu Koo 他
日本語で読む → - 論文軌道計画ロボティクス
行動スコア拡散:カーネルベースのスコア推定によるモデルフリー軌道計画
事前収集した軌道データからカーネル重み付き推定で拡散スコアを直接計算し、モデルや学習なしで軌道計画を行う手法を提案した。
原題: Behavioral Score Diffusion: Model-Free Trajectory Planning via Kernel-Based Score Estimation from Data / Shihao Li, Jiachen Li, Jiamin Xu 他
日本語で読む → - 論文筋骨格ロボット/共設計/進化計算ロボティクス
完全な筋肉の進化:筋骨格系移動のための効率的な形態-制御共設計
筋骨格ロボットの形態と制御を同時に最適化する手法を提案し、PCAと対称性を利用した低次元進化により、複雑な地形での移動性能を向上させた。
原題: Evolving the Complete Muscle: Efficient Morphology-Control Co-design for Musculoskeletal Locomotion / Lidong Sun, Wentao Zhao, Ye Wang 他
日本語で読む → - 論文リアルタイムシステム制御
Raspberry Pi 5上のPREEMPT_RT LinuxにおけるUAV飛行制御ワークロードのスケジューリング解析
Raspberry Pi 5上でPREEMPT_RT Linuxカーネルを用いたUAV飛行制御のリアルタイム性を解析し、標準カーネルでは9ms超の遅延が発生するのに対し、PREEMPT_RTにより最悪遅延を88%削減して225マイクロ秒未満に抑えられることを示した。
原題: Scheduling Analysis of UAV Flight Control Workloads on PREEMPT_RT Linux Using a Raspberry Pi 5 / Luiz Giacomossi, Håkan Forsberg, Ivan Tomasic 他
日本語で読む → - 論文動画生成画像認識
MoRight: モーション制御を正しく行う
ユーザー指定の動作で物体の動きを制御しつつ、カメラ視点も自由に変えられる動画生成フレームワークを提案。能動的動作と受動的反応を分離して因果関係を学習し、順方向・逆方向の推論を可能にした。
原題: MoRight: Motion Control Done Right / Shaowei Liu, Xuanchi Ren, Tianchang Shen 他
日本語で読む → - 論文群制御ロボティクス
群れサイズ変動がオペレータの作業負荷に与える影響
人間と群ロボットのチーム運用において、群れサイズの増減がオペレータの主観的作業負荷に与える影響を実験で調査した。小さな増加は負荷を低く保つが、小さな減少は負荷を高く維持し、大きな変化はリセット効果をもたらすことを示した。
原題: Effects of Swarm Size Variability on Operator Workload / William Hunt, Aleksandra Landowska, Horia A. Maior 他
日本語で読む → - 論文モバイルマニピュレーション/HRIロボティクス
ExpressMM: 人間とロボットのインタラクションにおける表現豊かなモバイル操作行動
本論文では、モバイルマニピュレータが人間と協調作業中に意図を表現するためのフレームワークExpressMMを提案し、視覚言語モデルと視覚言語行動ポリシーを統合して、中断可能な対話を実現した。
原題: ExpressMM: Expressive Mobile Manipulation Behaviors in Human-Robot Interactions / Souren Pashangpour, Haitong Wang, Matthew Lisondra 他
日本語で読む →