論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文ナビゲーションロボティクス
事前学習ビジョンモデルを用いた衝突時間に基づく非構造環境での動的障害物回避
実データのみで動作する、事前学習済みの単眼深度推定と特徴点追跡を用いた動的障害物回避手法を提案し、衝突時間を計算して回避動作を生成する。
原題: Time-to-Collision Based Dynamic Obstacle Avoidance Using Pretrained Vision Models for Robots in Unstructured Environments / Erik Jagnandan, Mulugeta Haile, Gregory Barber 他
日本語で読む → - 論文把持ロボティクス
単眼視覚に基づく把持のための制御フレームワーク
RGB画像のみを用いて、柔軟物体と剛体物体の両方を単一の制御パイプラインで把持するための、言語ベースの剛性推定と視覚的変形モニタリングを組み合わせたフレームワークを提案した。
原題: Monocular Vision Based Control Framework for Grasping / Shail Jadav, Dongheui Lee
日本語で読む → - 論文協調SLAM/プライバシー保護ロボティクス
CILC: マルチエージェント協調SLAMのための暗号学的に安全なエージェント間ループ閉じ込み候補検出
協調SLAMにおいて、悪意のあるエージェントによるプライバシー漏洩を防ぐため、秘密計算を用いてグローバル記述子を公開せずにループ閉じ込み候補を検出する手法を提案した。
原題: CILC: Cryptographically-secure Inter-agent Loop Closure Candidate Detection for Multi-Agent Collaborative SLAM / Andrew Fishberg, Yixuan Jia, Jonathan P. How
日本語で読む → - 論文データセットロボティクス
SinD 2.0:信号交差点におけるSOTIF指向の安全検証のための意味的リスク注釈付きマルチシティUAVデータセット
本論文は、複数都市の信号交差点を対象としたドローン撮影による大規模データセットSinD 2.0を紹介し、安全検証に必要な意味的リスク注釈と高密度の危険事象を提供する。
原題: SinD 2.0: A Multi-City UAV Dataset with Semantic Risk Annotations for SOTIF-Oriented Safety Validation at Signalized Intersections / Yunwei Li, Shengjie Fu, Chunrong Chen 他
日本語で読む → - 論文視覚言語ナビゲーションロボティクス
FSD-VLN: 空中長距離視覚言語ナビゲーションのための高速・低速デュアルシステムモデリング
UAVの長距離ナビゲーション向けに、意味推論と低遅延飛行制御を分離した高速・低速デュアルシステムアーキテクチャを提案し、未見シーンでの成功率を2倍に向上させつつ推論遅延を50%以上削減した。
原題: FSD-VLN: Fast-Slow Dual-System Modeling for Aerial Long-Horizon Vision-Language Navigation / Xueke Zhu, Qingyan Meng, Liutao Yu 他
日本語で読む → - 論文群制御ロボティクス
平坦性を保つ残差学習によるリアルタイム密接クワッドローター編隊飛行
クワッドローターの密接編隊飛行で問題となる空力干渉を、物理情報を組み込んだ残差学習で補償しつつ、システムの微分平坦性を維持することで、計算効率の高いフィードバック線形化制御を実現した。ハードウェア実験で追従誤差を31%削減し、NMPCと同等の性能を1桁少ない計算量で達成した。
原題: Flatness-Preserving Residual Learning for Real-Time Tight Quadrotor Formation Flight / Pei-An Hsieh, Fengjun Yang, Nikolai Matni 他
日本語で読む → - 論文プライバシー保護画像認識
顔を交換し特徴を守る:ITSにおける歩行者プライバシーのための二目的パイプライン
自動運転車向けデータセットで歩行者のプライバシーを保護するため、顔交換を行いながら識別に必要な顔属性を維持する5段階パイプラインを提案し、RoopとGhost-v2の顔交換モデルを比較評価した。
原題: Swapping Faces, Saving Features: A Dual-Purpose Pipeline for Pedestrian Privacy in ITS / Roba H. Farouk, Catherine M. Elias
日本語で読む → - 論文VLAcs.MA
早めに共有し、後で節約する:帯域制約下の協調VLNにおける同期駆動通信ゲーティング
帯域制約のある協調視覚言語ナビゲーション(VLN)において、通信の重要度を事後的にラベル付けする軽量な教師付きゲートを提案し、エピソード初期の自信がある状態での通信が効果的であることを示した。
原題: Early to Share, Late to Save: Synchronisation-Driven Communication Gating in Bandwidth-Constrained Cooperative VLN / Arav Gupta, Nivedan Yakolli, Avinash Gautam
日本語で読む → - 論文カメラモーション生成ロボティクス
LIME: 一人称視点ビデオから意図を考慮したカメラモーションを学習する
ロボットが自然言語の指示に基づいて次に観察すべきカメラの相対姿勢を生成する手法を提案。一人称ビデオから多様な意図とカメラ動作のペアを学習し、観察利得の予測と連続的なフローマッチングによる姿勢生成を組み合わせる。
原題: LIME: Learning Intent-aware Camera Motion from Egocentric Video / Boyang Sun, Jiajie Li, Yung-Hsu Yang 他
日本語で読む → - 論文水中ロボット/動作計画/冗長性ロボティクス
過アクチュエーション水中ロボットの冗長性を活用した外乱を考慮した動作計画による高忠実度3次元再構成
8スラスタの水中ロボットで、同じ動作を実現する冗長な推力配分の中から、対象領域への外乱を最小化する配分をリアルタイムに探索し、3次元再構成の精度を大幅に向上させた。
原題: Disturbance-aware Motion Planning for Over-actuated Underwater Vehicles Exploiting Actuation Redundancy for High-fidelity 3D Reconstruction / Yuer Gao, Tongqing Xu, Qingyang Liu 他
日本語で読む → - 論文力推定ロボティクス
変形ツール操作における文脈認識型力推定:数ショット連続適応によるロボット環境拭き取り
変形するツールを使ったロボットの拭き取り作業で、手首の力センサーから実際の接触力を推定するデータ駆動フレームワークを提案。LSTMと数ショット適応で環境変化に強く、誤差を最大63%削減した。
原題: Context-Aware Force Estimation for Deformable Tool Manipulation in Robotic Environmental Swabbing via Few-Shot Continual Adaptation / Siavash Mahmoudi, Chaitainya Kuppar Reddy, Yang Tian 他
日本語で読む → - 論文社会的アフォーダンスロボティクス
エージェント活用アフォーダンス:基本から複雑な表現パターンへ
ロボットが他エージェントとの協調によって行動可能性を拡張する「協調アフォーダンス」の概念を定義し、人工エージェントが利用可能なオントロジー表現を提案した。基本パターンを組み合わせて多様なシナリオを表現できることを示した。
原題: Agent-Exploitation Affordances: From Basic to Complex Representation Patterns / Bastien Dussard, Aurélie Clodic, Guillaume Sarthou
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
遅延を考慮した能動三角測量:不確実性駆動型マルチエージェント強化学習による対UAS応用
対UASのためのマルチエージェント能動視覚三角測量において、遅延を明示的に扱う強化学習フレームワークを提案し、Age-of-Informationと不確実性伝播を導入して精度と安定性を向上させた。
原題: Delay-Aware Active Triangulation with Uncertainty-Driven Multi-Agent Reinforcement Learning for Counter-UAS / Seungwook Lee, David Hyunchul Shim
日本語で読む → - 論文位置推定ロボティクス
不確実性から決定論へ:レイマッチングを介さない粗密段階的ビジュアルフロアプラン位置推定
本論文は、画像とフロアプランを用いた屋内位置推定において、従来のレイマッチングを介さず、粗密段階的アプローチで多峰性の位置分布を扱う手法を提案している。粗段階では画像条件付き拡散モデルで候補位置を生成し、密段階では局所的な残差を推定して高精度な位置を決定する。
原題: From Uncertainty to Determinism: Coarse-to-Fine Visual Floorplan Localization without Ray Matching / Shiyong Meng, Bolei Chen, Ping Zhong 他
日本語で読む → - 論文VLA/強化学習ロボティクス
最適輸送Q学習によるフローポリシーの操縦と高速化
ロボットの経験を用いたRL後訓練により、準最適なフローベースポリシーを微調整・高速化する最適輸送Q学習(OTQL)を提案した。
原題: Optimal Transport Q-Learning for Flow Policy Steering and Acceleration / Andreas Sochopoulos, Esmeralda S. Whitammer, Nikolaos Tsagkas 他
日本語で読む → - 論文移動支援ロボティクスロボティクス
実世界応用に向けた自律型パワードホイールチェアの研究
市販の自立型パワードホイールチェアにRGB-DカメラとLiDARを統合し、手を挙げて呼び寄せる機能と人追従機能を実装した実証研究。
原題: Towards Real-World Applications with an Autonomous Powered Wheelchair / Simone Arreghini, Alessandro Giusti, Alex Bordini 他
日本語で読む → - 論文リハビリテーションロボティクス
DRBA: 動的ロボットバランスアシスト -- 多様な訓練のためのアシスト・アズ・ニーデッド歩行・バランスリハビリテーションロボット
加齢や病態によるバランス低下に対し、骨盤支持用3自由度ロボットアームと起立補助モジュールを統合した歩行訓練ロボットDRBAを開発し、透明性の高い支援と患者9名での有効性を示した。
原題: DRBA: Dynamic Robotic Balance Assistant -- An assist-as-needed gait and balance rehabilitation robot for versatile training / Yifan Wang, Li Li, Youlong Wang 他
日本語で読む → - 論文マニピュレーション画像認識
散乱した収納作業におけるブレード挿入のための3Dアフォーダンス学習
散乱した布製ビン内でブレードを挿入する空間を確保するため、3D占有フィールド上のマスク付きオートエンコーダを用いて、各ボクセルでブレードの挿入可能性を推定する手法を提案した。実データ10,000エピソードで訓練し、従来のポーズベース手法より高い被覆率を達成した。
原題: Learning 3D Affordances for Blade Insertion in Cluttered Stowing / Tianyu Li, Harpreet Sawhney, Minju Jung 他
日本語で読む → - 論文VLAロボティクス
跳ぶ前に見よ:凍結VLAモデルのためのツリー探索を行動評価へ蒸留する
凍結したVision-Language-Actionモデルの出力分布から有望な行動を選ぶため、シミュレーションでのモンテカルロ木探索で得た知識を軽量なQ値モデルに蒸留し、不確実性を考慮した評価で行動を選択するフレームワークSVAを提案した。
原題: Look Before You Leap: Distilling Tree Search into Action Evaluation for Frozen VLA Models / Xinyi Xie, Zican Hu, Zhanyu Liu 他
日本語で読む → - 論文シミュレーションcs.MA
LOTUSim: 海洋ロボティクスのためのマルチドメインシミュレータ
海洋ロボティクス向けのオープンソースのリアルタイムシミュレータLOTUSimを提案。空中・水上・水中のロボット群を対象に、人間参加型の対話と物理的に忠実な環境を実現し、大規模な異種ドローン群でもリアルタイム性能を維持する。
原題: LOTUSim: Multi-Domain Simulator for Marine Robotics / Cédric Buche, Juliette Grosset, Hélène Lechêne 他
日本語で読む → - 論文触覚ロボティクス
金属超音波導波路を用いた分散型触覚センシングプラットフォーム:接触位置特定、力推定、材料識別
金属製の超音波導波路を単一の変換器で読み取る分散型触覚センサを提案し、接触位置・力・材料の識別が可能であることを実験で示した。
原題: Metallic Ultrasound Waveguides as a Distributed Tactile Sensing Platform for Contact Localization, Force Estimation, and Material Class Discrimination / Alexandros Rosakis, Alessio Tamborini, Basile Fakhoury 他
日本語で読む → - 論文ナビゲーションロボティクス
具現化視覚言語ナビゲーションの包括的サーベイと体系的実世界評価
視覚と言語によるナビゲーション(VLN)の研究を体系的に分類し、物理ロボットでの実世界評価を行った。シミュレーションと実世界の性能差を明らかにし、階層的フレームワークの堅牢性を示した。
原題: A Comprehensive Survey and Systematic Real-World Evaluation of Embodied Vision-and-Language Navigation / Liuyi Wang, Kai Sheng, Zongtao He 他
日本語で読む → - 論文ナビゲーションロボティクス
GDPR準拠の軌道共有:ISAC支援ロボットナビゲーションにおけるFID制約付き衝突予測のケーススタディ
ISAC環境でのロボット衝突回避において、Fisher情報量密度に基づき軌道データを摂動させて共有する手法を提案し、GDPRのデータ最小化と完全性要件を満たしつつ、プライバシーとユーティリティのトレードオフを改善することを実証した。
原題: GDPR-Aware Trajectory Sharing for ISAC-Assisted Robot Navigation: A Case Study on FID-Constrained Collision Prediction / Zexin Fang, Bin Han, Donglin Wang 他
日本語で読む → - 論文VLAロボティクス
HiMe: 長期的視覚言語行動制御のための階層的具現化メモリ
長期的なタスクで苦戦するVLAモデルに対し、実行・作業記憶・計画を分離した階層メモリフレームワークを提案し、成功率を向上させた。
原題: HiMe: Hierarchical Embodied Memory for Long-Horizon Vision-Language-Action Control / Li Ji, Siyin Wang, Pengfang Qian 他
日本語で読む → - 論文群制御ロボティクス
階層型ハイブリッド物理情報深層強化学習による異種マルチロボットシステムの高精度フォーメーション制御
モデル誤差や外乱に強い高精度なフォーメーション制御を実現するため、物理モデルと深層強化学習を階層的に組み合わせたフレームワークを提案し、実験で100%の成功率を達成した。
原題: High-Precision Formation Control for Heterogeneous Multi-Robot Systems via Hierarchical Hybrid Physics-Informed Deep Reinforcement Learning / Yanzhou Li, Guangli Chen, Xiao-Meng Li 他
日本語で読む → - 論文群制御ロボティクス
未知環境・未知パートナー・規模変動に対応するマルチロボットのオープン適応型チーミング
ロボットチームが未知の環境や仲間、チーム規模の変化に同時に適応する問題を定式化し、ハイパーグラフゲーム理論に基づく学習アルゴリズムHOLAを提案。実機実験で有効性を確認した。
原題: Multi-Robot Open Adaptive Teaming Across Unseen Environments, Partners, and Scales / Yang Li, Feng Xue, Fan Mo 他
日本語で読む → - 論文ナビゲーションロボティクス
SE(2)ナビゲーションメッシュ:姿勢依存の走行可能性を考慮した多層環境向け経路計画
複雑な多層環境での地上ロボットのナビゲーションのために、姿勢(ヨー角)依存の走行可能性を符号化した多角形表現SE(2) NavMeshを提案し、階層的なA*経路探索とオンライン更新手法を開発した。
原題: SE(2) Navigation Mesh / Shuyang Shi, Kaixian Qu, Changan Chen 他
日本語で読む → - 論文SLAM画像認識
DL-VINS-Factory: 視覚慣性SLAMにおける学習型ビジュアルフロントエンドのためのモジュール式フレームワーク
学習型特徴抽出器と追跡/マッチング手法を統合した視覚慣性SLAMのフレームワークを提案し、複数データセットで性能を評価した。
原題: DL-VINS-Factory: A Modular Framework for Learned Visual Front-Ends in Visual-Inertial SLAM / Shoon Kit Lim, Melissa Jia Ying Chong, Ting Yang Ling
日本語で読む → - 論文ナビゲーションロボティクス
群衆ロボットナビゲーションのための社会的選好学習
オフライン強化学習を用いた群衆ロボットナビゲーションにおいて、詳細な報酬設計を不要にする社会的選好学習アルゴリズムを提案し、シミュレーションと実機で有効性を検証した。
原題: SPLC: Social Preference Learning for Crowd Robot Navigation / Zixuan Chen, Hao Fu, Haiwen Hu 他
日本語で読む → - 論文制御ロボティクス
QuadRocket: ロケット型車両の適応推力ベクトル制御のための空中ロボットテストベッド
クアッドロータを推力ベクトルアクチュエータとして用いたロケット型プロトタイプを提案し、適応バックステッピング制御と動的サーフェス制御を組み合わせて軌道追従と外乱補償を実現した。
原題: QuadRocket: An Aerial Robotic Testbed for Adaptive Thrust-Vector Control of Rocket-Like Vehicles / Pedro Santos, Joel Reis, Paulo Oliveira 他
日本語で読む →