論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/26 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文飛行制御ロボティクス
安全かつ最適な飛行を目指して: 完全駆動マルチロータのための生存可能カーネルMPC
完全駆動マルチロータの安全な姿勢軌道生成を、生存可能性理論とデータ駆動手法を組み合わせたMPCフレームワークで実現し、障害物回避を動的バウンディングボックスで保証する手法を提案した。シミュレーションで実時間性能と安全性を検証した。
原題: Towards safe and optimal flight: Viability Kernel MPC for Fully Actuated Multirotor / Massimiliano Bertoni, Alberto Piccina, Gianni Lunardi 他
日本語で読む → - 論文動画生成画像認識
4DStreamCtrl: オンライン4D制御によるインタラクティブ動画生成
カメラと物体の動きを3D点トラックで統一し、リアルタイムで長い動画を生成できるモデルを提案した。
原題: 4DStreamCtrl: Interactive Video Generation with Online 4D Control / Shiqian Li, Chenguo Lin, Zhiguang Liu 他
日本語で読む → - 論文セグメンテーション画像認識
UAV画像の雑然シーンにおける通信鉄塔部品のゼロショットセグメンテーションのための顕著性-深度条件付け
UAV画像中の通信鉄塔部品を、顕著性と深度情報を用いて粗い塔の事前情報を構築し、Grounded-SAMやSAM 3と組み合わせることで、ゼロショットで高精度にセグメンテーションする手法を提案した。
原題: Saliency-Depth Conditioning for Zero-Shot Segmentation of Communication-Tower Components in Cluttered UAV Imagery / Ali Lesani, Chul Min Yeum, Su-Min Kang
日本語で読む → - 論文フィールドロボティクスロボティクス
障害物が曲がるとき:フィールドロボティクスにおける植生変形のモデル化
ロボットが植生と接触する際の変形を、ロボットに依存しない植生固有の機械的特性として推定し、植生を考慮したナビゲーションを実現する手法を提案した論文。
原題: When Obstacles Bend: Modeling Vegetation Deformation in the context of Field Robotics / Muhammad Hsaeeb Zaar Khizar, Tom Montagnon, Roland Lenain 他
日本語で読む → - 論文GNSS/深層学習ロボティクス
自己教師あり学習によるGNSSの可能性:深層学習強化PVTアルゴリズムの評価
密集した都市部でのマルチパス干渉を軽減するため、深層学習強化PVTアルゴリズムを提案し、自己教師あり事前学習で表現品質を向上させて測位精度を大幅に改善した。
原題: Opportunities of Self Supervised Learning for GNSS: Evaluation of a Deep Learning-Enhanced PVT Algorithm / Thomas Barbero, Bertrand Ekambi
日本語で読む → - 論文VLAロボティクス
一つのポリシー、多様な身体:異種具現化操作のためのカメラ中心の統一アクション幾何学事前学習
異なるロボット形態やカメラ設定をまたいで操作データを統一するため、カメラで観測可能なアンカー動作を共通のアクション表現として用いる新しいフレームワークUCAG-Pを提案。単一のVLAポリシーで複数のベンチマークを高精度に達成した。
原題: One Policy, Many Embodiments: Unified Camera-Centric Action Geometry Pre-training for Heterogeneous Embodied Manipulation / Xiaomi Embodied Intelligence Team, University of Macau, : 他
日本語で読む → - 論文VLA画像認識
V-Link: アクションDiTにおける失われた視覚表現の回復による視覚-言語-行動モデルの強化
VLAモデルのアクション専門家が視覚特徴を十分に活用できない問題を解決するため、VLM内に空間・意味クエリを学習し、非対称経路でAction DiTに注入するV-Linkを提案。ベンチマークで成功率を大幅に向上させた。
原題: V-Link: Recovering Lost Visual Representations in Action DiT for Vision-Language-Action Models / Yehao Lu, Jiarui Yang, Yuning Su 他
日本語で読む → - 論文UAVセキュリティ制御
SonicNudge: 推定器-制御器結合によるホバリングUAVの制御変位攻撃
超音波共振でジャイロスコープを微小に擾乱させ、姿勢推定バイアスを生じさせてホバリングUAVの位置をずらす新しい攻撃手法を提案・検証した論文。
原題: SonicNudge: Controlled Displacement of Hovering UAVs via Estimator-Controller Coupling / Shaocheng Luo, Ashir Raza, Haocheng Meng 他
日本語で読む → - 論文運動計画ロボティクス
最適制御のための分散前方ツリー探索:被覆性、複雑性、計算量
非線形システムの運動計画において、前方伝播に基づく決定論的で有限サンプルの準最適性を保証するプランナーを開発し、分散制御コマンドセットを用いた探索アルゴリズムDFT*を提案した。
原題: Dispersive Forward Tree Search for Optimal Control: Coverage, Complexity, and Computation / Shashank A. Deshpande, Jonathan P. How
日本語で読む → - 論文世界モデルロボティクス
WALL-SS: 次スケール自己回帰による長期的世界モデルのスケーリング
ロボットの視覚的未来予測をスケール単位の自己回帰で生成する世界モデルを提案し、行動制御可能で長期的なシミュレーションを実現した。
原題: WALL-SS: Scaling Long-horizon World Models via Next-Scale Autoregression / Maeve Zhang, Rain Sun, Xiang Wang 他
日本語で読む → - 論文交通予測AI
PhaseShift: 信号交差点を横断するトポロジー認識型データ調和とモデル統合
交差点ごとに別々に学習されていた交通行動モデルを、トポロジーを考慮した共通表現に調和させ、単一の再利用可能なバックボーンに統合するフレームワークを提案。複数交差点での評価で、局所モデルより長期的な予測精度が向上することを示した。
原題: PhaseShift: Topology-Aware Data Harmonization and Model Consolidation Across Signalized Intersections / Yash Ranjan, Artur Kumik, Rahul Sengupta 他
日本語で読む → - 論文移動予測ロボティクス
DESCENT: 空港地上移動予測のための有向エッジシーン符号化
空港地上の航空機移動予測のためのトランスフォーマー型アーキテクチャを提案し、潜在到達可能集合を用いた文脈サンプリングで精度を向上させた。
原題: DESCENT: Directed Edge Scene Encoding for Airport Surface Movement Prediction / Alexander Prutsch, David Schinagl, Horst Possegger
日本語で読む → - 論文VLAロボティクス
MA-VLA: 協調と構成的汎化のためのマルチアーム視覚言語行動モデル
複数アームの協調動作をアトミックな行動割り当てで分解し、訓練時にアームの役割をシャッフルすることで、未見の協調パターンへの汎化を実現するVLAモデルを提案した。
原題: MA-VLA: Multi-Arm Vision-Language-Action Model for Collaboration and Compositional Generalization / Zaibin Zhang, Junlan Xiao, Zhongbo Zhang 他
日本語で読む → - 論文オドメトリロボティクス
スーパーオドメトリ2.0:階層的適応による頑健なオドメトリ
環境劣化に応じてセンサ融合を動的に適応させる頑健なオドメトリフレームワークを提案。IMUをカメラやLiDARと同等に扱い、劣化時でも信頼性を確保する。
原題: SUPER ODOMETRY 2.0: Resilient Odometry via Hierarchical Adaptation / Shibo Zhao, Sifan Zhou, Yuchen Zhang 他
日本語で読む → - 論文動作計画ロボティクス
任意時点グローバルテンソル動作計画
任意のローカルプランナーを使えるようにGTMPを一般化し、任意時点で解を改善できる2つのポリシーを提案した。
原題: Anytime Global Tensor Motion Planning / Sai Coumar, An T. Le, Zachary Kingston
日本語で読む → - 論文手術映像生成画像認識
手術映像生成:拡散モデルからワールドモデルへの調査
手術映像生成の研究を、無条件生成・条件付き生成・ワールドモデル生成の3分類で整理し、ピクセル忠実度と臨床的妥当性のギャップや課題を明らかにしたサーベイ論文。
原題: Surgical Video Generation From Diffusion to World Models: A Survey / Fuxiang Huang, Chenxu Zhang, Liang Han 他
日本語で読む → - 論文知覚/把持計画ロボティクス
ロボット梱包のための低解像度認識
低コスト・低解像度の深度センサを用いたロボット梱包のためのスケーラブルな認識フレームワークを提案し、再構成の手がかりと把持の証拠を統合して次の視点選択と把持タイミングを決定する。
原題: Low-Resolution Perception for Robotic Packing / Giuseppe Fabio Preziosa, Federico Vignoni, Chiara Castellano 他
日本語で読む → - 論文群制御cs.MA
耐障害性マルチロボットシステムのための信頼考慮型逐次意思決定とロールアウト計画
GPSなりすまし攻撃を受ける可能性のあるマルチロボット経路計画問題に対し、信頼監視機構と階層的マッチング戦略を導入し、攻撃検出と耐障害性のあるルーティングを実現した。
原題: Trust-Aware Sequential Decision Making and Rollout Planning for Resilient Multi-Robot Systems / Roee M. Francos, Daniel Garces, Orhan Eren Akgün 他
日本語で読む → - 論文顕著物体検出画像認識
TDFNet:パノラマ顕著物体検出のための三投影変形融合ネットワーク
パノラマ画像の顕著物体検出において、等距離円筒投影や立方体マップ投影の幾何学的歪みを軽減するため、3つの投影表現を変形可能な注意機構と緯度ガイド融合で組み合わせたTDFNetを提案した。
原題: TDFNet: Tri-projection Deformable Fusion Network for Panoramic Salient Object Detection / Qiangqiang Zhou, Jiacong Yu, Jiawei Xu 他
日本語で読む → - 論文触覚/操作ロボティクス
TacForcing: 実行時触覚フィードバックによるストリーミング動作生成
接触を伴う操作タスクで、実行中に変化する触覚情報を動作生成に取り込む新しいフレームワークを提案。別の高周波コントローラを使わず、ストリーミング動作エキスパートと実行時触覚アテンションで性能を向上させた。
原題: TacForcing: Streaming Action Generation with Execution-Time Tactile Feedback / Jianbo Zhou, Boyuan Zhao, Yuzheng Zhang 他
日本語で読む → - 論文熱伝達モデリングロボティクス
急速変動条件下における産業用自動テープ積層プロセスの過渡マルチモード熱伝達
産業用自動テープ積層(ATL)プロセス向けに、放射・対流・伝導を統合した過渡熱伝達モデルを開発し、従来モデルの放射熱流束の過大評価を補正した。実機検証でNRMSE 1.08%の高精度を達成した。
原題: Transient multimode heat transfer of an industrial automated tape laying process under rapidly changing conditions / Bernhard Rameder, Hubert Gattringer, Andreas Müller 他
日本語で読む → - 論文VLAロボティクス
LM-X: 進捗・イベント・不確実性予測による説明可能な汎用ロボット操作の行動モデリング
汎用VLAポリシーに、タスク進捗・イベント遷移・局所信頼性を明示的に予測する3つの信号を導入し、制御に内在する説明可能性を実現した。大規模事前学習と実ロボットデータで高い成功率を達成した。
原題: LM-X: Explainable Action Modeling with Progress, Event, and Uncertainty Prediction for Generalist Robot Manipulation / Jin Lou, Jingxuan Zhu, Andong Chen 他
日本語で読む → - 論文VLA/3Dガウス/世界モデルロボティクス
GaussianDream++: ロボット操作のための効率的な3Dガウス世界モデリング
VLAポリシーに世界状態トークンと世界予測トークンを挿入し、訓練時のみ3Dガウス表現で現在と未来の世界を監督することで、推論時の追加コストなしに操作性能を向上させる手法を提案。
原題: GaussianDream++: Efficient 3D Gaussian World Modeling for Robotic Manipulation / Yuqing Jiang, Zijian Zhang, Weitao Zhou 他
日本語で読む → - 論文物理的HRI/適応制御ロボティクス
生成的アクションチャンクサンプリングによる物理的ヒューマンロボット協調における適応剛性制御
RGB画像と外部トルク推定に基づき、生成ポリシーが複数の未来アクションチャンクをサンプリングし、そのばらつきに応じて関節剛性と減衰を適応させる手法を提案。協調搬送タスクで成功率0.95を達成し、ばらつきが剛性調整のオンライン信号として有効であることを示した。
原題: Generative Action-Chunk Sampling for Adaptive Stiffness Control in Physical Human-Robot Collaboration / Aoi Otake, Ferdinand Hartmann, Ko Igari 他
日本語で読む → - 論文ロボットハンド/触覚ロボティクス
分散触覚知覚を備えた腱駆動5本指ハンドによる巧みな操作
腱駆動の5本指ハンドに分散触覚センサを統合し、柔軟性と操作力を両立させた設計を提案。ジェスチャーや把持などの実験で有効性を実証した。
原題: A Tendon-Driven Five-Fingered Hand with Distributed Tactile Perception for Dexterous Manipulation / Huayang Chen, Longhui Qin
日本語で読む → - 論文タスク計画ロボティクス
物体間アフォーダンスを活用した接触リッチタスクにおける効率的な計画
物体間の物理的相互作用を抽象化するアフォーダンスをVLMで生成し、TAMPの計画領域を拡張することで、接触を伴う複雑なタスクの計画成功率を向上させる手法を提案した。
原題: Leveraging Inter-object Affordances for Efficient Planning in Contact-rich Tasks / Pouya P. Niaz, Justus Piater, Alejandro Agostini
日本語で読む → - 論文3D再構成画像認識
PIVOT: 実世界3D再構成における姿勢・内部パラメータ・新視点評価のためのマルチ軌道データセットとテストベッド
ロボットやドローンが遭遇する現実的な条件下でのNeRFや3DGSの評価を目的に、多様なカメラ軌道で撮影したデータセットと評価フレームワークを構築し、軌道・姿勢・内部パラメータの影響を独立に分析できるベンチマークを提供した。
原題: PIVOT: A Multi-Trajectory Dataset and Testbed for Pose, Intrinsics, and Novel Viewpoint Evaluation in Real-World 3D Reconstruction / Mary Raymond
日本語で読む → - 論文自動運転ロボティクス
SkyDrive: 航空交通監視による新都市での自動運転学習
ドローンによる交通監視映像から運転行動を学習し、新環境への自動運転プランナーの適応を効率化するフレームワークを提案した。
原題: SkyDrive: Learning to Drive in a New City from Aerial Traffic Monitoring / Weijiang Xiong, Lan Feng, Alexandre Alahi 他
日本語で読む → - 論文パッキング/最適化ロボティクス
凸分解を用いた逐次物体配置最適化
物体配置を微分可能な非線形最適化問題として定式化し、凸包内の頂点制約を閉形式で計算することで、高速かつ高密度なパッキングを実現するフレームワークを提案した。
原題: Sequential Object Placement Optimization with Convex Decomposition / Yuezhe Zhang, Xiangyu Lyu, Sohan Rudra 他
日本語で読む → - 論文模倣学習ロボティクス
家庭環境における介護者との縦断的ロボット学習:デモンストレーションからの学習
家庭環境で非専門家の介護者がロボットにタスクを教える際の障壁を特定し、事前訓練と適応的フィードバックによる支援の効果を複数回の訪問を通じて評価した。
原題: Longitudinal Robot Learning from Demonstration with Care Providers in a Home Environment / Nina Moorman, Julianna Schalkwyk, Vriksha Srihari 他
日本語で読む →