論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/2/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
UniLACT: 深度認識RGB潜在行動学習による視覚-言語-行動モデル
RGBと深度の両方から統一的な潜在行動表現を学習し、それを擬似ラベルとしてVLAモデルを事前学習することで、空間認識を要するマニピュレーション精度を向上させた研究。
原題: UniLACT: Depth-Aware RGB Latent Action Learning for Vision-Language-Action Models / Manish Kumar Govind, Dominick Reilly, Pu Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
VCA: 曖昧な環境でセグメント化された物体を精密操作するための視覚-クリック-行動フレームワーク
言語指示の代わりにカメラ画像上で対象をクリックして指定し、セグメンテーションモデルと組み合わせてロボットの物体操作を正確に行うVCAフレームワークを提案した。
原題: VCA: Vision-Click-Action Framework for Precise Manipulation of Segmented Objects in Target Ambiguous Environments / Donggeon Kim, Seungwon Jan, Hyeonjun Park 他
日本語で読む → - 論文ヒューマノイド制御ロボティクス
OmniXtreme:高ダイナミックヒューマノイド制御における汎用性の壁を突破
多様なモーションの学習と実機向けの物理的調整を分離したフレームワークを提案し、ヒューマノイドが多様で高難度な動きを実機で高精度に追従できるようにした。
原題: OmniXtreme: Breaking the Generality Barrier in High-Dynamic Humanoid Control / Yunshen Wang, Shaohang Zhu, Peiyuan Zhi 他
日本語で読む → - 論文UAV検査ロボティクス
未マッピング送電鉄塔におけるUAVによる電力線碍子の自律検査
鉄塔の事前地図なしで、カメラとLiDARのセンサフュージョンにより碍子をオンライン検出・位置推定し、UAVが自律的に周回して詳細画像を取得する検査アルゴリズムを提案した。
原題: Autonomous Inspection of Power Line Insulators with UAV on an Unmapped Transmission Tower / Václav Riss, Vít Krátký, Robert Pěnička 他
日本語で読む → - 論文UAV探索ロボティクス
SCOPE: 骨格グラフに基づく計算効率の高い自律UAV探索フレームワーク
未知環境でのUAV探索において、リアルタイム骨格グラフと階層的計画により計算コストを平均86.9%削減しつつ高性能を実現するフレームワークを提案。
原題: SCOPE: Skeleton Graph-Based Computation-Efficient Framework for Autonomous UAV Exploration / Kai Li, Shengtao Zheng, Linkun Xiu 他
日本語で読む → - 論文VLAロボティクス
SignVLA: 手話によるロボット操作を実現するグロス不要の視覚言語行動フレームワーク
手話のグロス注釈を必要とせず、指文字のジェスチャーを直接ロボットの動作指令に変換するリアルタイムVLAシステムを提案した。
原題: SignVLA: A Gloss-Free Vision-Language-Action Framework for Real-Time Sign Language-Guided Robotic Manipulation / Xinyu Tan, Ningwei Bai, Harry Gardener 他
日本語で読む → - 論文GNSS/INS融合ロボティクス
等式・不等式制約を統合した二分岐型INS/GNSS融合
都市環境でのGNSS遮蔽時に、等号制約と不等式制約を分散重み付けで融合する二分岐型情報支援フレームワークを提案し、追加センサなしで車両ナビゲーションの精度を改善した。
原題: Dual-Branch INS/GNSS Fusion with Inequality and Equality Constraints / Mor Levenhar, Itzik Klein
日本語で読む → - 論文空力モデリングロボティクス
翼付き飛行船の二領域ハイブリッド空力モデリング:ニューラル混合によるアプローチ
翼付き飛行船の異なる空力領域を、固定翼モデルと抗力モデルをニューラルネットワークで混合するハイブリッドモデルで表現し、実機実験で有効性を検証した。
原題: Dual-Regime Hybrid Aerodynamic Modeling of Winged Blimps With Neural Mixing / Xiaorui Wang, Hongwu Wang, Yue Fan 他
日本語で読む → - 論文群制御ロボティクス
GNSSデータを活用したセルラー連携協調ロボットのSAR計画高度化
5G/6GネットワークとGNSSの地形データを利用し、捜索救助ミッションにおけるロボットの台数・経路・応答時間を最適化するフレームワークを提案した。
原題: Enhancing Cellular-enabled Collaborative Robots Planning through GNSS data for SAR Scenarios / Arnau Romero, Carmen Delgado, Jana Baguer 他
日本語で読む → - 論文能動SLAMロボティクス
Dream-SLAM: 動的環境における能動SLAMのための未観測領域の夢生成
部分的に観測された動的環境の時空間画像と意味構造を生成(夢見)し、実観測と融合することで、カメラ姿勢推定・3D地図生成・長期的な探索計画を改善する単眼能動SLAM手法を提案。
原題: Dream-SLAM: Dreaming the Unseen for Active SLAM in Dynamic Environments / Xiangqi Meng, Pengxu Hou, Zhenjun Zhao 他
日本語で読む → - 論文マニピュレーションロボティクス
視点が重要:マスク付きオートエンコーダによる視覚マニピュレーションのための動的視点最適化
単一カメラロボットにおいて、事前学習済みマルチビューマスク付きオートエンコーダを活用し、ラベルなしで最も情報量の多い視点を動的に選択するフレームワークMAE-Selectを提案。
原題: Viewpoint Matters: Dynamically Optimizing Viewpoints with Masked Autoencoder for Visual Manipulation / Pengfei Yi, Yifan Han, Junyan Li 他
日本語で読む → - 論文sim2realロボティクス
RoboCurate: 行動検証済みニューラル軌道による多様性を活かしたロボット学習
生成ビデオから得たロボット行動をシミュレータで再生し、映像との動きの一致度で品質を評価・選別する合成データ生成フレームワークを提案。実データのみの場合と比べ成功率を大幅に改善した。
原題: RoboCurate: Harnessing Diversity with Action-Verified Neural Trajectory for Robot Learning / Seungku Kim, Suhyeok Jang, Byungjun Yoon 他
日本語で読む → - 論文模倣学習ロボティクス
人間からロボットへの模倣学習:動画デモンストレーションからの操作スキル獲得
動画から操作動作と対象物体を抽出するVLMベースの理解モジュールと、TD3強化学習による模倣実行モジュールを組み合わせ、ロボットが非構造動画から操作スキルを学ぶパイプラインを提案した。
原題: Human-to-Robot Interaction: Learning from Video Demonstration for Robot Imitation / Thanh Nguyen Canh, Thanh-Tuan Tran, Haolan Zhang 他
日本語で読む → - 論文タスク計画ロボティクス
予測・適応・行動:タスク計画のためのハイブリッドフレームワーク
LLMの予測能力と確率的逐次意思決定を組み合わせ、人間の能力不足や物体欠如による失敗を予測・防止・回復するロボットタスク計画手法を提案。
原題: Anticipate, Adapt, Act: A Hybrid Framework for Task Planning / Nabanita Dash, Ayush Kaura, Shivam Singh 他
日本語で読む → - 論文3D再構成画像認識
BayesFusion-SDF: CPU上での視点計画を伴う確率的符号付距離融合
深度観測から疎なガウス確率場として形状を推定するCPU向けの確率的TSDF融合手法を提案し、不確実性を考慮した視点計画を可能にした。
原題: BayesFusion-SDF: Probabilistic Signed Distance Fusion with View Planning on CPU / Soumya Mazumdar, Vineet Kumar Rakesh, Tapas Samanta
日本語で読む → - 論文強化学習×軌道最適化ロボティクス
CACTO-BIC: バイアス付きサンプリングとGPU加速軌道最適化によるスケーラブルなアクター・クリティック学習
軌道最適化と強化学習を組み合わせたCACTOを改良し、価値関数に基づく初期状態サンプリングのバイアスとGPU加速により、サンプル効率と計算速度を向上させた。四足ロボットAlienGOでリアルタイム応用可能なスケーラビリティを示した。
原題: CACTO-BIC: Scalable Actor-Critic Learning via Biased Sampling and GPU-Accelerated Trajectory Optimization / Elisa Alboni, Pietro Noah Crestaz, Elias Fontanari 他
日本語で読む → - 論文Visual SLAMロボティクス
深層単眼Visual SLAMはスケール問題を克服したのか?ScaleMasterデータセットとベンチマーク
大規模屋内環境でのスケール一貫性を評価する初のベンチマークScaleMasterを提案し、最先端の深層単眼Visual SLAMがスケール関連の失敗を起こすことを定量的・定性的に示した。
原題: Have We Mastered Scale in Deep Monocular Visual SLAM? The ScaleMaster Dataset and Benchmark / Hyoseok Ju, Bokeon Suh, Giseop Kim
日本語で読む → - 論文UAV/位置推定画像認識
GPS拒否環境下のUAV向け高度適応型ビジョンのみの地理的位置推定
単眼の下向き画像から高度を推定し、その高度に応じて画像を正規化することで、高度差が大きい場合でも衛星・航空地図とのマッチング精度を高めるUAVの自己位置推定手法を提案。
原題: Altitude-Adaptive Vision-Only Geo-Localization for UAVs in GPS-Denied Environments / Xingyu Shao, Mengfan He, Liangzheng Sun 他
日本語で読む → - 論文強化学習/制御ロボティクス
アクションジャコビアンペナルティで滑らかな時変線形方策を学習
アクションの時間変化を自動微分で罰則化するアクションジャコビアンペナルティと、計算負荷を抑える線形方策ネットワークを提案し、滑らかな制御信号を生成する方策を学習する。
原題: Learning Smooth Time-Varying Linear Policies with an Action Jacobian Penalty / Zhaoming Xie, Kevin Karol, Jessica Hodgins
日本語で読む → - 論文HRIロボティクス
「こんにちは、配達中です。通してください」:混雑した都市街路でロボットと歩く公共経路ナビゲーション
公共空間を自律走行する配達ロボットを研究するため、都市民族誌の「同行観察」を応用したWalk-Along with Robots手法を提案し、その特徴・手順・評価方法を示した。
原題: "Hello, I'm Delivering. Let Me Pass By": Navigating Public Pathways with Walk-along with Robots in Crowded City Streets / EunJeong Cheon, Do Yeon Shin
日本語で読む → - 論文マニピュレーションロボティクス
SparTa: 少数のデモンストレーションからのスパースグラフィカルタスクモデル
少数のデモンストレーションから、物体間の関係をグラフで表現したタスクモデルを学習し、長期的なマニピュレーションタスクを実行する手法を提案。
原題: SparTa: Sparse Graphical Task Models from a Handful of Demonstrations / Adrian Röfer, Nick Heppert, Abhinav Valada
日本語で読む → - 論文医療ロボティクス/トレーニング評価ロボティクス
腹腔鏡トレーニング評価のための新型統合モーショントラッキングデバイス(IMTD):開発と検証
腹腔鏡手術トレーニング用に開発された4自由度の小型モーショントラッキングデバイスIMTDを提案し、モーションキャプチャシステムとの比較で精度と信頼性を検証した。低コストでボックストレーナーに統合可能であり、客観的なリアルタイムフィードバックによる手術技能評価への有用性を示した。
原題: A novel Integrated Motion Tracking Device (IMTD) for Objective Laparoscopic Training Assessment: Development and Validation / Siwar Bouzid, Abdelbadia Chaker, Marc Arsicault 他
日本語で読む → - 論文HRIデザインロボティクス
ロボット形態学の要素:ロボットの形状探索を支援するデザインフレームワーク
ロボットの形態を「知覚・関節・エンドエフェクタ・移動・構造」の5要素に分解するフレームワークと、それを体験的に探索できる tangible ブロックツールキットを提案し、デザインワークショップで有効性を示した。
原題: Elements of Robot Morphology: Supporting Designers in Robot Form Exploration / Amy Koike, Serena Ge Guo, Xinning He 他
日本語で読む → - 論文マルチモーダル/テスト時適応ロボティクス
触覚・視覚・言語モデルのためのテスト時適応
触覚・視覚・言語を統合したモデルがテスト時に分布変化に直面した際、各モダリティの信頼性を推定し、信頼性に基づいてサンプル選別・特徴融合・最適化を行う適応フレームワークを提案。
原題: Test-Time Adaptation for Tactile-Vision-Language Models / Chuyang Ye, Haoxian Jing, Qinting Jiang 他
日本語で読む → - 論文視覚サーボ/姿勢推定ロボティクス
内視鏡用連続体マニピュレータのマーカーレス6D姿勢推定と位置ベース視覚サーボ
内視鏡用連続体マニピュレータに対し、マーカーレスでステレオ画像から6D姿勢を推定し、その推定姿勢に基づく位置ベース視覚サーボを実現する統合フレームワークを提案した。実世界で平均並進誤差0.83mm・回転誤差2.76度の姿勢推定精度と、軌道追従で平均並進誤差2.07mm・回転誤差7.41度を達成した。
原題: Markerless 6D Pose Estimation and Position-Based Visual Servoing for Endoscopic Continuum Manipulators / Junhyun Park, Chunggil An, Myeongbo Park 他
日本語で読む → - 論文システム同定ロボティクス
制約と外乱下におけるシステム同定:ベイズ推定アプローチ
ロボットの状態軌道と物理パラメータを高精度に同時推定するベイズシステム同定フレームワークを提案し、シミュレーションと実機実験で従来法より優れた性能を示した。
原題: System Identification under Constraints and Disturbance: A Bayesian Estimation Approach / Sergi Martinez, Steve Tonneau, Carlos Mastalli
日本語で読む → - 論文マニピュレーションロボティクス
動的環境における粒子ベース知覚を用いた反応的動作生成
粒子ベースの動的マッピングとMPPI計画を組み合わせ、ロボットと障害物の動力学を同時に予測することで、動的環境での衝突回避性能を向上させる手法を提案した。
原題: Reactive Motion Generation With Particle-Based Perception in Dynamic Environments / Xiyuan Zhao, Huijun Li, Lifeng Zhu 他
日本語で読む → - 論文強化学習機械学習
未知の実行可能性を持つパラメータロバスト回避問題を強化学習で解く
強化学習を用いて、安全な方策が存在する初期条件の部分集合を特定しながら、その集合上で到達可能性問題を解く手法FGEを提案した。
原題: Solving Parameter-Robust Avoid Problems with Unknown Feasibility using Reinforcement Learning / Oswin So, Eric Yang Yu, Songyuan Zhang 他
日本語で読む → - 論文自律飛行ロボティクス
視覚ベース自律飛行のためのF'とROS2ハイブリッドアーキテクチャ:設計と実験的検証
NASAのF'フライトソフトウェアとROS2をProtocol Buffersで連携させ、屋内クアッドコプターの視覚ナビゲーション飛行実験でリアルタイム性能と統合の堅牢性を検証した。
原題: Hybrid F' and ROS2 Architecture for Vision-Based Autonomous Flight: Design and Experimental Validation / Abdelrahman Metwally, Monijesu James, Aleksey Fedoseev 他
日本語で読む → - 論文VLAロボティクス
ロボットのための選択的知覚:マルチモーダルVLAにおけるタスク適応型アテンション
手首カメラとテキスト指示から各視点のタスク関連度をリアルタイムに推定し、不要な視点の計算を抑制する動的融合フレームワークを提案。実機マニピュレーションで推論効率と制御性能の両方を改善した。
原題: Selective Perception for Robot: Task-Aware Attention in Multimodal VLA / Young-Chae Son, Jung-Woo Lee, Yoon-Ji Choi 他
日本語で読む →