論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文センシングロボティクス
サブセンチメートル精度のフィールド水位モニタリング向け低コストレーダーセンサー
商用レーダーセンサーを実環境で評価し、統計フィルタリングによりセンチメートル精度の水位推定を実現した。ドローンやロボットによる自律的水位監視への応用可能性を示す。
原題: Cost-Effective Radar Sensors for Field-Based Water Level Monitoring with Sub-Centimeter Accuracy / Anna Zavei-Boroda, J. Toby Minear, Kyle Harlow 他
日本語で読む → - 論文マニピュレーションロボティクス
厳しい運用・制御制約下における油圧インパクトハンマーのデータ駆動制御
テレオペデータから油圧アームの動的モデルを教師あり学習で同定し、RLとMPCでエンドエフェクタを目標姿勢へ到達させる制御器を構築、実機で検証した。
原題: Data-driven control of hydraulic impact hammers under strict operational and control constraints / Francisco Leiva, Claudio Canales, Michelle Valenzuela 他
日本語で読む → - 論文医療ロボティクスロボティクス
合成データを用いた追従型ロボット内視鏡ナビゲーションのための強化学習
単眼深度推定と強化学習を組み合わせ、合成データで訓練した追従型柔軟内視鏡ロボットの自律ナビゲーション手法を提案。
原題: Reinforcement Learning for Follow-the-Leader Robotic Endoscopic Navigation via Synthetic Data / Sicong Gao, Chen Qian, Laurence Xian 他
日本語で読む → - 論文制御制御
AMC26: ロバスト位置制御のための高性能外乱オブザーバ
離散時間領域で設計した高次打ち切り誤差を考慮する新しい外乱オブザーバを提案し、従来法より推定精度とロバスト性を向上させた。
原題: AMC26: High-performance DOb for robust position control / Emre Sariyildiz
日本語で読む → - 論文経路計画ロボティクス
2Dから3Dへの地形追従型エリアカバレッジ経路計画
農作業機の作業幅と作業高さを保ちながら3D地形に沿った複数の隣接経路を生成するアルゴリズムを提案し、実データで検証した。
原題: From 2D to 3D terrain-following area coverage path planning / Mogens Plessen
日本語で読む → - 論文義手制御ロボティクス
人工神経網とスライディングモード制御を組み合わせた義手手首のハイブリッド制御
人工神経網とスライディングモード制御を組み合わせ、腱駆動ソフト連続手首の高速応答と計算負荷低減を実現する制御器を開発し、シミュレーションと実験で検証した。
原題: A Hybrid Model-based and Data-based Approach Developed for a Prosthetic Hand Wrist / Shifa Sulaiman, Francesco Schetter, Mehul Menon 他
日本語で読む → - 論文自律飛行ロボティクス
FlyCo: 基盤モデルを活用したドローンによるオープンワールド環境での自律的3D構造スキャン
テキストや視覚的指示から、基盤モデルを活用した知覚・予測・計画ループにより、未知環境でドローンが対象構造物を自律的に3Dスキャンするシステムを提案。
原題: FlyCo: Foundation Model-Empowered Drones for Autonomous 3D Structure Scanning in Open-World Environments / Chen Feng, Guiyong Zheng, Tengkai Zhuang 他
日本語で読む → - 論文RFセンシングロボティクス
RF-MatID: 無線周波数による材料識別のためのデータセットとベンチマーク
4〜43.5GHzの広帯域RFデータ14.2万サンプルを収集し、深層学習モデルによる材料識別のベンチマークを構築した研究。
原題: RF-MatID: Dataset and Benchmark for Radio Frequency Material Identification / Xinyan Chen, Qinchun Li, Ruiqin Ma 他
日本語で読む → - 論文自己位置推定cs.IT
LED照明型ARマーカーによる可視光通信を用いたロボット自己位置推定
ArUcoマーカーの白黒パターンをLEDの点滅周波数で表現し、人間には自然な照明に見えるままカメラで位置推定できる可視光通信手法を提案した。
原題: Visible Light Communication using Led-Based AR Markers for Robot Localization / Wataru Uemura, Shogo Kawasaki
日本語で読む → - 論文テレオペレーションロボティクス
静的タスクだけでは不十分:VRとSpaceMouseによる静的・動的テレオペレーションタスクの比較研究
VRコントローラとSpaceMouseを静的・動的タスクで比較し、VRが成功率・作業時間・主観的負荷で優れることを示し、動的タスク向けVRインタフェースを公開した。
原題: Static Is Not Enough: A Comparative Study of VR and SpaceMouse in Static and Dynamic Teleoperation Tasks / Yijun Zhou, Muhan Hou, Kim Baraka
日本語で読む → - 論文UAV着陸ロボティクス
機敏なUAV着陸のための双方向適応フレームワーク
移動プラットフォームが自ら傾いて最適な着陸姿勢を作り、ドローンと協調して着陸を並列化する双方向協調着陸フレームワークを提案した。
原題: A Bi-directional Adaptive Framework for Agile UAV Landing / Chunhui Zhao, Xirui Kao, Yilin Lu 他
日本語で読む → - 論文マニピュレーションロボティクス
汎化可能な幾何学的事前知識と再帰スパイキング特徴学習によるヒューマノイドロボットマニピュレーション
視覚言語モデルに軽量な2D幾何学的バイアスを組み込み、再帰スパイキングネットワークで時空間一貫性を学習することで、未見環境での汎化と少ない実演からのデータ効率的な動作生成を実現した。
原題: Generalizable Geometric Prior and Recurrent Spiking Feature Learning for Humanoid Robot Manipulation / Xuetao Li, Wenke Huang, Mang Ye 他
日本語で読む → - 論文認知モデリングAI
能動的センシングが動的な証拠蓄積を通じて実世界の意思決定を形作る
運転シーンにおいて、眼球運動から能動的センシングを捉え、証拠の利用可能性が注意配分や意思決定傾向に与える影響を明らかにした。
原題: Active Sensing Shapes Real-World Decision-Making through Dynamic Evidence Accumulation / Hongliang Lu, Yunmeng Liu, Junjie Yang
日本語で読む → - 論文VLA画像認識
UAV映像理解のためのBLIP-2を用いたエッジ最適化マルチモーダル学習
BLIP-2にYOLO-WorldとYOLOv8-Segを組み合わせ、キーフレーム選定とプロンプト最適化により、UAVのエッジ機器でも動作する軽量なマルチモーダル映像理解プラットフォームを提案した。
原題: Edge-Optimized Multimodal Learning for UAV Video Understanding via BLIP-2 / Yizhan Feng, Hichem Snoussi, Jing Teng 他
日本語で読む → - 論文マニピュレーションロボティクス
Mixture-of-Experts拡散ポリシーによるロボットマニピュレーションスキルの抽象化
拡散ポリシーをマルチタスクに拡張するため、直交スキル基底を学習し、スティッキールーティングで必要な専門家のみを活性化するMixture-of-Expertsポリシーを提案。シミュレーションと実機で高い成功率と低推論コストを実現。
原題: Abstracting Robot Manipulation Skills via Mixture-of-Experts Diffusion Policies / Ce Hao, Xuanran Zhai, Yaohua Liu 他
日本語で読む → - 論文マニピュレーションロボティクス
TacUMI:接触の多いタスクのためのマルチモーダル汎用マニピュレーションインターフェース
手持ちデモ装置UMIに触覚・力覚・姿勢センサを統合し、接触の多い作業のマルチモーダルデータを収集できるようにした。さらに時系列モデルで作業を意味のある区間に分割する手法を提案し、ケーブル取付タスクで90%以上の分割精度を達成した。
原題: TacUMI: A Multi-Modal Universal Manipulation Interface for Contact-Rich Tasks / Tailai Cheng, Kejia Chen, Lingyun Chen 他
日本語で読む → - 論文ロボティクス/倉庫自動化ロボティクス
最大容量のグリッド型ストレージにおけるロバストな順不同取出し
グリッド型自動倉庫で、取出し順が保存時に想定した順序から最大k個ずれる場合でも、荷物の移動が不要になる条件を理論的に示し、その配置を計算する手法を提案した論文。
原題: Robust Out-of-Order Retrieval for Grid-Based Storage at Maximum Capacity / Tzvika Geft, William Zhang, Jingjin Yu 他
日本語で読む → - 論文VLAロボティクス
VLAgents: VLA推論を効率化するポリシーサーバ
VLAモデルの推論を統一プロトコルで抽象化し、共有メモリと圧縮ストリーミングで通信を最適化するモジュラーポリシーサーバを提案。
原題: VLAgents: A Policy Server for Efficient VLA Inference / Tobias Jülg, Khaled Gamal, Nisarga Nilavadi 他
日本語で読む → - 論文マニピュレーションロボティクス
ニューラル配置空間距離場による移動マニピュレータの高速かつ安全な軌道最適化
移動マニピュレータの全身衝突回避を配置空間で直接モデル化するGCDFを提案し、GPUバッチ処理可能なニューラル距離場と逐次凸最適化により高速・安全な軌道生成を実現した。
原題: Fast and Safe Trajectory Optimization for Mobile Manipulators With Neural Configuration Space Distance Field / Yulin Li, Zhiyuan Song, Yiming Li 他
日本語で読む → - 論文GNSS/月探査physics.space-ph
月域における複数コンステレーションの航法衛星信号の初観測:L1/L5 IQスナップショットの後処理による検証
月周回・月面で取得したIQスナップショットを後処理し、GPSやGalileo以外の複数コンステレーションの信号を月距離で初めて検出。追加コンステレーションが測位可能な衛星数を大幅に増やすことを示した。
原題: First Multi-Constellation Observations of Navigation Satellite Signals in the Lunar Domain by Post-Processing L1/L5 IQ Snapshots / Lorenzo Sciacca, Alex Minetto, Andrea Nardin 他
日本語で読む → - 論文sim2realロボティクス
MATTERIX:ロボティクス支援化学実験室自動化のためのデジタルツイン
化学実験室の高忠実度デジタルツインを構築するGPU加速マルチスケールロボットシミュレーションフレームワークを提案し、ロボット操作・粉体/液体動力学・熱伝達・化学反応を統合してsim-to-real転移を実証した。
原題: MATTERIX: toward a digital twin for robotics-assisted chemistry laboratory automation / Kourosh Darvish, Arjun Sohal, Abhijoy Mandal 他
日本語で読む → - 論文マッピングロボティクス
視点依存ローカルマップのグラフを用いたキーフレームベースの高密度マッピング
RGB-Dセンサのデータから視点依存のNDTローカルマップを更新し、ポーズグラフに保存してループ閉じ込め後に大域地図を補正するキーフレームベースのマッピング手法を提案。
原題: Keyframe-based Dense Mapping with the Graph of View-Dependent Local Maps / Krzysztof Zielinski, Dominik Belter
日本語で読む → - 論文3Dモデル検索画像認識
OSCAR: 言語プロンプトと単一画像からのオープンセットCAD検索
言語プロンプトと1枚の画像から、未ラベルの3Dモデルデータベースを検索して対応するCADモデルを訓練なしで見つける手法を提案。
原題: OSCAR: Open-Set CAD Retrieval from a Language Prompt and a Single Image / Tessa Pulli, Jean-Baptiste Weibel, Peter Hönig 他
日本語で読む → - 論文キャリブレーションロボティクス
DST-Calib: 二重経路・自己教師あり・ターゲット不要のLiDAR-カメラ外部キャリブレーションネットワーク
LiDARとカメラの外部キャリブレーションを、専用ターゲットや高精度正解ラベルなしでオンライン実行できる自己教師ありネットワークを提案。両側データ拡張と差分マップ構築により、汎化性能と精度を向上させた。
原題: DST-Calib: A Dual-Path, Self-Supervised, Target-Free LiDAR-Camera Extrinsic Calibration Network / Zhiwei Huang, Yanwei Fu, Yi Zhou 他
日本語で読む → - 論文sim2realロボティクス
StyleID-CycleGANによるSim-to-Real転移:視覚ドメイン適応を用いたロボットマニピュレータへのゼロショット展開
仮想環境の画像を実写風に変換するStyleID-CycleGANを提案し、仮想で訓練した強化学習エージェントを実機で追加学習なしに動かすゼロショット転移を産業用ロボットのピック&プレースで実証した。
原題: Sim-to-Real Transfer via a Style-Identified Cycle Consistent Generative Adversarial Network: Zero-Shot Deployment on Robotic Manipulators through Visual Domain Adaptation / Lucía Güitta-López, Lionel Güitta-López, Jaime Boal 他
日本語で読む → - 論文マルチエージェント強化学習ロボティクス
構造化・非構造化空域における間隔確保のためのTransformerベースマルチエージェント強化学習
相対極座標状態空間でTransformerエンコーダを訓練し、多様な交通パターンと交差角に適応する航空機の間隔確保手法を提案。単一エンコーダ構成が深い構成より優れ、衝突リスクをほぼゼロにした。
原題: Transformer-based Multi-agent Reinforcement Learning for Separation Assurance in Structured and Unstructured Airspaces / Arsyi Aziz, Peng Wei
日本語で読む → - 論文群制御ロボティクス
CHORAL: 異種ロボット群の安全で効率的な経路計画のための走行性を考慮した計画手法
偵察飛行から得た意味地図を用いて各ロボットの走行能力を考慮し、異種ロボット群の巡回経路とタスク割当を同時に計画する枠組みを提案。
原題: CHORAL: Traversal-Aware Planning for Safe and Efficient Heterogeneous Multi-Robot Routing / David Morilla-Cabello, Eduardo Montijano
日本語で読む → - 論文異種コンピューティング/ニューロモルフィックcs.NE
実時間ロボティクスのための異種コンピューティングプラットフォーム
ニューロモルフィックプロセッサLoihi2とイベントカメラ、GPUクラスタを組み合わせた異種計算アーキテクチャを提案し、ヒューマノイドロボットが人間と楽器を演奏する対話タスクで実証した。
原題: Heterogeneous computing platform for real-time robotics / Jakub Fil, Yulia Sandamirskaya, Hector Gonzalez 他
日本語で読む → - 論文マニピュレーションロボティクス
自律フォークリフトの長期的マルチゴールタスクのための異種マルチエキスパート強化学習
倉庫での自律フォークリフトの長期的タスクを、ナビゲーションとマニピュレーションの専門家に分け、模倣学習と強化学習を組み合わせて効率的に学習するフレームワークを提案。
原題: Heterogeneous Multi-Expert Reinforcement Learning for Long-Horizon Multi-Goal Tasks in Autonomous Forklifts / Yun Chen, Bowei Huang, Fan Guo 他
日本語で読む → - 論文VLAAI
Cosmos Policy: 視覚運動制御と計画のための動画モデル微調整
大規模事前学習済み動画モデルを、アーキテクチャ変更なしの一段階の追加学習だけでロボット方策に変換し、行動・将来画像・価値を潜在フレームとして生成して計画も可能にした手法。
原題: Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning / Moo Jin Kim, Yihuai Gao, Tsung-Yi Lin 他
日本語で読む →