論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文学習支援オンラインアルゴリズムcs.DS
直線上のオンライン巡回修理人問題に対する学習支援アルゴリズム
直線上のオンライン巡回修理人問題において、機械学習によるリクエスト位置の予測を活用する学習支援フレームワークを初めて適用し、予測が正確な場合に競合比2+√3を達成する決定論的アルゴリズムを提案した。
原題: Learning-Augmented Online TRP on a Line / Swapnil Guragain, Gokarna Sharma
日本語で読む → - 論文SLAM画像認識
PointSLAM++: ロバストな高密度ニューラルガウス点群ベースSLAM
階層的に制約されたニューラルガウス表現と漸進的な姿勢最適化を用いて、深度ノイズに強く高精度なRGB-D SLAMを実現した研究。
原題: PointSLAM++: Robust Dense Neural Gaussian Point Cloud-based SLAM / Xu Wang, Boyao Han, Xiaojun Chen 他
日本語で読む → - 論文自動運転ロボティクス
身体性知能運転のための大規模マルチモーダルモデル:自動運転の次のフロンティア
大規模マルチモーダルモデル(LMM)と深層強化学習を組み合わせた意味・方策の二重駆動型ハイブリッド意思決定フレームワークを提案し、車線変更計画タスクで有効性を検証した。
原題: Large Multimodal Models for Embodied Intelligent Driving: The Next Frontier in Self-Driving? / Long Zhang, Yuchen Xia, Bingqing Wei 他
日本語で読む → - 論文場所認識画像認識
WHU-PCPR: 複雑な都市環境での場所認識のためのクロスプラットフォーム異種点群データセット
異なるプラットフォームやLiDARセンサで取得した点群を用いた場所認識研究のための、大規模で多様なシーンを含むクロスプラットフォーム異種点群データセットを構築し、代表的な手法の評価と課題を議論した。
原題: WHU-PCPR: A cross-platform heterogeneous point cloud dataset for place recognition in complex urban scenes / Xianghong Zou, Jianping Li, Yandi Yang 他
日本語で読む → - 論文マニピュレーションcs.GR
DexterCap:巧みな手と物体の操作を捉える低コスト自動キャプチャシステム
手指の自己遮蔽に強いコード化マーカーと自動再構成パイプラインにより、低コストで巧みな手内操作を光学キャプチャするシステムを提案し、多様な操作行動を含むデータセットDexterHandを公開した。
原題: DexterCap: An Affordable and Automated System for Capturing Dexterous Hand-Object Manipulation / Yutong Liang, Shiyi Xu, Yulong Zhang 他
日本語で読む → - 論文HRIロボティクス
健康行動変容のための説得的ソーシャルロボット設計:行動変容戦略と評価手法の系統的レビュー
健康行動変容を促すソーシャルロボットのHRI研究39件を分析し、用いられた行動変容戦略を4カテゴリに整理するとともに、評価手法の特徴を明らかにして今後の研究方向を提案した。
原題: Designing Persuasive Social Robots for Health Behavior Change: A Systematic Review of Behavior Change Strategies and Evaluation Methods / Jiaxin Xu, Chao Zhang, Raymond H. Cuijpers 他
日本語で読む → - 論文マニピュレーションロボティクス
ジャストインタイム情報木:可操作度を考慮した漸近最適動作計画
サンプリングベースの動作計画を改良し、エッジ接続とサンプリング密度を動的に調整して初期経路を高速に発見しつつ、可操作度と軌道コストのバランスを取るJIT*を提案した。
原題: Just in time Informed Trees: Manipulability-Aware Asymptotically Optimized Motion Planning / Kuanqi Cai, Liding Zhang, Xinwen Su 他
日本語で読む → - 論文SLAM画像認識
VGGT-SLAM 2.0:リアルタイム高密度フィードフォワードシーン再構成
VGGTを用いたサブマップ統合型SLAMを改良し、ドリフト除去・ループ閉じ込み改善・Jetson Thor上での実時間動作を実現したシステム。
原題: VGGT-SLAM 2.0: Real-time Dense Feed-forward Scene Reconstruction / Dominic Maggio, Luca Carlone
日本語で読む → - 論文筋電位/トルク推定ロボティクス
sEMGを用いた関節トルク推定における軽量ニューラルネットワークのための特徴抽出パイプライン
8チャンネルの表面筋電位から肘と肩の関節トルクを予測する特徴抽出パイプラインを提案し、単純なMLPでも時間依存性を考慮したTCNと同等の性能を達成できることを示した。
原題: A Feature Extraction Pipeline for Enhancing Lightweight Neural Networks in sEMG-based Joint Torque Estimation / Kartik Chari, Raid Dokhan, Anas Homsi 他
日本語で読む → - 論文UAV/情報計画ロボティクス
離散ガウス過程表現を用いたUAV雑草マッピングのための能動的情報計画
UAVによる雑草マッピングにおいて、ガウス過程の離散化手法の違いが地図品質とミッション性能に与える影響を調査し、情報に基づく経路計画を実装した研究。
原題: Active Informative Planning for UAV-based Weed Mapping using Discrete Gaussian Process Representations / Jacob Swindell, Marija Popović, Riccardo Polvara
日本語で読む → - 論文人間ロボット協調ロボティクス
知覚から記号的タスク計画へ:視覚言語モデルによる人間とロボットの協調構造組立
視覚言語モデルでRGB-D観測を設計仕様と照合して組立状態を記号化し、人間の介入に応じて最小変更で再計画する人間協調型組立フレームワークを提案した。
原題: From Perception to Symbolic Task Planning: Vision-Language Guided Human-Robot Collaborative Structured Assembly / Yanyi Chen, Min Deng
日本語で読む → - 論文触覚ロボティクス
視覚遮蔽下における変形可能な線状物体の能動的視触覚クロスモーダル知覚
視覚的に隠れたケーブルをSAMと触覚センサで能動的に探索し、視覚と触覚の点群を融合して3D形状を再構成するフレームワークを提案した。
原題: Active Cross-Modal Visuo-Tactile Perception of Deformable Linear Objects / Raffaele Mazza, Ciro Natale, Pietro Falco
日本語で読む → - 論文着地衝撃吸収ロボティクス
着地時に生じる擬人化足関節構造の粘弾性変化は足構造と姿勢によって調整される
人間の足の骨格形状を模した多関節構造を作製し、着地時の衝撃に対する粘弾性応答が骨格構造と姿勢によってどう変わるかを調べた。その結果、アーチ状の多関節構造は単純な平板や剛体足より衝撃を吸収し、足首や足指の角度が減衰と反発のバランスを調整できることが示された。
原題: Landing-Induced Viscoelastic Changes in an Anthropomimetic Foot Joint Structure are Modulated by Foot Structure and Posture / Satoru Hashimoto, Yinlai Jiang, Hiroshi Yokoi 他
日本語で読む → - 論文VLAロボティクス
DroneVLA:視覚言語行動モデルによる空中マニピュレーション
自然言語の指示を理解するVLAモデルとGrounding DINOを組み合わせ、1自由度グリッパ付きドローンが対象物を把持し人へ受け渡すシステムを構築した。実機実験で位置推定・ナビゲーションの精度を検証した。
原題: DroneVLA: VLA based Aerial Manipulation / Fawad Mehboob, Monijesu James, Amir Habel 他
日本語で読む → - 論文VLAロボティクス
AC^2-VLA: 行動文脈を考慮した適応的計算による効率的なロボットマニピュレーション
VLAモデルの推論における時間・空間・深さ方向の冗長性に着目し、行動文脈に基づいて計算を適応的に再利用・削減するフレームワークを提案。密なモデルと同等の成功率を保ちつつ最大1.79倍の高速化とFLOPs29.4%削減を実現した。
原題: AC^2-VLA: Action-Context-Aware Adaptive Computation in Vision-Language-Action Models for Efficient Robotic Manipulation / Wenda Yu, Tianshi Wang, Fengling Li 他
日本語で読む → - 論文経路計画ロボティクス
精密農業におけるUGVのための深層強化学習を用いた経路計画最適化
精密農業向け無人地面車両の経路計画を深層強化学習で最適化し、動的環境でTD3エージェントが95%の成功率を達成した。
原題: Optimizing Path Planning using Deep Reinforcement Learning for UGVs in Precision Agriculture / Laukik Patade, Rohan Rane, Sandeep Pillai
日本語で読む → - 論文クロスエンボディメントロボティクス
CEI: 3D空間におけるクロスエンボディメント視覚運動方策学習のための統合インターフェース
異なるロボットアームやエンドエフェクタ間で実演データを転移し、未見の形態でも方策学習を可能にするフレームワークCEIを提案。機能類似性に基づく軌道アライメントで、シミュレーションと実機での双方向転移を実現した。
原題: CEI: A Unified Interface for Cross-Embodiment Visuomotor Policy Learning in 3D Space / Tong Wu, Shoujie Li, Junhao Gong 他
日本語で読む → - 論文深度推定画像認識
UAV林業における樹枝の深度推定のゴールドスタンダードに向けて:深層ステレオマッチング手法のベンチマーク
8つのステレオ深度推定手法を4つの標準ベンチマークと新規の樹枝データセットでゼロショット評価し、DEFOMが植生環境で最も頑健であることを示した。
原題: Towards Gold-Standard Depth Estimation for Tree Branches in UAV Forestry: Benchmarking Deep Stereo Matching Methods / Yida Lin, Bing Xue, Mengjie Zhang 他
日本語で読む → - 論文VLAロボティクス
ActiveVLA: 能動的知覚を視覚-言語-行動モデルに統合した高精度3Dロボットマニピュレーション
静的な手首カメラに頼る従来のVLAモデルに対し、重要領域の特定と能動的な視点選択・3Dズームインを行う2段階の枠組みを導入し、長期的・微細な操作精度を向上させた。
原題: ActiveVLA: Injecting Active Perception into Vision-Language-Action Models for Precise 3D Robotic Manipulation / Zhenyang Liu, Yongchong Gu, Yikai Wang 他
日本語で読む → - 論文マニピュレーションロボティクス
安定した手から学ぶ:顕微鏡下でのロボット支援のための弱教師ありエージェント
顕微鏡下でのロボット微細操作において、較正を考慮した知覚とアドミタンス制御を融合した弱教師ありフレームワークを提案し、手動の奥行き注釈なしで高精度な位置決めを実現した。
原題: Learning From a Steady Hand: A Weakly Supervised Agent for Robot Assistance under Microscopy / Huanyu Tian, Martin Huber, Lingyun Zeng 他
日本語で読む → - 論文フィールドマッピングロボティクス
テイラー展開によるロボットフィールドマッピングの位置推定誤差補正:ガウス過程を用いた手法
ガウス過程によるフィールドマッピングで、ロボットの位置推定誤差が予測精度を低下させる問題に対し、カーネル関数の微分可能性を利用した2次補正アルゴリズムを提案し、シミュレーションで精度と計算効率の向上を示した。
原題: A Taylor Series Approach to Correct Localization Errors in Robotic Field Mapping using Gaussian Processes / Muzaffar Qureshi, Tochukwu Elijah Ogri, Kyle Volle 他
日本語で読む → - 論文無線品質予測cs.NI
MapViT: 動的環境におけるリアルタイム無線品質マップ予測のための2段階ViTベースフレームワーク
大規模言語モデルの事前学習・微調整パラダイムに着想を得て、環境変化と無線信号品質を予測する2段階のVision Transformerフレームワークを提案し、移動ロボット向けのリアルタイム予測を実現した。
原題: MapViT: A Two-Stage ViT-Based Framework for Real-Time Radio Quality Map Prediction in Dynamic Environments / Cyril Shih-Huan Hsu, Xi Li, Lanfranco Zanzi 他
日本語で読む → - 論文自動運転ロボティクス
LLM駆動のシナリオ認識型自動運転プランニング
大規模言語モデルを活用してシーンを理解し、モード切替と運動計画を統合最適化する自動運転プランナーLAPを提案。高密度交通下での走行効率と安全性を両立。
原題: LLM-Driven Scenario-Aware Planning for Autonomous Driving / He Li, Zhaowei Chen, Rui Gao 他
日本語で読む → - 論文支援ロボティクスロボティクス
いつ支援すべきか:支援ロボティクスにおける信頼性の高い人間意図予測のための校正済み信頼度
日常生活動作における次行動予測の信頼度を事後校正し、信頼度が高いときだけ支援を実行するACT/HOLDルールを提案した。
原題: When to Act: Calibrated Confidence for Reliable Human Intention Prediction in Assistive Robotics / Johannes A. Gaus, Winfried Ilg, Daniel Haeufle
日本語で読む → - 論文義手制御ロボティクス
代償効果増幅制御(CEAC):上肢義手の肘における位置と速度の協調制御のための動作ベースアプローチ
体幹の屈伸運動を入力として義手の肘の速度を制御する新しい制御パラダイムCEACを提案し、健常者12名による描画タスクと10名による多点リーチングタスクで評価した。自然な腕の動きに匹敵する性能と人間工学的な体幹姿勢を実現した。
原題: Compensation Effect Amplification Control (CEAC): A movement-based approach for coordinated position and velocity control of the elbow of upper-limb prostheses / Julian Kulozik, Nathanaël Jarrassé
日本語で読む → - 論文動作計画ロボティクス
安全な自動運転に向けて:組み込みハードウェア上でのリアルタイム動作計画アルゴリズム
自動車グレードの組み込みプラットフォームとRTOS上で軽量なサンプリングベース軌道プランナを実装し、決定論的なタイミングと低遅延で動作することを実験的に示した。
原題: Towards Safe Autonomous Driving: A Real-Time Motion Planning Algorithm on Embedded Hardware / Korbinian Moller, Glenn Johannes Tungka, Lucas Jürgens 他
日本語で読む → - 論文SLAMロボティクス
AnyLoc視覚的位置認識によるDPV-SLAMのループ閉じ込み改善
DPV-SLAMのループ検出を従来のBoVWから深層特徴を用いるAnyLocに置き換え、環境に応じて類似度閾値を自動調整する仕組みを導入することで、屋内・屋外でのループ閉じ込み精度とロバスト性を向上させた。
原題: Loop Closure using AnyLoc Visual Place Recognition in DPV-SLAM / Wenzheng Zhang, Kazuki Adachi, Yoshitaka Hara 他
日本語で読む → - 論文制御/オンライン学習ロボティクス
未知パラメータの安全なオンライン学習のためのパラメータロバストMPPI
パラメータの不確かさに対処するため、オンライン学習と確率的な安全制約を統合したMPPI制御フレームワークを提案し、シミュレーションと実機で有効性を示した。
原題: Parameter-Robust MPPI for Safe Online Learning of Unknown Parameters / Matti Vahs, Jaeyoun Choi, Niklas Schmid 他
日本語で読む → - 論文VLAロボティクス
CARE: ロボット制御のための連続潜在行動表現のマルチタスク事前学習
行動ラベルなしで動画とテキストのペアのみから連続的な潜在行動表現を学習し、少数のラベル付きデータで微調整することでロボット制御を実現するフレームワークを提案。
原題: CARE: Multi-Task Pretraining for Latent Continuous Action Representation in Robot Control / Jiaqi Shi, Xulong Zhang, Xiaoyang Qu 他
日本語で読む → - 論文位置推定ロボティクス
DisCo-FLoc: セマンティクス不要なSE(2)対応コントラスト曖昧性解消による間取り位置推定
単眼RGB画像から深度対応のレイ回帰で2Dレイ特徴を抽出し、SE(2)摂動を用いたコントラスト学習で間取り上の位置・向きを曖昧性なく推定する手法を提案。
原題: DisCo-FLoc: Semantic-Free Floorplan Localization via $SE(2)$-Aware Contrastive Disambiguation / Ping Zhong, Shiyong Meng, Bolei Chen 他
日本語で読む →