論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
1つのデモで多様な物体へ:局所接触形状による操作の一般化
人間のデモから学習し、接触点周りの局所形状に注目した報酬設計で、多指ロボットハンドの操作を未見の物体へ一般化する手法を提案した。
原題: One Demonstration, Many Objects: Generalizing Manipulation via Local Contact Geometry / Satvik Sharma, Samrat Sahoo, Huang Huang 他
日本語で読む → - 論文生物移動physics.bio-ph
マッドスキッパーは尾の突き上げを利用して様々な湿り気の泥上での移動を助ける
マッドスキッパーが様々な湿り気の泥上で移動する際、通常の松葉杖歩行に加えて尾の突き上げを用いて推進力と揚力を得ることを観察した。
原題: Mudskippers use tail thrusting to help crutching to move on mud of various wetness / Divya Ramesh, Gargi Sadalgekar, Jiangqi Tan 他
日本語で読む → - 論文トラッキング画像認識
TAPVid-MV: 複数視点にわたる3次元任意点追跡のベンチマーク
複数カメラ映像における長期的な3次元点追跡のための最初のベンチマークを構築し、既存手法の性能を評価した。
原題: TAPVid-MV: A Benchmark for Tracking Any Point in 3D Across Multiple Views / Skanda Koppula, Frano Rajic, Abdullah Faiz Ur Rahman 他
日本語で読む → - 論文群制御ロボティクス
分散型マルチロボット探査のための接続性を考慮したグラフ拡張手法
通信が不安定な環境下での複数UAVによる未知領域探査を対象に、フロンティアの接続性に基づく新しい探査グラフ拡張戦略を提案し、領域分割の安定性と探査効率を向上させた。
原題: Connectivity-Aware Graph Extension for Decentralized Multi-Robot Exploration / Béatrice Garcia Cegarra, Elena Vanneaux, Quentin Picard 他
日本語で読む → - 論文画像再照明画像認識
HELIOS: 真夜中から正午まで、屋外都市シーンの連続的な再照明
ペア画像を使わずに、実世界の未ラベルデータから昼夜間の照明を連続的に変換する再照明手法HELIOSを提案した。
原題: HELIOS: From midnight to noon, continuous outdoor urban scene relighting / Hala Djeghim, Nathan Piasco, Luis Roldão 他
日本語で読む → - 論文ニューロシンボリックAIAI
ニューロシンボリック幾何学的抽象化(NeuSOGA):観測から記号的数学表現へ
観測データをトポロジー・幾何学的抽象化を経て解釈可能な記号的数学表現に変換するフレームワークNeuSOGAを提案した。
原題: Neuro-Symbolic Geometric Abstraction (NeuSOGA): From Observations to Symbolic Mathematical Representations / Qingde Li, Qingqi Hong, Jie Tian
日本語で読む → - 論文移動physics.bio-ph
移動研究のための泥の強度の制御・変化・特性評価の重要性と方法
動物やロボットが遭遇する泥の降伏強度を制御・測定する方法を開発し、乾燥砂との違いを明らかにした。
原題: Importance and methods to control, vary, and characterize mud strength for studying locomotion / Divya Ramesh, Gargi Sadalgekar, Qiyuan Fu 他
日本語で読む → - 論文sim2real機械学習
安全なシミュレーションから実世界への転移の証明可能な保証
シミュレータで訓練した方策を実世界に安全に転移するためのアルゴリズムを提案し、シミュレータと実世界の差に応じたサンプル複雑性の理論的保証を与えた。
原題: Provably Safe Sim-to-Real Transfer / Tingting Ni, Maryam Kamgarpour
日本語で読む → - 論文センサフュージョン画像認識
カルマンフィルタを用いた傾斜角推定アルゴリズムの設計と実装
MPU6050センサとRP2040マイコンを用い、加速度計とジャイロスコープのデータをカルマンフィルタで統合し、ノイズとドリフトを抑えた高精度な傾斜角推定システムを実装・評価した論文。
原題: Design and Implementation of a Kalman Filter-Infused Algorithm for Tilt Estimation / Yuehan Ma, Hongji Dai
日本語で読む → - 論文交通制御ロボティクス
可変速度制限制御への交通騒音排出モデルの統合
交通騒音を考慮した可変速度制限(VSL)制御フレームワークを提案し、騒音排出指標に基づいて速度制限を動的に調整することで、騒音を低減しつつ平均速度を維持することを示した。
原題: Integrating Traffic Noise Emission Modelling into Variable Speed Limit Control / Jiawen Meng, John Pravin Arockiasamy, Alexey Vinel
日本語で読む → - 論文強化学習/MPCロボティクス
MPCソルバー勾配ガイダンスによる強化学習の加速:重み可変MPC向け
モデル予測制御(MPC)のコスト重みを適応的に学習する際、強化学習のサンプル効率を向上させるため、微分可能MPCのソルバー勾配を補助ガイダンスとして利用するSG-RL手法を提案した。自動レースプラットフォームで最大70.6%のサンプル削減を実証した。
原題: Accelerating Reinforcement Learning via MPC Solver-Gradient Guidance for Weights-varying MPC / Baha Zarrouki, Arslan Thobani, Jasper Hoffmann 他
日本語で読む → - 論文POMDP/プランニングロボティクス
高次元POMDPのためのスケーラブルなRao-Blackwell化オンラインプランニング
高次元の部分観測環境でのオンラインプランニングを改善するため、Rao-Blackwell化POMDPフレームワークを拡張し、連続・離散ハイブリッド信念表現で不確実性を解析的に伝播させてサンプリング分散を低減する手法を提案。探索救助タスクでFastSLAM 2.0と統合し、少ない粒子とシミュレーションで高い累積報酬を達成した。
原題: Scalable Rao-Blackwellized Online Planning for High-Dimensional POMDPs / Jiho Lee, Nisar Ahmed, Kyle Hollins Wray 他
日本語で読む → - 論文マニピュレーションロボティクス
Facet-0: 接触を伴う精密操作のためのロボット基盤モデル
接触の結果を予測・評価するロボット基盤モデルを提案し、サブミリ精度の組立タスクで高い成功率を達成した。
原題: Facet-0: A Robotic Foundation Model for Contact-Rich Precise Manipulation / Haoyuan Deng, Haichao Liu, Wenkai Guo 他
日本語で読む → - 論文ロボット操作ロボティクス
非把持スローイング:強化学習の視点から
ロボットによる物体投げ動作を強化学習で実現し、滑りや転がりを活用して把持不要の投げを可能にした。シミュレーションで99%の成功率を達成し、実機への適用も考慮している。
原題: Non-Prehensile Throwing: A Reinforcement Learning Perspective / Abdullah Mustafa, Ryo Hanai, Ixchel G. Ramirez-Alpizar 他
日本語で読む → - 論文3Dメモリ/動的環境/ナビゲーションロボティクス
HitMem: 動的環境のための階層的時間的3Dメモリとマルチモーダル文脈認識検索
動的環境で物体が移動した際のメモリと観測の矛盾を解決するため、階層的時間的3DメモリフレームワークHitMemを提案し、物体の再発見精度とタスク実行性能を向上させた。
原題: HitMem: Hierarchical Temporal 3D Memory with Multi-Modal Context-Aware Retrieval for Dynamic Environments / Ruijie Tang, Chenye Zou, Guoquan Wu 他
日本語で読む → - 論文自動運転/意図認識ロボティクス
DNC-IMM: 運転コンテキスト情報に基づくニューラル校正による早期車線変更意図認識
従来のIMMフィルタにニューラルネットワークを組み合わせ、運転状況に応じて遷移確率と観測尤度を校正し、車線変更意図を早期に高精度で認識する手法を提案した。
原題: DNC-IMM: Early Lane-Change Intention Recognition via Neural Calibration Based on Driving Context Information / Woong-Chan Byun, Seung-Hyun Kong
日本語で読む → - 論文シミュレーション/ベンチマークロボティクス
AM-Bench: 空中マニピュレーションのポリシー学習のためのモジュール式シミュレーションスイートとベンチマーク
空中マニピュレーションのポリシー学習を評価するための、モジュール式シミュレーションスイートとベンチマークを提案した論文。
原題: AM-Bench: A Modular Simulation Suite and Benchmark for Aerial Manipulation Policy Learning / Yutong Wang, Dongjae Lee, Xiaofeng Guo 他
日本語で読む → - 論文モデル予測制御ロボティクス
ProxPI: 学習済み事前分布の不一致下でのサンプリングベースMPCに対する近接事前分布注入
学習済みポリシーとMPCを組み合わせる際、事前分布が不正確な場合にサンプリング分布をポリシー出力に中心化する既存手法の問題を指摘し、名目中心のサンプリングを維持しつつポリシーを近接コストとして組み込むProxPIを提案。理論と実験で性能回復を実証。
原題: ProxPI: Proximal Prior Injection for Sampling-Based MPC under Learned-Prior Mismatch / Euncheol Im, Myotaeg Lim, Yisoo Lee
日本語で読む → - 論文ヒューマノイド制御ロボティクス
ADAPT: 俊敏な拡散行動事前分布による堅牢で操縦可能なオンライン文章駆動ヒューマノイド制御
テキスト条件付きのヒューマノイド全身制御をエンドツーエンドで行うフレームワークを提案。拡散ベースの行動事前分布と残差強化学習を組み合わせ、言語コマンドに応じた多様な動作を直接実行しつつ、長期的な堅牢性とスムーズな切り替えを実現する。
原題: ADAPT: Agile Diffusion Action Priors for Robust and Steerable Online Text-Driven Humanoid Control / Yan Wu, Chenhao Li, Kaifeng Zhao 他
日本語で読む → - 論文触覚ロボティクス
連続・閉ループ・双方向触覚インタラクションのためのウェアラブル空気圧デバイス
触覚センシングと触覚フィードバックを統合したウェアラブル空気圧デバイスを提案し、遠隔操作の性能向上と精神的負荷の低減を実証した。
原題: A Wearable Pneumatic Device for Continuous, Closed-Loop, Bidirectional Tactile Interaction / Cosima du Pasquier, Aliyah Smith, Serin Huber 他
日本語で読む → - 論文自動運転ロボティクス
文脈を考慮したインテリジェント車両
本論文は、インテリジェント車両の次世代システムにおいて、状況要因(文脈)を一級の設計原理として扱い、ソフトウェアスタック全体で共有状態として活用することを提案し、関連研究を体系的にレビューして技術的課題を特定する。
原題: Context-Aware Intelligent Vehicles / Liangkai Liu, Shuyao Shi, Mingke Wang 他
日本語で読む → - 論文深度推定画像認識
単眼深度推定:進展と機会の包括的サーベイ
単眼画像からの深度推定の進化を、初期の学習ベース手法から基盤モデル時代まで体系的にレビューし、主要なデータセット、手法の分類、応用、今後の課題を整理したサーベイ論文。
原題: Monocular Depth Estimation from a Single Image: Progress and Opportunities / Muxin Liu, Xiaoyang Lyu, Yang-Tian Sun 他
日本語で読む → - 論文脳波デコード機械学習
EEG-VID: タスク誘導型潜在予測事前学習による脳波デコードと支援的ターゲット選択
脳波デコードのためのタスク誘導型潜在予測事前学習フレームワークを提案し、セッションや被験者の変化に対する頑健性を向上させた。
原題: EEG-VID: Task-Guided Latent Predictive Pretraining for EEG Decoding and Assistive Target Selection / Guanzhong Sun, Junyi Ma, Yuxuan Wu 他
日本語で読む → - 論文AI倫理AI
アルゴリズムがブランド危機となるとき:分散責任と説明責任ある透明性の社会技術理論
AIシステムの障害や誤用がブランド危機に発展する過程を、責任の分散と説明責任の観点から理論化した概念論文。
原題: When the Algorithm Becomes the Brand Crisis: A Sociotechnical Theory of Distributed Responsibility and Accountable Transparency / Mohammad Saleh Torkestani, Taha Mansouri
日本語で読む → - 論文群制御ロボティクス
GPS劣化環境下での協調UAVのための視覚ベースリーダー・フォロワー編隊制御
フォロワーUAVに搭載したRGB-DカメラでリーダーUAVを検出・追跡し、相対位置を推定して編隊を維持する視覚ベースの協調制御フレームワークを提案・評価した。
原題: Vision-Based Leader-Follower Formation Control for Cooperative UAVs in GPS-Degraded Environments / Deekshitha Angadi, Naveena Budda, Vikas Agarwal 他
日本語で読む → - 論文音声対話ロボティクス
騒がしい公共空間における複数参加者とのヒューマンロボット対話
騒音の多い公共空間で、ロボットやアバターが複数人と会話するための音声強調システムを提案し、2025年大阪万博で実証した。
原題: Human-robot conversation with multiple participants in noisy public spaces / Divesh Lala, Yogeeswaran Muthukumaran, Vincent Fernandes 他
日本語で読む → - 論文ビデオ生成画像認識
MeRoPE: カメラ制御ビデオ生成のためのメトリック回転位置埋め込み
カメラ制御ビデオ生成において、実世界のメトリックカメラ軌道でスケール依存の失敗を起こさない、ノルム保存型の相対カメラエンコーディングMeRoPEを提案した。
原題: MeRoPE: Metric Rotary Position Embedding for Camera-Controlled Video Generation / Zhijian Qiao, Xinjiang Wang, Jiajie Chen 他
日本語で読む → - 論文群制御ロボティクス
TriSAR:災害対応における空中ロボットチームのタスク調整と衝突回避
災害対応のための5機のUAVチームを対象に、タスク割り当て戦略(遺伝的アルゴリズムと貪欲法)と衝突回避の有無が任務効率と安全性に与える影響を、物理ベースのシミュレーションで比較評価した。
原題: TriSAR: Task Coordination and Collision Avoidance for Aerial Robot Teams in Disaster Response / Aditya Anil Kapile, Pedro Machado, Isibor Kennedy Ihianle
日本語で読む → - 論文デジタルツイン機械学習
テラヘルツ無線データセンター向けトライバンドチャネル計測に基づく多層デジタルツイン
テラヘルツ無線データセンターの効率的な設計・最適化のため、140/220/300GHzの実測に基づく多層デジタルツインを提案し、AIチャネルツインによる高速なチャネル再構成を実現した。
原題: Tri-Band Channel Measurement-Enabled Multi-Layer Digital Twin for Terahertz Wireless Data Centers / Mingjie Zhu, Ziming Yu, Guangjian Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
VerNav: 検証器優先の低遅延ビジョン・言語ナビゲーション
VLNタスクにおいて、各ステップの自己回帰生成を検証器による一括アクション検証に置き換え、不確実な場合のみ適応的生成器を使うことで、遅延を10倍以上削減しつつ競争力のある性能を達成するフレームワークを提案した。
原題: VerNav: Verifier-First Low-Latency Vision-and-Language Navigation / Zhixin Wang, Chengzheyi Yao, Leyuan Liu 他
日本語で読む →