論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/1/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文マニピュレーションロボティクス
DemoBot:第三者視点の人間動画から器用な両手マニピュレーションを効率的に学習
1本の注釈なしRGB-D動画から両腕多指ロボットの操作スキルを獲得する学習フレームワークを提案し、動きの事前分布と強化学習を組み合わせて長期的な両手組み立てタスクを実現した。
原題: DemoBot: Efficient Learning of Bimanual Manipulation with Dexterous Hands From Third-Person Human Videos / Yucheng Xu, Xiaofeng Mao, Elle Miller 他
日本語で読む → - 論文sim2realロボティクス
LogicEnvGen: タスク論理に基づく多様な具現化AI向けシミュレーション環境の生成
LLMを用いてエージェントのタスク実行論理を解析し、論理的に多様なシミュレーション環境をテストケースとして自動生成する手法を提案。
原題: LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI / Jianan Wang, Siyang Zhang, Bin Li 他
日本語で読む → - 論文自動運転/シミュレーションHCI
人間らしい歩行者モデルによる現実的な敵対的シナリオ生成と自動運転制御パラメータ最適化
認知科学的な歩行者モデルを用いて、個人差と個人内変動を考慮した現実的な敵対的シナリオを生成し、自動運転車の制御パラメータ最適化に応用できることを示した。
原題: Realistic adversarial scenario generation via human-like pedestrian model for autonomous vehicle control parameter optimisation / Yueyang Wang, Mehmet Dogar, Russell Darling 他
日本語で読む → - 論文触覚HCI
遠隔触診におけるしこりの硬さを再現するハイブリッド軟質触覚ディスプレイ
硬いプラットフォームと4×4の軟質空気圧触覚ディスプレイを組み合わせ、軟組織下の硬いしこりを提示する手法を提案し、12名の実験で検出精度が50%から95%以上に向上することを示した。
原題: A Hybrid Soft Haptic Display for Rendering Lump Stiffness in Remote Palpation / Pijuan Yu, Anzu Kawazoe, Alexis Urquhart 他
日本語で読む → - 論文運動プリミティブロボティクス
ロボティクスにおける運動プリミティブ:包括的サーベイ
ロボットの運動制御に用いられる運動プリミティブの主要な枠組みを年代順に整理し、その長所・短所と応用例を体系的にまとめたサーベイ論文。
原題: Movement Primitives in Robotics: A Comprehensive Survey / Nolan B. Gutierrez, Joseph M. Cloud, William J. Beksi
日本語で読む → - 論文知識グラフロボティクス
ロボットの知識駆動型ミッション設計手法
ROS 2システムに知識グラフを導入し、自律ロボットミッションの効率と知能を高める設計手法を提案。Gazeboでの捜索救助シミュレーションで有効性を実証した。
原題: A Methodology for Designing Knowledge-Driven Missions for Robots / Guillermo GP-Lenza, Carmen DR. Pita-Romero, Miguel Fernandez-Cortizas 他
日本語で読む → - 論文安全強化学習機械学習
ナイトメア・ドリーマー:危険状態を夢見て先回りする安全強化学習
学習した世界モデルで将来の安全違反を予測し、それを避けるように行動計画を立てるモデルベース安全強化学習手法を提案。画像入力のみで安全性と効率を大幅に改善した。
原題: Nightmare Dreamer: Dreaming About Unsafe States And Planning Ahead / Oluwatosin Oseni, Shengjie Wang, Jun Zhu 他
日本語で読む → - 論文歩行制御
脚式ロボットの歩行制御におけるモデル予測パス積分制御のためのサンプリング戦略設計
脚式ロボットの歩行制御にMPPIを適用する際のサンプリング戦略を体系的に検討し、非構造化法とスプライン法を比較して制御の滑らかさや性能への影響を明らかにした。
原題: Sampling Strategy Design for Model Predictive Path Integral Control on Legged Robot Locomotion / Chuyuan Tao, Fanxin Wang, Haolong Jiang 他
日本語で読む → - 論文sim2realロボティクス
データ駆動型テラメカニクスによる月面ローバー向けリアルタイムシミュレータ
月面ローバーの走行を高忠実度で再現するため、実験とシミュレーションから得たデータで滑りと沈下の回帰モデルを構築し、リアルタイムで動作するテラメカニクスシミュレータを実現した。
原題: Data-Driven Terramechanics Approach Towards a Realistic Real-Time Simulator for Lunar Rovers / Jakob M. Kern, James M. Hurrell, Shreya Santra 他
日本語で読む → - 論文VLAロボティクス
デモンストレーション不要のLLMエージェントによるロボット制御
ソフトウェア開発用のLLMエージェントフレームワークをそのままロボット操作に適用し、デモやファインチューニングなしでLIBEROなどで高い成功率を達成した。
原題: Demonstration-Free Robotic Control via LLM Agents / Brian Y. Tsui, Alan Y. Fang, Tiffany J. Hwu
日本語で読む → - 論文航空管制/強化学習機械学習
オンライン行動スタッキングによる航空管制の強化学習性能向上
強化学習で航空管制を学習する際、推論時に基本行動を組み合わせて複合的な管制指示を生成するオンライン行動スタッキングを提案し、小さな行動空間でも実用的な性能を実現した。
原題: Online Action-Stacking Improves Reinforcement Learning Performance for Air Traffic Control / Ben Carvell, George De Ath, Eseoghene Benjamin 他
日本語で読む → - 論文物理的ヒューマンロボットインタラクションロボティクス
超冗長ロボット身体との人間工学的物理インタラクションのための姿勢バーチャルフィクスチャ
超冗長ロボット身体(SRB)との物理的インタラクション中に非人間工学的な姿勢を検出すると、抵抗感を与えて姿勢改善を促す制御フレームワークを提案し、14名の被験者実験で有効性を示した。
原題: Postural Virtual Fixtures for Ergonomic Physical Interactions with Supernumerary Robotic Bodies / Theodora Kastritsi, Marta Lagomarsino, Arash Ajoudani
日本語で読む → - 論文マニピュレーションロボティクス
関節物体のオンライン推定と操作
視覚事前情報と固有感覚を因子グラフで統合し、未知の関節物体の関節状態をオンライン推定しながら操作する手法を提案。実機で75%の成功率を達成。
原題: Online Estimation and Manipulation of Articulated Objects / Russell Buchanan, Adrian Röfer, João Moura 他
日本語で読む → - 論文マニピュレーションロボティクス
電子機器の協調的双腕ロボット分解のためのグラフベース適応計画(eGRAP)
視覚・動的計画・双腕実行を統合し、電子機器を自律分解するeGRAPを提案。HDDで高い成功率と効率的なサイクルタイムを実証。
原題: Graph-Based Adaptive Planning for Coordinated Dual-Arm Robotic Disassembly of Electronic Devices (eGRAP) / Adip Ranjan Das, Maria Koskinopoulou
日本語で読む → - 論文教育・シミュレーションロボティクス
EduSim-LLM:大規模言語モデルとロボットシミュレーションを統合した初心者向け教育プラットフォーム
自然言語指示をCoppeliaSim上のロボット行動列に変換する教育プラットフォームを構築し、直接制御と自律制御の2つの対話モデルで多ロボット協調や運動計画を評価した。
原題: EduSim-LLM: An Educational Platform Integrating Large Language Models and Robotic Simulation for Beginners / Shenqi Lu, Liangwei Zhang
日本語で読む → - 論文3Dセグメンテーション画像認識
CropNeRF: ニューラル放射場に基づく作物カウントフレームワーク
多視点画像とNeRFを組み合わせ、3Dインスタンスセグメンテーションで作物を正確に数える手法を提案し、綿花・リンゴ・ナシのデータセットで有効性を示した。
原題: CropNeRF: A Neural Radiance Field-Based Framework for Crop Counting / Md Ahmed Al Muzaddid, William J. Beksi
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
WaveMan: ヒューマノイドロボットのためのミリ波による部屋規模の人間インタラクション知覚
ミリ波センシングを用いて、ユーザーの位置に依存せずプライバシーを守りながら部屋規模で人間のインタラクションを認識するシステムを提案し、未学習の位置でも高精度を実現した。
原題: WaveMan: mmWave-Based Room-Scale Human Interaction Perception for Humanoid Robots / Yuxuan Hu, Kuangji Zuo, Boyu Ma 他
日本語で読む → - 論文ナビゲーションAI
昆虫に着想を得た視覚的ポイントゴールナビゲーション
昆虫の脳構造(キノコ体と中心複合体)を模倣し、衝突学習による適応的な障害物回避と経路最適化を実現するナビゲーションモデルを開発。標準ベンチマークで最先端モデルと同等の成功率をはるかに低い計算コストで達成した。
原題: Insect-inspired Visual Point-goal Navigation / Yihe Lu, Barbara Webb
日本語で読む → - 論文VLAAI
LangForce: 潜在行動クエリによる視覚言語行動モデルのベイズ分解
視覚言語行動モデルが言語指示を無視して視覚のみに依存する「情報崩壊」問題を、ベイズ分解と潜在行動クエリで解決し、未知環境での汎化性能を向上させた研究。
原題: LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries / Shijie Lian, Bin Yu, Xiaopeng Lin 他
日本語で読む → - 論文手術ロボティクスロボティクス
手術把持・牽引のための教師ありMixture-of-Experts
ステレオ内視鏡画像と150件未満のデモのみで、位相構造を持つ手術操作を学習する教師ありMoEアーキテクチャを提案し、腸管把持・牽引タスクで汎用VLAを上回る性能と分布外頑健性を示した。
原題: Supervised Mixture-of-Experts for Surgical Grasping and Retraction / Lorenzo Mazza, Ariel Rodriguez, Rayan Younis 他
日本語で読む → - 論文模倣学習/ヒューマノイド制御ロボティクス
タスク中心の運動事前分布最適化:不整合な模倣を条件付き正則化で扱うヒューマノイド制御
人間の運動デモを模倣の共目的ではなくタスク進捗に応じた条件付き正則化として扱い、不整合な事前分布下でも自然な動きを保ちつつタスク性能を高める敵対的模倣学習フレームワークTCMPを提案した。
原題: Task-Centric Policy Optimization from Misaligned Motion Priors / Ziang Zheng, Kai Feng, Yi Nie 他
日本語で読む → - 論文モジュラーロボットロボティクス
変形可能な四辺形モジュールロボットの自己再構成計画
変形可能な四辺形モジュールロボットのための、安定した接続を保証する自己再構成計画アルゴリズムを提案し、物理プラットフォームで実現可能性を示した。
原題: Self-Reconfiguration Planning for Deformable Quadrilateral Modular Robots / Jie Gu, Hongrun Gao, Zhihao Xia 他
日本語で読む → - 論文深度推定画像認識
UAV林業における樹枝の深度推定のゴールドスタンダードに向けて:深層ステレオマッチング手法のベンチマーク
8つのステレオ深度推定手法を4つの標準ベンチマークと新規の樹枝データセットでゼロショット評価し、DEFOMが植生環境で最も頑健であることを示した。
原題: Towards Gold-Standard Depth Estimation for Tree Branches in UAV Forestry: Benchmarking Deep Stereo Matching Methods / Yida Lin, Bing Xue, Mengjie Zhang 他
日本語で読む → - 論文計画ロボティクス
誘導探索付き合成拡散による長期的計画
局所的な拡散モデルを組み合わせて長期タスクを計画する際のモード平均化問題を、拡散のノイズ除去過程に探索を組み込むことで解決し、ロボット操作や画像・動画生成で有効性を示した論文。
原題: Compositional Diffusion with Guided Search for Long-Horizon Planning / Utkarsh A Mishra, David He, Yongxin Chen 他
日本語で読む → - 論文自己適応ロボティクス
SUNSET:ROSベースの自己適応のためのセンサフュージョン意味セグメンテーション例題
ROS2上で動作するセンサフュージョン意味セグメンテーションパイプラインを例題として提供し、故障注入により自己適応アプローチの評価を可能にする。
原題: SUNSET - A Sensor-fUsioN based semantic SegmEnTation exemplar for ROS-based self-adaptation / Andreas Wiedholz, Rafael Paintner, Alwin Hoffmann 他
日本語で読む → - 論文位置推定画像認識
惑星探査の地空ロボットチーム向けドメイン汎化クロスビュー位置推定のための視覚基盤モデル
視覚基盤モデルによるセマンティックセグメンテーションと大量の合成データを活用し、地上ローバーが限られた視野の単眼RGB画像から航空マップ上で自己位置を推定するクロスビュー二重エンコーダ手法を提案。実世界の探査アナログ施設で取得したデータセットも公開した。
原題: Vision Foundation Models for Domain Generalisable Cross-View Localisation in Planetary Ground-Aerial Robotic Teams / Lachlan Holden, Feras Dayoub, Alberto Candela 他
日本語で読む → - 論文位置認識ロボティクス
農業環境におけるLiDAR位置認識の先進技術と応用:包括的サーベイ
農業環境でのLiDAR位置認識技術に焦点を当て、最新の深層学習応用、課題、データセット、評価指標を包括的にレビューした初のサーベイ。
原題: Advanced techniques and applications of LiDAR Place Recognition in Agricultural Environments: A Comprehensive Survey / Judith Vilella-Cantos, Mónica Ballesta, David Valiente 他
日本語で読む → - 論文自動運転ロボティクス
多目的自動運転のパレート空間を学習する:モジュール式データ駆動アプローチ
自然な走行軌跡データから安全性・効率性・インタラクションのトレードオフを学習し、パレート最適な運転状態を特定する枠組みを提案。TGSIMデータで検証し、パレート最適状態は稀であることを示した。
原題: Learning the Pareto Space of Multi-Objective Autonomous Driving: A Modular, Data-Driven Approach / Mohammad Elayan, Wissam Kontar
日本語で読む → - 論文ナビゲーションロボティクス
DSCD-Nav: 物体ナビゲーションのための二立場協調討論
視覚言語モデルを用いた物体ナビゲーションにおいて、タスク理解と安全・情報バランスの二つの立場から協調的に討論させ、合意形成で行動を決定する手法を提案。不確実な選択には軽量な追加確認を行うことで、探索の冗長性を減らし成功率と経路効率を改善した。
原題: DSCD-Nav: Dual-Stance Cooperative Debate for Object Navigation / Weitao An, Qi Liu, Chenghao Xu 他
日本語で読む → - 論文予測ロボティクス
二重予測は不要:遮蔽環境における効率的なエージェント予測
遮蔽された交通エージェントの予測において、冗長な占有予測を減らすため、ハンガリアンマッチングと進行方向分離を導入したMatchInformerを提案し、Waymoデータセットで精度向上を実証した。
原題: Don't double it: Efficient Agent Prediction in Occlusions / Anna Rothenhäusler, Markus Mazzola, Andreas Look 他
日本語で読む →