論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/4/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文テレオペレーション/データ収集ロボティクス
DEX-Mouse: 力覚フィードバックを備えた低コスト・携帯型・汎用の器用なロボットハンド用データ収集インターフェース
キャリブレーション不要で携帯可能な、力覚フィードバック付きのハンドヘルド型テレオペレーションインターフェースを150ドル未満で開発し、ロボットハンドを前腕に取り付ける構成で高タスク成功率と低作業負荷を実証した。
原題: DEX-Mouse: A Low-cost Portable and Universal Interface with Force Feedback for Data Collection of Dexterous Robotic Hands / Joonho Koh, Haechan Jung, Nayoung Kim 他
日本語で読む → - 論文ネットワーク制御ロボティクス
テレコムワールドモデル:6Gのためのデジタルツイン、基盤モデル、予測計画の統合
6Gネットワーク向けに、言語ベースのLLMと物理ベースのデジタルツインの限界を克服するため、学習・行動条件付き・不確実性を考慮したテレコムシステムダイナミクスのモデル化を実現する「テレコムワールドモデル」というアーキテクチャを提案した論文。
原題: Telecom World Models: Unifying Digital Twins, Foundation Models, and Predictive Planning for 6G / Hang Zou, Yuzhi Yang, Lina Bariah 他
日本語で読む → - 論文ドローン/捜索救助/無線測位cs.NI
「Wi-Fiドローンで家まで連れて帰って」:荒野捜索救助のためのドローン搭載無線システム
既存インフラに依存せず、遭難者の携帯端末のWi-Fi自動再接続挙動を利用して、ドローンで遭難者を発見・位置特定する自律捜索救助システムを提案・実装した。
原題: "Take Me Home, Wi-Fi Drone": A Drone-based Wireless System for Wilderness Search and Rescue / Weiying Hou, Luca Jiang-Tao Yu, Chenshu Wu
日本語で読む → - 論文制御ロボティクス
COSMIK-MPPI:近接動的人間環境における衝突回避への制約付きモデル予測制御の拡張
MPPI制御に制約違反を終端事象として扱う手法を組み合わせ、人間の動作予測に依存せずに衝突回避を保証するフレームワークを提案し、実機で検証した。
原題: COSMIK-MPPI: Scaling Constrained Model Predictive Control to Collision Avoidance in Close-Proximity Dynamic Human Environments / Ege Gursoy, Maxime Sabbah, Arthur Haffemayer 他
日本語で読む → - 論文計画/アフォーダンスAI
ADAPT: 不特定のアフォーダンス制約下での常識的計画のベンチマーク
動的環境で物体のアフォーダンスが変化し指示に明示されない状況を評価するベンチマークDynAffordを導入し、既存プランナーにアフォーダンス推論を追加するモジュールADAPTを提案した。
原題: ADAPT: Benchmarking Commonsense Planning under Unspecified Affordance Constraints / Pei-An Chen, Yong-Ching Liang, Jia-Fong Yeh 他
日本語で読む → - 論文データ収集ロボティクス
VRロボットゲームを活用した具現化知能タスクのデータ収集促進
Unityベースのゲーム化データ収集フレームワークを提案し、VRでのヒューマノイドロボット操作と自動評価により、ごみ拾いタスクのデモデータを効率的に収集できることを実証した。
原題: Leveraging VR Robot Games to Facilitate Data Collection for Embodied Intelligence Tasks / Yihan Zhang, Ziyun Huang, Linqi Ye
日本語で読む → - 論文着陸/静電吸着/MAVロボティクス
微小航空ロボットの平滑・曲面着陸のための柔軟静電吸着足
柔軟で伸縮可能な静電吸着パッドの作製法と、クアッドロータへの搭載による平滑・曲面への着陸実証を行った論文。
原題: Soft Electroadhesive Feet for Micro Aerial Robots Perching on Smooth and Curved Surfaces / Chen Liu, Sonu Feroz, Ketao Zhang
日本語で読む → - 論文ナビゲーションロボティクス
考える前に進む:画像目標ナビゲーションのための階層的推論
画像目標ナビゲーションを高レベル計画と低レベル実行に分解し、視覚言語モデルで短期的計画を生成して強化学習ポリシーを導く階層的フレームワークHRNavを提案。迷いを減らすペナルティも導入し、シミュレーションと実環境で有効性を実証した。
原題: Think before Go: Hierarchical Reasoning for Image-goal Navigation / Pengna Li, Kangyi Wu, Shaoqing Xu 他
日本語で読む → - 論文把持/運動学ロボティクス
連続体アームによる平面把持の運動学
ソフトな連続体アームが平面物体を把持する際の幾何学的枠組みを解析し、最適制御と把持品質指標を提案した論文。
原題: Kinematics of continuum planar grasping / Udit Halder, Nicolas Echeverria Zambrano, Xincheng Li
日本語で読む → - 論文タスク計画ロボティクス
LLM-Flax:大規模言語モデルによる神経記号的アプローチを用いた汎用ロボットタスク計画
PDDLドメインファイルのみから、手動設計や学習データなしで神経記号的タスクプランナーを構築する3段階フレームワークを提案し、ベンチマークで手動ベースラインを上回る成功率を達成した。
原題: LLM-Flax : Generalizable Robotic Task Planning via Neuro-Symbolic Approaches with Large Language Models / Seongmin Kim, Daegyu Lee
日本語で読む → - 論文自動運転/強化学習ロボティクス
レーシングパラメータ化深層強化学習による自動運転車の衝突回避
自動運転車の衝突回避に、レースカーの追い越しを模したパラメータ化深層強化学習を適用し、シミュレーションで学習したポリシーを実機に転移して、従来のMPC-APFより優れた性能と低計算コストを実証した。
原題: Autonomous Vehicle Collision Avoidance With Racing Parameterized Deep Reinforcement Learning / Shathushan Sivashangaran, Vihaan Dutta, Apoorva Khairnar 他
日本語で読む → - 論文ヒューマンロボットインタラクションロボティクス
ロボットトレーナーは人に楽しまれるか?ペーサーロボットSnoopieのケーススタディ
四足歩行ロボットがランニングのインターバルトレーニングのペーサーとして機能し、ウェアラブル端末と比較してペース順守率と一貫性が向上し、ユーザーにも好意的に受け入れられることを示した。
原題: Will People Enjoy a Robot Trainer? A Case Study with Snoopie the Pacerbot / Maximilian Du, Jennifer Grannen, Shuran Song 他
日本語で読む → - 論文操作計画ロボティクス
3Dアンカー型先読み計画:ワールドモデルベースMCTSによる持続的ロボットシーン記憶
ロボット操作のためのSystem 2推論エンジンで、3D一貫性のあるワールドモデルをロールアウト予測器としてMCTSと組み合わせ、遮蔽後も物体位置を記憶して再計画できるようにした。
原題: 3D-Anchored Lookahead Planning for Persistent Robotic Scene Memory via World-Model-Based MCTS / Bronislav Sidik, Dror Mizrahi
日本語で読む → - 論文遠隔医療/デジタルツインロボティクス
ハイブリッド自律・遠隔操作医療対応のためのGeoVision対応デジタルツイン
災害時やインフラが限られた環境での遠隔医療対応を支援するため、GeoVision機能を活用したデジタルツインアーキテクチャを提案し、リアルタイム同期により状況認識と意思決定を向上させる。
原題: GeoVision-Enabled Digital Twin for Hybrid Autonomous-Teleoperated Medical Responses / Parham Kebria, Soheil Sabri, Laura J Brattain
日本語で読む → - 論文模倣学習ロボティクス
WARPED: 手首視点レンダリングによる自己中心視点の人間デモからのロボットポリシー学習
単眼RGBの自己中心視点動画から、手首視点の写実的な観測を合成してロボットポリシーを訓練するフレームワークを提案。遠隔操作デモと同等の成功率を5〜8倍短いデータ収集時間で達成した。
原題: WARPED: Wrist-Aligned Rendering for Robot Policy Learning from Egocentric Human Demonstrations / Harry Freeman, Chung Hee Kim, George Kantor
日本語で読む → - 論文VSLAM/姿勢推定画像認識
関係性エピポーラグラフによる頑健な相対カメラ姿勢推定
対応点をノードとするエピポーラグラフ上で関係推論を行い、ノイズや大きなベースライン変化に頑健な相対カメラ姿勢を推定する手法を提案した。
原題: Relational Epipolar Graphs for Robust Relative Camera Pose Estimation / Prateeth Rao, Sachit Rao
日本語で読む → - 論文VLA/世界モデルロボティクス
Motubrain: ロボット制御のための高度な世界行動モデル
視覚・言語・行動を統合した世界行動モデルMotubrainを提案し、動画と行動の同時予測や多様なロボットデータへの対応、高速な実時間推論を実現した。
原題: Motubrain: An Advanced World Action Model for Robot Control / Motubrain Team, Chendong Xiang, Fan Bao 他
日本語で読む → - 論文模倣学習/操作ロボティクス
チューブ拡散ポリシー:接触を伴う操作のための反応的視覚触覚ポリシー学習
接触を伴う操作において、視覚と触覚のフィードバックに基づいて即座に適応できるよう、拡散モデルとチューブベースのフィードバック制御を組み合わせた新しいポリシー学習フレームワークを提案した。
原題: Tube Diffusion Policy: Reactive Visual-Tactile Policy Learning for Contact-rich Manipulation / Teng Xue, Alberto Rigo, Bingjian Huang 他
日本語で読む → - 論文自動運転/データセットロボティクス
OVPD: 実地自動運転チャレンジの仮想・物理融合テストデータセット
実車両をループに組み込んだ仮想・物理融合テストデータセットOVPDを公開し、自動運転アルゴリズムの閉ループ評価と故障診断を可能にする。
原題: OVPD: A Virtual-Physical Fusion Testing Dataset of OnSite Auton-omous Driving Challenge / Yuhang Zhang, Jiarui Zhang, Bowen Jian 他
日本語で読む → - 論文ナビゲーションロボティクス
AnyImageNav: 任意視点の幾何学による精密な最終メートル画像ゴールナビゲーション
画像ゴールナビゲーションを精密な位置決めが可能な設定に拡張し、ゴール画像を幾何学的クエリとして扱い、密な画素対応による6自由度カメラ姿勢推定を実現する訓練不要のシステムを提案した。
原題: AnyImageNav: Any-View Geometry for Precise Last-Meter Image-Goal Navigation / Yijie Deng, Shuaihang Yuan, Yi Fang
日本語で読む → - 論文自動運転ロボティクス
ProDrive: 自己と環境の共進化による自動運転のためのプロアクティブ計画
現在の観測のみに依存する反応的な自動運転計画の問題を解決するため、自己と環境の共進化を可能にするワールドモデルベースのプロアクティブ計画フレームワークを提案した。
原題: ProDrive: Proactive Planning for Autonomous Driving via Ego-Environment Co-Evolution / Chuyao Fu, Shengzhe Gan, Zhuoli Ouyang 他
日本語で読む → - 論文マニピュレーションロボティクス
ゲート付きメモリポリシー:文脈内記憶と適応
ロボット操作タスクの記憶要件に応じて、履歴を選択的に記憶・想起する視覚運動ポリシーを提案。メモリゲートと軽量クロスアテンションにより、非マルコフ的タスクで性能を向上させた。
原題: Gated Memory Policy: In-Context Memorization and Adaptation / Yihuai Gao, Jeff Jinyun Liu, Shuang Li 他
日本語で読む → - 論文アクチュエータ設計ロボティクス
DTEA: 直列・並列コンプライアンスをリアルタイム切替可能な二重トポロジー弾性アクチュエータ
直列弾性アクチュエータ(SEA)と並列弾性アクチュエータ(PEA)の利点を両立するため、動作中にトポロジーを動的切替できる新しいアクチュエータDTEAを提案し、プロトタイプで切替の堅牢性と性能を実証した。
原題: DTEA: A Dual-Topology Elastic Actuator Enabling Real-Time Switching Between Series and Parallel Compliance / Vishal Ramesh, Aman Singh, Shishir Kolathaya
日本語で読む → - 論文群制御制御
長期間自律のためのPDE制約最適化による安全かつエネルギー効率的なマルチロボット密度制御
マルチロボットシステムの密度制御を、空間的な安全性とエネルギー持続性を保証しながら行う新しいフレームワークを提案。Fokker-Planck PDEを用いて密度レベルで確率的なロボット運動をモデル化し、制御リアプノフ関数と制御バリア関数を統合して目標密度追従、障害物回避、充電サイクルにわたるエネルギー充足を実現する。
原題: Safe and Energy-Aware Multi-Robot Density Control via PDE-Constrained Optimization for Long-Duration Autonomy / Longchen Niu, Andrew Nasif, Gennaro Notomista
日本語で読む → - 論文ナビゲーションロボティクス
航空ロボットのための視覚言語ナビゲーション:大規模言語モデルの時代に向けて
本論文は、航空機(UAV)が自然言語の指示を理解し、3次元環境を自律的にナビゲートする「航空視覚言語ナビゲーション」の分野を概観し、大規模言語モデル(LLM)と視覚言語モデル(VLM)の統合に焦点を当てて、方法論の分類、評価インフラの批判的検討、および7つの未解決問題を提示するサーベイである。
原題: Vision-Language Navigation for Aerial Robots: Towards the Era of Large Language Models / Xingyu Xia, Lekai Zhou, Yujie Tang 他
日本語で読む → - 論文システム同定機械学習
ロボット力学の生成的インコンテキストメタ学習のための拡散系列モデル
ロボットの力学モデル同定をインコンテキストメタ学習問題として捉え、決定論的モデルと拡散ベースの生成モデルを比較し、分布シフトに対する頑健性とリアルタイム制約への適合性を示した。
原題: Diffusion Sequence Models for Generative In-Context Meta-Learning of Robot Dynamics / Angelo Moroncelli, Matteo Rufolo, Gunes Cagin Aydin 他
日本語で読む → - 論文歩行ロボティクス
コンプライアント蠕動ロボットの動的モデリングとロバスト歩容最適化
波形パイプを移動するコンプライアント蠕動ロボットのハイブリッド動的モデルとエネルギー消費モデルを構築し、速度と消費電力のトレードオフを考慮したロバストな歩容最適化フレームワークを提案した。
原題: Dynamic Modeling and Robust Gait Optimization of a Compliant Worm Robot / Xinyu Zhou, Yu Mei, Faith Thomson 他
日本語で読む → - 論文3D再構築画像認識
F3DGS: 分散型マルチエージェント世界モデリングのための連合3Dガウススプラッティング
複数のエージェントが独立して動作する分散環境で、観測データを中央集約せずに3Dシーン再構築を行う連合学習フレームワークを提案した論文。
原題: F3DGS: Federated 3D Gaussian Splatting for Decentralized Multi-Agent World Modeling / Morui Zhu, Mohammad Dehghani Tezerjani, Mátyás Szántó 他
日本語で読む → - 論文触覚ロボティクス
縁と面の触覚を再現するウェアラブル触覚デバイス
軽量な指先装着型触覚デバイスを開発し、縁と面の接触を異なる振動パターンで提示。ユーザー実験で93%の識別精度を達成した。
原題: A wearable haptic device for edge and surface simulation / Rui Chen, Xianlong Mai, Alireza Sanaei 他
日本語で読む → - 論文触覚ロボティクス
触覚モデルの訓練法:多指ロボットハンドによる触覚認識
視覚ベースの触覚センサー向けに、Vision Transformerを用いた新しい触覚認識モデルTacViTを提案し、未見のセンサーでも高い汎化性能を示すことを実証した。
原題: How to Train your Tactile Model: Tactile Perception with Multi-fingered Robot Hands / Christopher J. Ford, Kaichen Shi, Laura Butcher 他
日本語で読む →