論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/7/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
ロボット行動表現のための意味的アンカリング
VLAモデルの微調整で失われる意味構造を保つため、行動表現を意味多様体に固定するプラグアンドプレイ手法を提案し、実世界で最大+18.7%の成功率向上を達成した。
原題: Semantic Anchoring for Robotic Action Representations / Yuan Xu, Youheng Shi, Chengyang Li 他
日本語で読む → - 論文時間的偽造検出画像認識
MG-RWKV: 時間的偽造位置特定のための多粒度文脈認識RWKV
RWKVの状態進化を利用し、O(T)計算量で全シーケンス処理を実現する多粒度フレームワークを提案。双方向RWKV、多粒度MoE、粒度間一貫性により、偽造セグメントの正確な特定を実現した。
原題: MG-RWKV: Multi-Grained Context-Aware RWKV for Temporal Forgery Localization / Jingchen Ni, Cangjin Yu, Dan Jiang 他
日本語で読む → - 論文SLAMロボティクス
GLAM-SLAM: フローの高密度化と空間分割によるリアルタイム大規模ガウススプラッティングSLAM
大規模屋外シーン向けのリアルタイムなガウススプラッティングSLAMシステムを提案し、特徴ベースのフロントエンドとスパースなアンカーグリッド表現で軽量なトラッキングとスケーラブルなマッピングを実現した。
原題: GLAM-SLAM: Real-time Gaussian Large-scale Mapping via Flow Densification and Spatial Decomposition / Panagiotis Mermigkas, Argyris Manetas, Petros Maragos
日本語で読む → - 論文6D姿勢推定画像認識
PIXIE: 組み立て欠陥を有する未見物体のためのゼロショット・テクスチャ非依存6D姿勢推定フレームワーク
テクスチャのない3DモデルとRGB画像のみから、未見物体の6D姿勢をゼロショットで推定するフレームワークを提案。合成レンダリングと特徴マッチングにより2D-3D対応を取得し、PnPで姿勢を計算する。
原題: PIXIE: A Zero-Shot texture-invariant 6D pose estimation framework for unseen objects with assembly defects / Leon Jungemeyer, Alejandro Magaña, Gautham Mohan 他
日本語で読む → - 論文二輪ロボット/バランス制御/アニマトロニクスロボティクス
四足形態を備えた乗騎型アニマトロニクス二輪ロボットの制御設計
四足の四肢を持つ乗騎型二輪ロボットを開発し、自転車操縦の魅力を若者に再認識させることを目指した。四肢は補助と表現に使い、主な移動は自立二輪で行い、安定したバランス制御と自然な四足歩行の運動制御を提案した。
原題: Control Design for a Rideable Animatronic Two-Wheeled Robot with Quadruped Form / Tadashi Sumioka, Kazushi Akimoto, Takuya Tsujimura 他
日本語で読む → - 論文計画ロボティクス
EvoPlan: 時空間保証を備えた進化的ニューロシンボリックロボット計画
LLMベースのプランナーに進化的探索と形式検証を組み合わせ、実行可能性と安全性を保証するニューロシンボリック計画フレームワークを提案した。
原題: EvoPlan: Evolutionary Neuro-Symbolic Robot Planning with Spatio-Temporal Guarantees / Bhavya Sai Nukapotula, Samin Moosavi, Haoze Wang 他
日本語で読む → - 論文ドローン/UAVロボティクス
MIRA: 屋内研究用のモジュール式オープンソース小型UAV
3Dプリント機体とコンテナ化ソフトウェアを備えた低コストで改造容易な屋内研究用マイクロUAVを開発し、自律飛行評価で性能を実証した。
原題: MIRA: A Modular Open-Source Micro-UAV for Indoor Research / Lucas K. de Oliveira, Felipe A. G. Tommaselli, João Aires Marsicano 他
日本語で読む → - 論文操作スキル獲得ロボティクス
単一の人間ビデオから数秒でロボットが操作スキルを獲得
ロボットが1本の人間のデモ動画から、数秒で新しい操作スキルを獲得しつつ、既存スキルを保持できるフレームワークHOSTを提案した。
原題: Robots Acquire Manipulation Skills in Seconds from a Single Human Video / Guangyan Chen, Meiling Wang, Te Cui 他
日本語で読む → - 論文マニピュレーションロボティクス
Zero2Skill: 自律データ収集・訓練・展開によるロボットスキルのブートストラップ
人間の介入を減らしつつロボット操作スキルを自律的に学習するシステムを提案。修正を記憶して再利用することで、人間の作業時間を大幅に削減し、成功率を向上させた。
原題: Zero2Skill: Bootstrapping Robot Skills through Autonomous Data Collection, Training, and Deployment / Boyuan Wang, Zhenyuan Zhang, Zhiqin Yang 他
日本語で読む → - 論文シミュレーションロボティクス
OrchardBench: 農業ロボットのための物理基盤型GPU並列リンゴ園シミュレーションベンチマーク
リンゴ収穫ロボットの研究を加速するため、物理的に正確でGPU並列なリンゴ園シミュレータを開発した。
原題: OrchardBench: A Physically-Grounded, GPU-Parallel Apple-Orchard Simulation Benchmark for Agricultural Robotics / Humphrey Munn
日本語で読む → - 論文マニピュレーションロボティクス
物体姿勢の不確実性を扱うモジュール式ビンピッキングフレームワーク
物体の姿勢推定と把持プロセスで生じる誤差を同時に扱うモジュール式のビンピッキングフレームワークを提案し、実環境で3種類の物体を用いて有効性を検証した。
原題: Towards a Modular Bin-picking Framework for Handling Object Pose Uncertainties / Frederik Hagelskjær
日本語で読む → - 論文SLAMロボティクス
意味的半インクリメンタルなデータ対応不要のオブジェクトSLAM
本論文は、データ対応を明示的に行わずに、ロボットの姿勢、ランドマーク位置、およびランドマークの意味情報(クラスラベルや特徴ベクトル)を同時推定するSLAMフレームワークを提案している。
原題: Semantic Semi-Incremental Data-Association-Free Object SLAM / Yihao Zhang, Jungseok Hong, John J. Leonard
日本語で読む → - 論文HRIロボティクス
忘れられない:ヒューマノイドロボットヘッドKimのためのパーソナライズされたエピソード記憶の実装と評価
大規模言語モデルを使う対話ロボットに、過去の会話を記憶して再利用する軽量なエピソード記憶モジュールを実装し、オンライン実験で社会的知覚が向上することを示した論文。
原題: Not Forgotten: Implementation and Evaluation of a Personalized Episodic Memory for the Humanoid Robot Head Kim / Steve Aschenbrenner, Marcel Heisler, Thomas Sievers 他
日本語で読む → - 論文VLAロボティクス
具現化GPT-5.1:世界モデルの証拠か?
身体性やシミュレーション訓練を受けていない大規模マルチモーダルモデルGPT-5.1が、物理ロボットの高レベル制御としてナビゲーションや物体操作を実行できるかを探る探索的研究。
原題: Embodied GPT-5.1: Evidence of a World Model? / Roberto Spinelli, Thiago C. Martins
日本語で読む → - 論文エージェント/経験進化ロボティクス
LabEvolver: 訓練不要の経験進化による安全で接地されたウェットラボエージェント
実行経験からエピソード記憶を獲得し、安全検証を伴う適応的知覚・計画を行う訓練不要のフレームワークを提案。pH調整タスクで時間と安全介入を大幅削減し、ALFWorldでも成功率を向上させた。
原題: LabEvolver: Training-Free Experience Evolution for Safe and Grounded Wet-Lab Agents / Jingya Wang, Yuyang Gao, Liuzhenghao Lv 他
日本語で読む → - 論文ロコ操作ロボティクス
四脚ロコ操作のためのふくらはぎ統合アーム
四脚ロボットの前脚ふくらはぎにマニピュレータを統合し、四脚を接地したまま両手での操作を可能にする設計を提案。視覚言語モデルによる長期的な自律操作も実証した。
原題: Calf-Integrated Arms for Bimanual Quadruped Loco-Manipulation / Yan Pan, Yuanchuan Ren, Chipui Chan 他
日本語で読む → - 論文VLA/オフラインRLロボティクス
RedFlow: 失敗をアクションレベルの修正へと変換するフローマッチングVLAポリシー
フローマッチングVLAポリシー向けに、失敗データをアクションレベルの修正信号に変換するオフライン強化学習フレームワークRedFlowを提案。実世界成功率を56.7%から74.7%に向上させた。
原題: RedFlow: Redirect Failure into Action-Level Corrections for Flow-matching VLA Policy / Zhengyang Yan, Junhao Li, Fangqi Zhu 他
日本語で読む → - 論文シーングラフ生成画像認識
幾何学的2Dシーングラフ生成
組み立てロボットが部品の組み立て関係を理解できるよう、セマンティックデータに頼らず小さなデータセットでも動作する、部品間の組み立て関係を表すシーングラフを生成する手法を提案した。
原題: Geometric 2D Scene Graph Generation / Christoph Jahn, Urs Waldmann, Bastian Goldluecke
日本語で読む → - 論文群制御ロボティクス
COLMAR: マルチエージェント能動的3次元再構成のための協調視点ポリシー学習
複数のエージェントが限られたセンシング予算で効率的に視点を選び、冗長観測や空間的偏りを減らして高品質な3次元再構成を行う協調視点ポリシー学習フレームワークを提案した。
原題: COLMAR: Cooperative View Policy Learning for Multi-Agent Active 3D Reconstruction / Phu Pham, Damon Conover, Aniket Bera
日本語で読む → - 論文世界モデル機械学習
Koopman Dreamer:安定した世界モデル想像のためのスペクトル制約付き潜在ダイナミクス
Dreamerスタイルの世界モデルにKoopman理論に基づくスペクトル制約付きの決定論的潜在ダイナミクスを導入し、長期ロールアウトの安定性と制御性能を向上させた。
原題: Koopman Dreamer: Spectrally Constrained Latent Dynamics for Stable World-Model Imagination / Jiaqi Li, Xinglong Zhang, Haibin Xie 他
日本語で読む → - 論文歩行制御ロボティクス
壁支持二足歩行のためのマルチレート非線形モデル予測制御:四足ロボットの統合的計画・制御フレームワーク
四足ロボットが壁を利用して二足歩行するための、接触点と重心軌道を同時に計画するマルチレート非線形モデル予測制御(MR-NMPC)と全身制御を組み合わせた階層的制御フレームワークを提案した。シミュレーションで不整地や外乱下での頑健性を実証した。
原題: Multi-Rate Nonlinear Model Predictive Control for Wall-Supported Bipedal Locomotion of Quadrupedal Robots / Taizoon Chunawala, Jeeseop Kim, Kaveh Akbari Hamed
日本語で読む → - 論文VLA/ロバスト性/物理攻撃ロボティクス
照明、カメラ、誤動作:照明ロバスト性がVLAモデルを色盲にするとき
VLAモデルが照明変化に弱いことを突いた物理的スポットライト攻撃FLAREを提案し、さらに色情報を守る対抗訓練法ChromaGuardで攻撃下でも高い成功率を達成した。
原題: Lights, Camera, Malfunction: When Illumination Robustness Leaves VLA Models Blind to Color / Marino Watanabe, Takami Sato, Kentaro Yoshioka
日本語で読む → - 論文マニピュレーションロボティクス
暗黙の力覚を超えて:アクション・チャンキング・トランスフォーマーにおける明示的な力トルクプロキシの評価
本論文は、ACT(Action Chunking with Transformers)がリーダー・フォロワーテレオペレーションの追従誤差から暗黙に力情報を得ていることを示し、その信号を除去した場合の性能低下と、モーター電流や関節トルクを追加することで力覚を回復できることを実機タスクで検証した。
原題: Beyond Implicit Force: Evaluating Explicit Force-Torque Proxies in Action Chunking with Transformers / King Hang Wong, Lingqiao Liu, Feras Dayoub
日本語で読む → - 論文マニピュレーションロボティクス
SeededGrasp: 複数身体を持つ複雑なシーンにおける言語誘導型把持
視覚言語モデルで把持位置のシード点を予測し、軽量な把持生成モデルを条件付けることで、複数ロボット形態に対応したデータ効率の良い言語誘導把持を実現した。
原題: SeededGrasp: Language-Guided Grasping in Complex Scenes with Multiple Embodiments / Yang Xu, Gurpreet Singh Mukker, Raymond Wang 他
日本語で読む → - 論文UAV/身体化知覚ロボティクス
ActiveFly-Bench: 空中身体知覚のための身体化質問応答と視覚言語行動の統合
UAVの能動的知覚を評価する初のベンチマークを提案し、高次タスク理解から低次制御までを階層的に評価するエージェントを開発した。
原題: ActiveFly-Bench: Aligning Embodied Question Answering with Vision-Language-Action for Aerial Embodied Perception / Weichen Zhang, Shiquan Yu, Yinan Zhu 他
日本語で読む → - 論文プランニングロボティクス
敵対的環境下における確率的マルチ目的キノダイナミックプランニング
確率的に敵対モードへ遷移するハイブリッド敵対者を含む環境で、実行コストと安全違反リスクをトレードオフするパレート最適経路を、閉ループポリシー系列とモンテカルロ粒子ロールアウトを用いて構築する手法を提案した。
原題: Stochastic Multi-Objective Kinodynamic Planning Against Adversaries / Thomas Marshall Vielmetti, Daniel Cherenson, Dimitra Panagou
日本語で読む → - 論文VLAロボティクス
DeVA: 物理的ガイダンスを備えた分離型ビデオ・アクションモデルによるロボットポリシー学習
ビデオ生成とアクション予測を分離した専門家モジュールと物理的ガイダンスを導入し、ロボット操作ポリシーの学習効率と汎化性能を向上させた。
原題: DeVA: Decoupled Video-Action Model with physical guidance for robot policy learning / Mengqi Zhang, Sahil Khose, Simar Kareer 他
日本語で読む → - 論文SLAM/AR/ヒューマンロボット協調HCI
SHARE: 共有ヒューマンロボット作業空間におけるユーザー中心SLAMを用いたヘッドマウントARの実現
ARユーザーの遅延要件を優先しつつロボットの追跡精度も保つ、ユーザー中心のマルチエージェントSLAMシステムSHAREを設計・実装・評価した。
原題: SHARE: Towards Head-Mounted AR with User-Centric SLAM in Shared Human-Robot Workspaces / Tianyuan Du, Tianyi Hu, Hanting Ye 他
日本語で読む → - 論文医療ロボティクスロボティクス
腱駆動ロボットガイドワイヤ用ハンドヘルド駆動機構の開発
血管内治療のガイドワイヤ操作を支援するため、腱駆動式ロボットガイドワイヤを手で持って操作できるコンパクトな駆動機構を開発し、模擬大動脈モデルでのナビゲーションを実証した。
原題: Development of a Handheld Actuation Mechanism for a Tendon-driven Robotically Steered Guidewire / Saima Chavenet, Timothy A. Brumfiel, Revanth Konda 他
日本語で読む → - 論文センサフュージョン/運動推定ロボティクス
未知エネルギー放射源の運動推定のためのベアリング-強度法
受動センサで得られるベアリング(方位)と信号強度を組み合わせて、移動するエネルギー放射源の運動を推定する新しい手法を提案。従来の方位のみの手法では必要だったセンサの横方向運動の条件が不要になることを理論と実験で示した。
原題: A Bearing-Strength Method for Motion Estimation of Unknown Energy Emitters / Haoyu Chen, Zian Ning, Yin Zhang 他
日本語で読む →