論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/5/1 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文テレオペレーション/データ品質ロボティクス
テレオペレーションのループを閉じる:高品質なデモ収集のためのエピソードレベルデータ品質評価とフィードバック
テレオペレーションによるデモ収集において、タスク成功だが下流利用に不適切なエピソードを検出し、セマンティックなタスク進捗とロボットテレメトリに基づく即時フィードバックを提供するフレームワークを提案した。
原題: Closing the Loop in Teleoperation: Episode-Level Data Quality Assessment and Feedback for High-Quality Demonstration Collection / Gokul Narayanan, Yash Shahapurkar, Melih Erdogan 他
日本語で読む → - 論文報酬学習ロボティクス
PrefMoE: 混合専門家報酬学習による頑健な選好モデリング
ノイズや矛盾を含む選好データから複数の報酬専門家を学習し、軌跡レベルのソフトルーティングで適応的に組み合わせることで、頑健な選好モデリングを実現する手法を提案した。
原題: PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning / Ziqin Yuan, Ruiqi Wang, Dezhong Zhao 他
日本語で読む → - 論文群制御ロボティクス
V2X環境におけるマルチロボット協調
本論文は、都市交通環境で動作するソーシャルロボット群の分散協調を可能にするV2X通信フレームワークを提案し、ロボット向けの認識・操作調整サービスを実装・評価した。
原題: Multi-Robot Coordination in V2X Environments / John Pravin Arockiasamy, Alexey Vinel
日本語で読む → - 論文ガス源探索ロボティクス
キャリブレーション不要の移動ロボットによるガス源位置推定:濃度測定順位に基づく発生源推定
低コストセンサの非線形応答や環境依存性を回避するため、ガス濃度の測定値の順位情報を用いて発生源位置を確率的に推定する手法を提案し、シミュレーションと実機実験で有効性を示した。
原題: Calibration-Free Gas Source Localization with Mobile Robots: Source Term Estimation Based on Concentration Measurement Ranking / Wanting Jin, Agatha Duranceau, İzzet Kağan Erünsal 他
日本語で読む → - 論文3次元復元画像認識
TriP: 三角形パズルによる頑健な並進平均化手法
カメラ位置復元のための並進平均化問題に対し、三角形の幾何から局所スケールを推定し、対数領域で同期させることで、外れ値に頑健で高精度な解法を提案した。
原題: TriP: A Triangle Puzzle Approach to Robust Translation Averaging / Zhekai Fan, Wanze Li, Jinxin Wang 他
日本語で読む → - 論文自動運転ロボティクス
自動運転における遅延と精度のトレードオフ最適化のための多解像度エンドツーエンド深層ニューラルネットワーク
自動運転のリアルタイム性と精度の両立を目指し、シーンや計算資源に応じて入力解像度を動的に切り替えられる多解像度CNNを提案し、CARLA環境で安全性指標の改善を実証した。
原題: Multi-Resolution End-to-End Deep Neural Network for Optimizing Latency-Accuracy Tradeoff in Autonomous Driving / Qitao Weng, Heechul Yun
日本語で読む → - 論文自動運転/リスクマップロボティクス
部分観測環境における自動運転のための統合リスクマップ学習
自動運転における遮蔽によるリスクを、交通流リスクと衝突リスクを統合したリスクマップとしてモデル化・学習し、拡散モデルによる敵対的シナリオ生成も組み合わせて、部分観測下でのリスク認識計画を実現した。
原題: Learning A Unified Risk Map for Autonomous Driving in Partially Observable Environments / Jie Jia, Yaofeng Su, Zeyu Bao 他
日本語で読む → - 論文物理特性推定ロボティクス
PhyPush: 物理誘導トランスフォーマーによるセンサレス物理特性推定は1回の押し動作で十分
ロボットアームのエンドエフェクタの速度情報のみを用いて、物体の質量と摩擦係数を1回の押し動作から推定する物理誘導トランスフォーマーを提案した。
原題: PhyPush: One Push is All You Need for Sensorless Physical Property Estimation with Physics-Guided Transformers / Koyo Fujii, Luis Figueredo, Praminda Caleb-Solly 他
日本語で読む → - 論文群制御ロボティクス
タスク意味グラフ駆動の分散エージェントネットワークによる水中目標追跡
AUV群による水中目標追跡のためのオープンソースMARLプラットフォームを構築し、タスク意味グラフを活用したSTG-MAPPOアルゴリズムを提案した。
原題: Task-Semantic Graph-Driven Distributed Agent Networking for Underwater Target Tracking / Shengchao Zhu, Guangjie Han, Chuan Lin 他
日本語で読む → - 論文教示学習ロボティクス
ロボットへの教示方法の比較:運動感覚、ジョイスティック、ジェスチャーによる教示
8人の参加者によるユーザー研究で、運動感覚ガイダンス、ジョイスティック遠隔操作、手のジェスチャーの3つの教示方法を比較し、再現成功率、作業負荷、教示エラーを評価した。
原題: How Should We Teach Robots? A Comparison of Kinesthetic, Joystick, and Gesture-Based Teaching / Petr Vanc, Jan Kristof Behrens, Václav Hlaváč 他
日本語で読む → - 論文模倣学習ロボティクス
低解像度自己中心視覚を用いた能動的知覚のための行動クローニング
低解像度の自己中心視覚と行動クローニングを用いて、ロボットアームが物体を見つけて把持するための能動的知覚を獲得できることを示した論文。
原題: Behavior Cloning for Active Perception with Low-Resolution Egocentric Vision / Anthony Bilic, Chen Chen, Ladislau Bölöni
日本語で読む → - 論文マニピュレーションロボティクス
TapSampling: タスク進捗理解型検証器を用いた推論時サンプリングによるロボット操作
ロボット操作の汎用ポリシーに対して、推論時に複数の行動候補をサンプリングし、タスク進捗を予測する検証器で最適な行動を選ぶプラグアンドプレイなフレームワークを提案した。
原題: TapSampling: Inference-Time Sampling with a Task-Progress-Understanding Verifier for Robotic Manipulation / Sizhe Zhao, Shengping Zhang, Shuo Yang 他
日本語で読む → - 論文マニピュレーションロボティクス
反復作業を含む建設活動のための操作計画
VR環境での単一デモンストレーションから建設作業の操作スキルを獲得し、スクリュー運動の幾何学を用いて反復的な建設タスクをロボットで実行する手法を提案した。
原題: Manipulation Planning for Construction Activities with Repetitive Tasks / Wangyi Liu, Dasharadhan Mahalingam, Fanru Gao 他
日本語で読む → - 論文模倣学習/操作ロボティクス
人間の遠隔操作データから学ぶ、シミュレーション基盤の双腕ロープ操作ポリシー
この論文は、結び目を解くタスクにおいて、視覚ベースのポリシーよりも物理状態ベースのポリシーの方が汎化性能が高いことを示し、観測空間の選択が重要であることを明らかにした。
原題: Learning Sim-Grounded Policies for Bimanual Rope Manipulation from Human Teleoperation Data / Gina Wigginghaus, Tim Missal, Berk Guler 他
日本語で読む → - 論文シミュレーションロボティクス
関節物体のシミュレーション物理を自動改善する手法
不完全な3Dアセットから、シミュレーションで安定して操作可能な関節物体を自動生成する手法を提案。物理特性を推論し、シミュレータからのフィードバックで反復的に改善する。
原題: Automatically Improving Simulation Physics for Articulated Objects / Anh-Quan Pham
日本語で読む → - 論文自動運転/VLA画像認識
逆運動学による運転VLAの接地
運転VLAの軌道予測が視覚トークンを無視する問題を、逆運動学の観点から再設計し、将来の視覚状態予測と専用の逆運動学ネットワークを導入することで、小規模モデルでも大規模VLAに匹敵する性能を達成した。
原題: Grounding Driving VLA via Inverse Kinematics / Junsung Park, Hyunjung Shim
日本語で読む → - 論文VLA/ナビゲーション画像認識
SpaAct: 空間活性化遷移学習とカリキュラム適応による視覚言語ナビゲーション
視覚言語ナビゲーション(VLN)のためのVLM適応フレームワークSpaActを提案。後方行動推論と前方遷移予測の2つの空間活性化タスクと、TriPAカリキュラム学習により動的空間認識を獲得し、VLN-CEベンチマークでSOTAを達成。
原題: SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation / Pengna Li, Kangyi Wu, Shaoqing Xu 他
日本語で読む → - 論文群制御制御
不確かな外力下でのカテナリーロボットのロバスト幾何学的制御
2台のクアッドローターを非伸縮ケーブルで連結したカテナリーロボットのロバスト制御を提案し、ケーブル形状による不確かな力に対する追従誤差の入力-状態安定性を理論的に示した。
原題: Robust Geometric Control of Catenary Robots under Unstructured Force Uncertainties / Alexandre Anahory Simoes, Leonardo Colombo
日本語で読む → - 論文形式的議論cs.LO
BAss: 抽象弁証法的枠組みにおける記号的推論
二分決定図を用いて抽象弁証法的枠組みの解釈を効率的に列挙する新しい記号的ソルバーを提案し、既存ツールを大幅に上回る性能を示した。
原題: BAss: Symbolic Reasoning in Abstract Dialectical Frameworks / Samuel Pastva, Van-Giang Trinh
日本語で読む → - 論文シミュレーション環境構築画像認識
World2Minecraft: 占有駆動によるシミュレーションシーン構築
実世界のシーンを3Dセマンティック占有予測に基づいてMinecraft環境に変換する手法を提案し、データ収集パイプラインと大規模データセットMinecraftOccを導入して、占有予測の性能向上とカスタマイズ可能な具現化AI研究プラットフォームを実現した。
原題: World2Minecraft: Occupancy-Driven Simulated Scenes Construction / Lechao Zhang, Haoran Xu, Jingyu Gong 他
日本語で読む → - 論文3Dビジョン/潜在表現画像認識
ガウス的ボトルネックを超えて:Vision-Transformer特徴空間の位相整合エンコーディング
シーンの3D幾何構造を保存するため、Power Spherical分布を用いた新しいVAE(S^2VAE)を提案し、深度推定・カメラポーズ復元・点群再構成で従来のガウス潜在変数より優れることを示した。
原題: Beyond Gaussian Bottlenecks: Topologically Aligned Encoding of Vision-Transformer Feature Spaces / Andrew Bond, Ilkin Umut Melanlioglu, Erkut Erdem 他
日本語で読む → - 論文意図推論画像認識
文脈を事前分布として:非言語エージェントのためのベイズ的意図推論と家庭猫テストベッド
家庭猫などの非言語エージェントの意図を、空間文脈を事前分布として扱うベイズ的枠組みで推論する手法を提案し、データセットで精度向上とショートカット失敗の低減を確認した。
原題: Context as Prior: Bayesian-Inspired Intent Inference for Non-Speaking Agents with a Household Cat Testbed / Wenqian Zhang, Zehao Wang
日本語で読む → - 論文構成的一般化/神経記号的AIAI
AGEL-Comp: 対話型エージェントにおける構成的一般化のための神経記号的枠組み
LLMベースのエージェントの構成的一般化の失敗に対処するため、動的因果プログラムグラフと帰納論理プログラミング、神経定理証明器を統合した神経記号的アーキテクチャAGEL-Compを提案し、シミュレーション環境でその有効性を示した。
原題: AGEL-Comp: A Neuro-Symbolic Framework for Compositional Generalization in Interactive Agents / Mahnoor Shahid, Hannes Rothe
日本語で読む → - 論文3D視覚グラウンディング画像認識
複数一貫した2D-3Dマッピングによる頑健なゼロショット3D視覚グラウンディング
ゼロショット3D視覚グラウンディングの性能を、2D-3D間の一貫性を明示的に確立するフレームワークMCM-VGを提案して向上させた。
原題: Multiple Consistent 2D-3D Mappings for Robust Zero-Shot 3D Visual Grounding / Yufei Yin, Jie Zheng, Qianke Meng 他
日本語で読む → - 論文世界モデル/計画/制御画像認識
身体化世界モデルの高次化による計画と制御の実現
高次元の関節動作空間を直接探索する代わりに、高レベル行動を低レベル関節動作列に変換する軽量ポリシーを訓練し、凍結した世界モデルと組み合わせて高レベル行動から未来観測を予測する「持ち上げられた世界モデル」を提案。人間型エージェントで2Dウェイポイントを高レベル行動とし、低レベル探索より3.8倍精度が向上。
原題: Lifting Embodied World Models for Planning and Control / Alex N. Wang, Trevor Darrell, Pavel Izmailov 他
日本語で読む → - 論文群制御制御
連続体群ロボットの分散制御:局所コントローラを微分作用素として捉える
大規模ロボット群を連続体密度としてモデル化し、分散コントローラを微分作用素として定式化する枠組みを提案。目標密度への安定化問題を解析し、純点状コントローラの限界を示すとともに、強い安定性を持つ1次制御則を提示した。
原題: On Distributed Control of Continuum Swarms: Local Controllers as Differential Operators / Max Emerick, Saroj Prasad Chhatoi, Bassam Bamieh
日本語で読む → - 論文強化学習機械学習
人間フィードバックを活用した意味的に有用なスキル発見
強化学習における教師なしスキル発見に人間のフィードバックを組み込み、意味的に多様で関連性のあるスキルを効率的に発見する手法を提案した。
原題: Leveraging Human Feedback for Semantically-Relevant Skill Discovery / Maxence Hussonnois, Thommen George Karimpanal, Santu Rana
日本語で読む → - 論文群制御制御
非凝集ターゲットの障害物回避型マルチロボット羊飼い制御
障害物の多い環境で、互いに凝集しないターゲット群を誘導するためのマルチロボット制御戦略を提案し、シミュレーションと実機実験で有効性を検証した。
原題: Multi-robot obstacle-aware shepherding of non-cohesive target agents / Cinzia Tomaselli, Stefano Covone, Andreagiovanni Reina 他
日本語で読む → - 論文空間推論画像認識
SpaMEM: 身体化環境における知覚-記憶統合による動的空間推論のベンチマーク
マルチモーダル大規模言語モデルの身体化環境での長期的空間推論能力を評価する大規模ベンチマークSpaMEMを提案し、行動系列による空間状態変化を伴うタスクでモデルの限界を明らかにした。
原題: SpaMEM: Benchmarking Dynamic Spatial Reasoning via Perception-Memory Integration in Embodied Environments / Chih-Ting Liao, Xi Xiao, Chunlei Meng 他
日本語で読む → - 論文マルチエージェントシステムcs.MA
単一エージェントの整合を超えて:マルチエージェントシステムにおけるコンテキスト断片化違反の防止
個々のエージェントの行動は安全に見えるが、組織ポリシーに違反する「コンテキスト断片化違反」を特定し、分散型ゼロトラスト執行アーキテクチャ「Distributed Sentinel」を提案する。
原題: Beyond Single-Agent Alignment: Preventing Context-Fragmented Violations in Multi-Agent Systems / Jie Wu, Ming Gong
日本語で読む →