論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/17 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文テレオペレーション/触覚ロボティクス
ViHaTeleop: 器用な操作学習のための低コスト・軽量な視覚-触覚テレオペレーションシステム
低コストで軽量な視覚-触覚テレオペレーションシステムを開発し、触覚フィードバックが接触が重要なタスクの成功率を向上させることを実証した。
原題: ViHaTeleop: A Low-Cost, Lightweight Visual-Haptic Teleoperation System for Dexterous Manipulation Learning / Fucai Zhu, Yanhou Lai, Paul Maestre 他
日本語で読む → - 論文VQA/操作計画画像認識
PROBE: VLMエージェントによる操作基盤の視覚質問応答
ロボットが隠れた物体を探すために操作が必要な動的シーンでの視覚質問応答(MG-VQA)を提案し、シミュレータとベンチマークを構築、VLMエージェントの性能を評価・微調整する手法を示した。
原題: PROBE: Manipulation-Grounded Visual Question Answering with VLM Agents / Vineet Bhat, Siyi Chen, Alex Zook 他
日本語で読む → - 論文マニピュレーションロボティクス
統一条件・行動モデリングによる高精度ワンステップ行動生成
条件と行動を共有トークン空間で統一的にモデリングするUCA-Flowを提案し、推論速度を大幅に向上させつつ成功率を9.3ポイント改善した。
原題: Unified Condition-Action Modeling for Accurate One-Step Action Generation / Xinyu Zhou, Zikun Cai, Kuangji Zuo 他
日本語で読む → - 論文操作計画ロボティクス
PDDL-ART: デモンストレーションからの自律的シンボリック抽象化による長期的ロボット操作のための視覚言語モデル
本論文は、単一の専門家デモと自然言語タスク記述からPDDLドメインと問題記述を自動生成するVLMベースのフレームワークPDDL-ARTを提案する。構文・意味・実行レベルの多段階補正パイプラインと、幾何・時間推論のためのツール使用を導入し、長期的操作タスクで有効性を示した。
原題: PDDL-ART: Autonomous Symbolic Abstraction From Demonstration For Long-Horizon Robotic Manipulation Using Vision-Language Models / Disha Kamale, Dmitry Berenson
日本語で読む → - 論文強化学習機械学習
世界モデルを用いたQ学習
Q学習に世界モデルを組み合わせ、実データのみで学習しつつ想像上の軌道で探索を行うことで、サンプル効率と性能を向上させる手法を提案した。
原題: Q-Learning With World Models / Perry Dong, Yueru Jia, Chelsea Finn 他
日本語で読む → - 論文LLM評価ロボティクス
監視・警備ロボット向けアイデンティティ依存LLM出力のベンチマーキング
LLMが生成する監視・警備ロボットの設計記述が、人口統計学的アイデンティティのラベルによって読みやすさに系統的な差が出るかを評価した論文。
原題: Benchmarking Identity-Sensitive LLM Outputs for Surveillance and Security Robots / Nneka Hyman, Jasmine Khan, Raj Korpan
日本語で読む → - 論文ハンド制御ロボティクス
H-PACハンド:劣駆動ロボットハンドの制御指向モデリングと腱弾性補償
腱駆動の劣駆動ハンドにおける腱伸びによる関節誤差を補償する制御手法を提案し、6アクチュエータ・15自由度のハンドで精度を大幅に改善した。
原題: H-PAC Hand: Control-Oriented Modeling and Tendon-Elasticity Compensation for an Underactuated Robotic Hand / Teng Yan, Jiongxu Chen, Teng Wang 他
日本語で読む → - 論文セキュリティロボティクス
状態が攻撃面となるとき:LLM駆動型具現化エージェントにおける状態意味注入攻撃
LLM駆動の具現化エージェントにおいて、環境状態を改ざんする「状態意味注入攻撃」を提案し、その脅威と防御の必要性を示した論文。
原題: When State Becomes an Attack Surface: State-Semantic Injection in LLM-Driven Embodied Agents / Jiawei Liu, Jiacheng Guo, Tian Zhang 他
日本語で読む → - 論文侵入検知cs.CR
車両パワートレインCANバスシステム向けデジタルツイン型侵入検知
CANバスのペイロード改ざん攻撃を検知するため、デジタルツインで車両の物理関係を学習し、予測と実測の残差から攻撃を検出する手法を提案した。実データで評価し、従来手法より高い検出率を達成した。
原題: Digital Twin-Based Intrusion Detection for Vehicle Powertrain CAN Bus Systems / Araf Rahman, M Sabbir Salek, Mashrur Chowdhury
日本語で読む → - 論文全身制御ロボティクス
ヒューマノイドロボットによるアメリカンフットボールのタイトスパイラル投げ
ヒューマノイドロボットがアメリカンフットボールを正確に投げるための全身制御戦略を提案し、リリース時のスピン注入と接触ダイナミクスを扱う。
原題: Throwing a Tight Spiral American Football by a Humanoid Robot / Zaid Mahboob, Bowen Weng
日本語で読む → - 論文経路計画ロボティクス
DEMデータ統合によるUGV自律航法のための地形認識型ローカル経路計画
低解像度のDEMデータとリアルタイムLiDARセンサを統合し、グローバル経路とローカル適応を組み合わせたUGVの経路計画フレームワークを提案。シミュレーションで障害物回避率95%と平均斜面角度の低減を達成した。
原題: Terrain-Aware Local Path Planning with Global DEM Data Integration for Autonomous UGV Navigation / Devender Singh, Issah Nazif Suleiman, Paul Mitten 他
日本語で読む → - 論文軌道上ナビゲーションロボティクス
軌道プランナー:衛星エージェントの軌道上障害物回避のための潜在世界モデル
軌道上の衛星ナビゲーション向けに、潜在空間で将来状態を予測する2段階の世界モデルを提案し、物理状態を復元するプローブを導入。シミュレーションで91.7%の成功率を達成。
原題: Orbit-Planner: Towards Latent World Models for On-Orbit Obstacle Avoidance of Satellite Agents / Zhijian Li, Chao Ren, Peijin Wang 他
日本語で読む → - 論文強化学習/ベンチマークAI
クロノクックド:強化学習エージェントにおける暗黙の区間タイミングのベンチマーク
調理シナリオを通じて、強化学習エージェントの時間知覚能力を評価するベンチマークスイートを提案し、時間情報が明示されない環境での性能を検証する。
原題: Chronocooked: A Benchmark for Implicit Interval Timing in Reinforcement Learning Agents / Amrapali Pednekar, Alvaro Garrido-Perez, Yara Khaluf 他
日本語で読む → - 論文ソフトロボティクスロボティクス
重力負荷下での大型高力ソフトロボットマニピュレータの設計最適化
ソフトロボットの腕の形状を最適化し、自重による座屈を防ぎつつブロッキング力を最大化する手法を提案。閉形式解を示し、実験で有効性を検証した。
原題: Design Optimization for Large High-Force Soft Robot Manipulators Under Gravitational Loads / Isara Cholaseuk, Penelope Llibre, Alexa Kyriacou 他
日本語で読む → - 論文マニピュレーションロボティクス
意味と密度を考慮したアクセシビリティ維持型マルチオブジェクト配置計画
家庭用ロボットが棚に複数の物体を順次配置する際、意味的な整理、空間の高密度利用、操作のしやすさを同時に考慮する計画手法SDPPを提案した。
原題: Semantic- and Density-Aware Planning for Accessibility-Preserving Multi-Object Placement / Benno Wingender, Nils Dengler, Nicolas Busch 他
日本語で読む → - 論文VLA/操作ロボティクス
SparkVLA: 長期的操作のための適応アクションチャンクを備えた停止認識型階層VLA
階層型VLAシステムにおけるサブタスクの停止タイミングとアクションチャンク長の相互依存関係を単一のランキング問題として定式化し、統一候補セットから最適解を選択する新しい手法を提案した。
原題: SparkVLA: Stop-Aware Hierarchical VLA with Adaptive Action Chunking for Long-Horizon Manipulation / Xunyao Lei, Renjun Wu, Tianlin Huo 他
日本語で読む → - 論文群制御ロボティクス
プランナー条件付き拡散による協調マルチエージェント探索
複数のプランナーのデモから学習し、プランナーIDを条件として与えることで多様な軌道を生成できる拡散ポリシーを提案。局所的な再ランキングでエージェント間の重複を減らし、協調探索を実現した。
原題: Planner-Conditioned Diffusion for Coordinated Multi-Agent Exploration / Marcus Yu Siong Teo, Jeric Lew, Tanishq Duhan 他
日本語で読む → - 論文HDRイメージング画像認識
深度ガイドによる多視点露出ブラケティングを用いたHDRロボットビジョン
極端な照明条件下での単一ショットHDR撮像を実現するため、多視点カメラに異なる露出を割り当て、深度情報で融合する手法DMEBを提案し、ロボット用の大規模HDRデータセットも構築した。
原題: Depth-guided Multi-view Exposure Bracketing for HDR Robot Vision / Jinnyeong Kim, Juhyung Choi, Woohyeok Kim 他
日本語で読む → - 論文自動運転/倫理/強化学習機械学習
倫理的判断ヘッド:人間のフィードバックからの強化学習による自動運転車の規範倫理の実装
自動運転車の倫理的判断を強化学習で実装するフレームワークを提案し、功利主義とカント主義の二つの規範を評価した。人間の好みに基づく報酬モデルを用いて訓練し、倫理フレームワークの学習可能性の非対称性を明らかにした。
原題: The Ethical Decision Head: Operationalizing Normative Ethics in Autonomous Vehicles via Reinforcement Learning from Human Feedback / Thomas Mbrice, Ammar Ali, Sami Mian 他
日本語で読む → - 論文VLA/プランニングロボティクス
ニューロシンボリック具現化エージェント
視覚言語モデルとシンボリックプランニングを組み合わせ、家庭内の長期的タスクを実行可能な計画として生成するエージェントを提案。探索と制約付き計画により、実行可能性を保証しつつ高い成功率を達成。
原題: Neurosymbolic Embodied Agents / Mohammad Albinhassan, Yuming Feng, Alessandra Russo 他
日本語で読む → - 論文移動操作/sim2realロボティクス
FetchMan: シミュレーション経験から学ぶ視覚的ヒューマノイド移動操作ポリシー
シミュレーションで合成デモをクローンするだけでは性能が頭打ちになることを発見し、強化学習とFlow-GRPOによる微調整を組み合わせたエンドツーエンドのsim-to-realパイプラインを構築。実機Unitree G1で未見シーンへのゼロショット到達・把持を73.3%の成功率で達成した。
原題: FetchMan: Learning Visual Humanoid Loco-Manipulation Policies from Simulated Experiences / Omar Rayyan, Zhi Li, Max Argus 他
日本語で読む → - 論文水中追跡制御
移動地平線推定によるTDoA計測を用いた水中ターゲット追跡
水中ターゲット追跡のためのTDoA計測に基づく移動地平線推定(MHE)手法を提案し、シミュレーションでEKFより頑健な追跡性能を示した。
原題: Moving Horizon Estimation for Underwater Target Tracking Based on Time-Difference-of-Arrival Measurements / Anton Tolstonogov, David Cabecinhas, Pedro Batista 他
日本語で読む → - 論文模倣学習ロボティクス
SurgVIL: オープンソース手術動画による手術ロボット模倣学習の大規模化
手術ロボットの模倣学習において、実組織の動画データから弱い教師信号として運動学を推定し、ファントムデータと組み合わせて学習することで、実組織や分布外環境への汎化性能を向上させるフレームワークを提案した。
原題: SurgVIL: Scaling Surgical Robot Imitation Learning with Open-source Surgical Videos / Xinhao Chen, JuoTung Chen, Nigel Nelson 他
日本語で読む → - 論文制御/マルチロータロボティクス
レディネス障壁関数:過アクチュエーションマルチロータ配分の前方不変制御権限
過アクチュエーションマルチロータの配分問題で、制御権限を前方不変量として扱い、制御障壁関数を用いてトルクレベルで制約を課すことで、連続性と権限保証を両立する手法を提案した。
原題: Readiness Barrier Functions: Forward-Invariant Control Authority for Overactuated Multirotor Allocation / Giuseppe Silano
日本語で読む → - 論文歩行AI
不整地での脚式移動のための軌跡レベル自動カリキュラム学習
不整地での脚式移動ポリシー学習において、地形マップから直接タスクを生成する軌跡レベルの自動カリキュラム学習フレームワークを提案し、成功率を大幅に向上させた。
原題: Trajectory-Level Automatic Curriculum Learning for Legged Locomotion on Unstructured Terrain / Rocky Liu, Tengyu Liu, Baoxiong Jia 他
日本語で読む → - 論文VLAロボティクス
教えて育てる:汎用ロボット学習のためのエージェント中心アーキテクチャ
この論文は、少数のデモから再利用可能なスキルブロックを学習し、新しいシーンでそれらを組み合わせてタスクを実行するエージェント中心のアーキテクチャ(TGL)を提案し、再学習の負担を軽減する。
原題: Teach and Grow: An Agent-Centered Architecture for General Robot Learning / Chang Nie, Zhe Liu, Hesheng Wang
日本語で読む → - 論文センサ融合ロボティクス
サイクロプス:色を夢見るカメラとしてのLiDAR
低照度や高ダイナミックレンジ環境で劣化するカメラの代わりに、照明に依存しないLiDAR強度をRGBビデオに変換するフレームワーク「Cyclops」を提案し、カメラなしで終日認識タスクを可能にする。
原題: Cyclops: LiDAR as a Camera That Dreams in Color / Wei Gao, Jian Shu, Mingle Zhao 他
日本語で読む → - 論文群制御ロボティクス
採餌ロボット群のための適応的反発フェロモンクラスタリング
ロボット群の採餌効率を高めるため、探索済み領域に反発フェロモンを配置して未探索領域へ誘導する適応的反発フェロモンクラスタリング(ARPC)を提案し、シミュレーションで既存手法より優れた性能を示した。
原題: Adaptive Repulsive Pheromone Clustering for Foraging Robot Swarms / Carlos Pena-Caballero, Constantine Tarawneh, Qi Lu
日本語で読む → - 論文マニピュレーションロボティクス
VLCP: 視覚言語制御ポリシーによるロボット操作の閉ループコード再計画
凍結した視覚言語モデルを制御コード生成に用い、デモや微調整なしでロボット操作ポリシーを実現。エピソード内でコードを再計画することで失敗を修正し、成功率を大幅に向上させた。
原題: VLCP: Vision Language Control Policy Closed-Loop Code Replanning for Robot Manipulation / Dhia Naouali, Minghan Wu, Claudia Wong 他
日本語で読む → - 論文地理的定位画像認識
X$^2$Localizer: プログレッシブなクロスビュー動画地理的定位のためのクロス粒度アライメント
本論文は、地上視点の動画を対応する航空画像に位置づけるクロスビュー動画地理的定位(CVG)を、部分的な観測や動的な時間予算に対応できるプログレッシブな設定(PCVG)に拡張し、新しいフレームワークX$^2$Localizerを提案する。
原題: X$^2$Localizer: Cross-grained Alignment for Progressive Cross-view Video Geo-localization / Zichao Zeng, Weijia Fan, Yufan Chen 他
日本語で読む →