論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/4 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文VLAロボティクス
一言で変わる行動:言語条件付き身体化推論の実ロボットベンチマーク
タスクが変わらない場合は行動を維持し、タスクが変わった場合のみ行動を正しく更新する能力を評価する、実ロボット向けの新しいベンチマークを提案した。
原題: One Word, Different Action: A Real-Robot Benchmark for Language-Conditioned Embodied Reasoning / Yiwei Liu, Luwei Yang, Shunbo Lei
日本語で読む → - 論文ナビゲーションロボティクス
NavArena: 3Dガウススプラッティング再構成からの目標指向ナビゲーションベンチマークの自動構築
固定された3DGS再構成を、到達可能性や衝突判定、意味的目標を備えたナビゲーションベンチマークへ自動変換するフレームワークを提案し、2,000以上のシーンで2,220万の専門家軌道を生成して評価する。
原題: NavArena: Automated Construction of Goal-Oriented Navigation Benchmarks from 3D Gaussian Splatting Reconstructions / Junhui Wang, Wei Yang, Xinyao Li 他
日本語で読む → - 論文姿勢推定画像認識
音に基づく複数人物の3D姿勢推定
音響信号のみから複数人物の3D姿勢を推定する初の試みで、重なり合う音響特徴を分離するエンコーダ・デコーダフレームワークを提案した。
原題: Sound-based Multi-Person 3D Pose Estimation / Yusuke Oumi, Yuto Shibata, Go Irie 他
日本語で読む → - 論文ハードウェアアクセラレータcs.AR
APEX-RBD: ハードウェア効率的なロボット動力学アクセラレータ設計のための混合精度探索フレームワーク
剛体動力学計算のハードウェアアクセラレータ設計において、変数の感度差を考慮した混合精度探索を効率化する自動フレームワークを提案し、面積と消費電力を大幅に削減する構成を発見した。
原題: APEX-RBD: Mixed-Precision Exploration Framework for Hardware-Efficient Robot Dynamics Accelerator Design / Xingyu Liu, Hanwei Fan, Chaofang Ma 他
日本語で読む → - 論文最適制御制御
ルールブックを用いたリスク認識型最適制御
複数の要件を優先度とリスク評価で扱う安全制御問題に対し、リスク認識型ルールブックを定義し、辞書式最適化と枝刈りアルゴリズムで最適性ギャップを保証する手法を提案した。
原題: Risk-Aware Optimal Control with Rulebooks / Tichakorn Wongpiromsarn
日本語で読む → - 論文マニピュレーションロボティクス
ロボットハンド操作における形態と駆動方式の帰納的バイアス
ロボットハンドの形態と駆動方式が操作性能に与える影響を、タスクヤコビアンと駆動行列の条件数を用いて解析し、強化学習実験で検証した論文。
原題: Morphology and actuation as inductive biases in robotic hand manipulation / Zalán Tari, Eszter Birtalan, Péter Polcz 他
日本語で読む → - 論文3Dシーン生成画像認識
SceneMosaic: ハイブリッドエージェント的レイアウト進化による効率的で多様なシミュレーション対応シーン生成
画像ベースの事前知識とVLMエージェントを組み合わせ、屋内シーンを局所単位で進化させて高品質かつ物理的に妥当な多様な3Dシーンを高速生成するフレームワークを提案した。
原題: SceneMosaic: Efficient and Diverse Simulation-Ready Scene Generation via Hybrid Agentic Layout Evolution / Xingjian Ran, Xiaoye Mo, Sihao Liu 他
日本語で読む → - 論文協調自動運転ロボティクス
CoLMIN: LLMに基づく協調自動運転のためのマルチ決定経路交渉
複数車両の協調自動運転において、LLMの推論能力を活用し、複数の運転意図を生成・評価する交渉フレームワークCoLMINを提案。浅い反射と深い反射を組み合わせて、複雑な交通シナリオでの安定した合意形成を実現する。
原題: CoLMIN: LLM-based Multi-Decision Path Negotiation for Cooperative Autonomous Driving / Zhe Huang, Zhaoxin Fan, Shuo Wang 他
日本語で読む → - 論文ナビゲーションロボティクス
自律ロボットナビゲーション失敗予測のための適応コスト考慮型機械学習:すべての誤りが等しいわけではない
ナビゲーション失敗の予測を、カテゴリの深刻度だけでなく速度や障害物距離などの物理的文脈を考慮したコスト関数で重み付けする適応的手法を提案し、シミュレーションと実データで高深刻度の再現率を向上させた。
原題: Adaptive Cost-Sensitive Machine Learning for Autonomous Robot Navigation Failure Prediction: When Not All Errors Are Equal / Rifa Ferzana
日本語で読む → - 論文マニピュレーションロボティクス
意図を考慮したロボットから人への両手受け渡しのための時間的触覚符号化とコンプライアンス制御
ロボットから人への物体受け渡しにおいて、視覚だけでは受け取り意図を判別できない問題に対し、VLAモデルに時間的触覚フィードバックとコンプライアンス制御を組み合わせ、安全で快適な受け渡しを実現する手法を提案・評価した。
原題: Temporal Tactile Encoding and Compliance for Intent-Aware Robot-to-Human Bimanual Handover / Pasquale Marra, Stefano Berti, Gabriele Mario Caddeo 他
日本語で読む → - 論文マニピュレーションロボティクス
物理カーネル:暗所マニピュレーションのための構造化視覚潜在表現
短時間の照明下での書き込みで視覚潜在z0を符号化し、その後は画素入力なしで方策と開ループ動力学が接触の多いスキルを実行できることを示した研究。
原題: Physical Kernel: Structured Visual Latents for Dark Manipulation / Jinting Hang, Hong Li, Zhenhui Cai 他
日本語で読む → - 論文エージェントAIAI
言語モデルから世界行動システムへ:デジタル・社会・仮想・物理環境におけるエージェントAIの進歩と限界
大規模言語モデルが外部状態を変えるエージェントとなる際の進歩と限界を、委任された権限、時間的持続性、環境結合の観点から批判的にレビューした論文。
原題: From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Digital, Social, Virtual, and Physical Environments / Linsen Zhu, Mengqing Cai
日本語で読む → - 論文VLAロボティクス
GE-Act 2.0: ロボット操作のためのワールドアクションモデルの事前学習とスケーリング
操作データのみで生成・行動コンポーネントをゼロから学習するワールドアクションモデルを提案し、大規模データでの事前学習とスケーリングの効果を検証した。
原題: GE-Act 2.0: Pretraining and Scaling a World-Action Model for Robotic Manipulation / AgiBot Research Team, Renhang Liu, Wenzhi Zhao 他
日本語で読む → - 論文遠隔制御ロボティクス
結合制御と無線ワールドモデルによる頑健な遠隔ロボット制御
無線ネットワーク上の遠隔ロボット制御において、通信資源の制約や不安定な接続に頑健なフレームワークを提案。カメラ画像と無線信号の表現を統合したJEPAワールドモデルで将来の状態を予測し、通信スケジューリングを最適化する。
原題: Coupled Control and Wireless World Models for Resilient Remote Robotic Control / H. P. Madushanka, Sumudu Samarakoon, Mehdi Bennis
日本語で読む → - 論文群制御/セキュリティ制御
ハードウェア認証とパケットタイミング透かしによるミッションクリティカルなロボット群の実践的ゼロトラスト
ROS 2ベースの無人車両群に対し、TPM 2.0によるハードウェア認証とパケット間遅延の統計的透かしを組み合わせたゼロトラストセキュリティフレームワークを提案・実証し、ステルス型中間者攻撃を完全検出した。
原題: Practical Zero-Trust for Mission-Critical Robotic Fleets via Hardware Attestation and Packet Timing Watermarking / Ryne Gonzales, Ethan Liesdyanto, Rex Worley 他
日本語で読む → - 論文耐障害性制御制御
妨害電波下での自律走行車の耐障害性制御ループ:スペクトル認識とネットワーク層フェイルオーバーによる実現
自律移動ロボットの無線制御ループを妨害電波から守るため、物理層のスペクトル認識とネットワーク層の経路最適化を組み合わせた耐障害性フレームワークを提案し、ROS2搭載ロボットで通信復旧時間を平均141msに短縮、追従誤差を78.9%削減した。
原題: Resilient Control Loops in Autonomous Vehicles Under Adversarial Jamming via Spectral Perception and Network-Layer Failover / Luis Barajas, Colin Jeardoe, Jaewon Kim 他
日本語で読む → - 論文ナビゲーションロボティクス
密集・不確実な群衆中のロボットナビゲーションのための人-人・人-ロボット相互作用トランスフォーマー (H2INT)
群衆中のロボットナビゲーションにおいて、歩行者がロボットの存在に応じて動きを変えることを明示的にモデル化する強化学習フレームワークを提案。人-人・人-ロボット関係を階層的に符号化するトランスフォーマーと、応答性を段階的に低下させるカリキュラム学習により、安全性と頑健性を向上させた。
原題: Human-Human & Human-Robot Interaction Transformer (H2INT) for Robot Navigation in Dense and Uncertain Crowds / Ao Shen, Kaixi Chen, Shiwei Liu 他
日本語で読む → - 論文群制御ロボティクス
局所学習を不安定化させないロボットポリシー精錬のためのスキーマ拘束型言語モデル
異種ロボット群の分散ナビゲーションにおいて、LLMによるポリシー生成をラウンド単位に限定し、UCBバンディットとDouble DQNで局所制御を安定化させる手法を提案・評価した。
原題: A Schema Bounded Language Model for Refining Robot Policies Without Destabilizing Local Learning / Chongwen Dong, Mithun Paul Saint-Germain, Pinjari Asif 他
日本語で読む → - 論文LLM評価/道徳的意思決定自然言語
LLMは知覚された道徳的主体性をどう評価するか?人間と人工エージェントの相互作用における道徳的意思決定の調査
人間とLLMが、スマートシティのシナリオにおける人間および自律型人工エージェントの道徳的主体性をどう評価するかを比較した初の実証研究。
原題: How do LLMs Evaluate Perceived Moral Agency? Investigating Moral Decision-Making in Human-Artificial Agents Interactions / Fernanda Mansilla, Aloysius Tok, Bahia Guellaï 他
日本語で読む → - 論文触覚/操作ロボティクス
TacPAC: 接触リッチ操作のためのワールドアクションモデルにおける触覚予測とリアルタイム行動修正
視覚中心のワールドアクションモデルに触覚予測を組み込む際、予測と実行のタイミング差が問題となる。TacPACは、計画された行動チャンクに基づく触覚予測をキャッシュし、実行中に得られる実触覚画像と照合して未実行の行動をリアルタイムに修正する手法を提案し、5つの実ロボットタスクで成功率を大幅に向上させた。
原題: TacPAC: Tactile Prediction and Real-Time Action Correction in World-Action Models for Contact-Rich Manipulation / Zipei Ma, Xiaofei Wei, Junzhe Jiang 他
日本語で読む → - 論文力学系制御ロボティクス
厳密モードを至る所に:測地流と両立するポテンシャルによる力学系の秩序化
保存力学系において、構成空間全体を厳密な非線形ノーマルモードで埋め尽くすポテンシャルを設計し、弾性要素による効率的な周期軌道生成と制御手法を提案した。
原題: Strict Modes Everywhere - Bringing Order Into Dynamics of Mechanical Systems by a Potential Compatible With the Geodesic Flow / Arne Sachtler, Alin Albu-Schäffer
日本語で読む → - 論文3D認識/クラス増分学習画像認識
クロスドメイン3Dクラス増分学習における性能差の緩和
3D点群のクラス増分学習で、ドメイン間の性能差という新たな課題を発見し、その緩和手法PolyMemを提案した論文。
原題: Mitigating Performance Discrepancy in Cross-Domain 3D Class-Incremental Learning / Jinge Ma, Gautham Vinod, Bruce Coburn 他
日本語で読む → - 論文3Dマップ/セマンティックセグメンテーション画像認識
VoxelFix: 完成済み3Dボクセルマップの事後セマンティック修正
完成済みの3Dボクセルマップのセマンティック精度を、幾何と占有状態を固定したままグラフベースモデルで修正する手法を提案し、mIoUを4.23〜5.00ポイント向上させた。
原題: VoxelFix: Post-Hoc Semantic Correction of Completed 3D Voxel Maps / Sunesh Praveen Raja Sundarasami, Taehyoung Kim, Johannes Scherer 他
日本語で読む → - 論文LLM校正機械学習
ロジットバイアスによる単一クエリのブラックボックス校正監査
LLM APIが確率を隠す問題に対し、ロジットバイアスパラメータを利用して1サンプルあたり1回のクエリで正確な確率閾値を評価し、二値タスクの真の校正誤差を推定する手法を提案した。
原題: Single-Query Black-Box Calibration Auditing via Logit Bias / Roman Plaud, Antoine Saillenfest, Matthieu Labeau 他
日本語で読む → - 論文配置最適化ロボティクス
ToPos: 制約付き測地線ボロノイ分解による地形多様体上の自動最適配置
地形を3次元多様体として扱い、測地線距離と制約付きボロノイ分解を用いて、アクセス不能領域を避けつつ表面積バランスの良い参照点配置を自動最適化するフレームワークを提案した。
原題: ToPos: Automated Optimal Positioning on Topographic Manifolds using Constrained Geodesic Voronoi Decomposition / Rajesh Raveendran, Akseli Vanhamaa, Jaakko Suutala 他
日本語で読む → - 論文空間記憶画像認識
言語軌跡符号化による身体化エージェントの長期的空間記憶の効率化
動的物体の動きの履歴を自然言語と空間・視覚アンカーで圧縮表現し、長時間にわたる物体の状態遷移を言語で検索可能にする手法を提案した。
原題: Linguistic Trajectory Encoding for Efficient Long-Horizon Spatial Memory in Embodied Agents / Tianyidan Xie, Shenyi Wang, Qiang Tang 他
日本語で読む → - 論文世界モデル画像認識
TourPhysics: 物理を世界モデルに導入し、単一画像からの探索と操作を実現
単一画像と物理設定から初期化し、シミュレーションとビデオ生成を組み合わせて、長期的な物理的一貫性を保ちながら探索と操作を行うオンラインフレームワークを提案する。
原題: TourPhysics: Bringing Physics to World Models for Exploration and Manipulation from a Single Image / Xin Zhang, Yabo Chen, Zixuan Duan 他
日本語で読む → - 論文グリッパー設計ロボティクス
ARTiS: 分解作業における工具操作を強化する適応型ロボットグリッパー
分解作業で工具をしっかり握って使えるよう、柔らかい掌と指先、剛性機構を組み合わせた適応型グリッパーARTiSを提案・評価した論文。
原題: ARTiS: An Adaptive Robotic Gripper for Enhanced Tool Manipulation in Disassembly Applications / Roman Mykhailyshyn, Domae Yukiyasu, Harada Kensuke
日本語で読む → - 論文知識表現・推論AI
意味論的ベイズ世界モデル
知識グラフの確定的な事実表現と、確率的に推論する基盤モデルやエージェントとの不整合を指摘し、知識グラフ上の信念を共有・更新する「意味論的ベイズ世界モデル」を提案する論文。
原題: Semantic Bayesian World Models / Tommaso Soru
日本語で読む → - 論文人型ロボット/共設計ロボティクス
BRIDGE: 形態と制御の共設計による物理AIのためのオープンソース人型ロボットプラットフォーム
人間の動作データを活用できる人型ロボットの設計を、形態と全身制御をデータ駆動で共最適化するフレームワークを提案し、その設計を実現したオープンソースの小型人型ロボット「Bridge」を公開した。
原題: BRIDGE: An Open-Source Humanoid Platform via Morphology-Control Co-Design for Physical AI / Jianren Wang, Letian Qian, Zikai Wang 他
日本語で読む →