論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/18 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文3D生成cs.GR
aDSL: エージェントとプログラムの共同設計によるエージェント型3D生成
LLMによる3Dプログラム生成の脆さを解決するため、エージェント向けDSLと役割特化型マルチエージェントシステムを共同設計し、テキストや画像から構造化された3D形状を生成する。
原題: aDSL: Agentic 3D Creation via Joint Agent-Program Design / Rui-Huan Wang, Si-Tong Wei, Jia-Qi He 他
日本語で読む → - 論文自動運転/軌道計画ロボティクス
GAPL: LLMベース軌道計画のための接地された行動効果ポリシー学習
自動運転の軌道計画において、LLMの推論能力とシミュレーションによる環境ダイナミクスの接地を組み合わせ、PPOでポリシーを最適化する閉ループフレームワークGAPLを提案した。
原題: GAPL: Grounded Action-effect Policy Learning for LLM-Based Trajectory Planning / Zhihong Cui, Hengyu Liu, Zhangkai Wu 他
日本語で読む → - 論文VLAロボティクス
タスクプロトタイプ誘導フローマッチングによる視覚言語ロボット操作の少数ショット汎化
少数の実演からタスクの位相レベルのプロトタイプを抽出し、フローマッチングの初期分布と速度場を誘導することで、視覚言語ロボット操作を新しい手順に少数ショットで適応させる手法を提案。
原題: Task-Prototype Guided Flow Matching for Few-Shot Generalization in Vision-Language Robot Manipulation / Yizhao Wang, Guantao Zhang, Jingbo Wang
日本語で読む → - 論文顔認識/解釈可能性画像認識
SCOUT: 顔認識テンプレートのオープンボキャブラリ編集のための意味概念発見
顔認識テンプレート内の意味概念を直接発見・操作するフレームワークを提案し、自然言語記述から潜在特徴の意味仮説を生成して安定性を検証することで、編集可能な意味方向を獲得する。
原題: SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates / Leon Todorov, Peter Rot, Peter Peer 他
日本語で読む → - 論文ナビゲーションロボティクス
DPNet: 視覚ベースUAVナビゲーションのための効率的な行き止まり予測と回避
RGB-D入力から行き止まりの相対距離と方位を予測する軽量ニューラルネットワークを提案し、軌道ライブラリを刈り込んでUAVが行き止まりを回避しながら滑らかに飛行できるようにした。実データでの追加学習なしで実世界に適用でき、50Hzでの高速再計画を実現する。
原題: DPNet: Efficient Dead-End Prediction and Avoidance for Vision-Based UAV Navigation / Ruibin Zhang, Lun Pan, Zelong Xia 他
日本語で読む → - 論文データセット/ベンチマークロボティクス
HiPHI: 高精度な人体動作と物体インタラクションのための大規模ベンチマーク
本論文は、600時間以上の高精度な全身動作と物体インタラクションを収録した大規模データセットHiPHIを構築し、動作多様性やインタラクションの接地性を評価するベンチマークを提案した。
原題: HiPHI: A Large-Scale Benchmark for High-Precision Human Motion and Object-Interaction / Jiahao Ji, Ji Ma, Runhan Zhang 他
日本語で読む → - 論文ガス源位置推定ロボティクス
物理依存性に基づく逐次推論による深層確率的屋内ガス源位置推定
移動ロボットのスパースでノイズの多い測定からガス源の位置を推定する深層確率フレームワークを提案。風と濃度場の物理的依存性を逐次条件付き推論に組み込み、精度と効率を向上させた。
原題: Deep Probabilistic Indoor Gas Source Localization via Physical Dependency-Guided Sequential Inference / Seunghwan Kim, Hyungjin Kim, Junhee Lee 他
日本語で読む → - 論文VLAAI
HaReCAP: 習慣的行動に基づく再帰的大規模言語モデルエージェントの接地
長期的な身体性タスクにおいて、LLMエージェントの葉ノードでの行動接地の冗長性を減らすため、成功軌跡から頻出の葉決定を抽出してオフラインでルール化し、実行時に安全な場合のみLLM呼び出しをスキップするHaReCAPを提案した。
原題: HaReCAP: Habitual-action Grounding for Recursive Large Language Model Agents / Shen Liu, Zhenguo Xu, Shaopu Wang 他
日本語で読む → - 論文世界モデル/計画機械学習
SCALE: 正しい幾何学におけるJEPA計画のための状態校正潜在埋め込み
エンドツーエンドの世界モデルLeWMの潜在表現に、タスク関連状態空間との距離整合性を持たせることで、計画性能を向上させる手法SCALEを提案した。
原題: SCALE: State-Calibrated Latent Embeddings for JEPA Planning in the Right Geometry / Jiaming Hu, Yan Zheng, Tian Wang
日本語で読む → - 論文3D再構成ロボティクス
OccamView: フレーム予算制約下のアクティブ3Dガウス再構成のためのオブジェクト条件付き視点選択
限られたフレーム予算で3Dガウス再構成を行う際、物体の隠れ領域を考慮した視点選択手法を提案し、再構成の完全性を向上させた。
原題: OccamView: Object-Conditioned View Selection for Frame-Budgeted Active 3D Gaussian Reconstruction / Hongbo Gao, Wei Zhang, Zeyu Ni 他
日本語で読む → - 論文ハンド制御ロボティクス
H-PACハンド:劣駆動ロボットハンドの制御指向モデリングと腱弾性補償
腱駆動の劣駆動ハンドにおける腱伸びによる関節誤差を補償する制御手法を提案し、6アクチュエータ・15自由度のハンドで精度を大幅に改善した。
原題: H-PAC Hand: Control-Oriented Modeling and Tendon-Elasticity Compensation for an Underactuated Robotic Hand / Teng Yan, Jiongxu Chen, Teng Wang 他
日本語で読む → - 論文評価ベンチマーク機械学習
CaliBench: ビデオ世界モデルの確率的ダイナミクスは物理的に較正されているか?
ビデオ世界モデルの生成結果が物理現象の不確実性を正しく再現しているかを評価するベンチマークCaliBenchを提案し、複数のモデルで較正のずれを検出した。
原題: CaliBench: Are the Stochastic Dynamics of Video World Models Physically Calibrated? / Jonathan Sadeghi, Jenny Seidenschwarz, Jesse Allardice 他
日本語で読む → - 論文VLAロボティクス
NebulaVLA: ロボット操作のためのガイドアクションを備えた二周波数視覚言語行動モデル
高レベルの意味推論と低レベルのアクション制御を分離した非同期二周波数アーキテクチャを提案し、異種ロボット間のギャップを埋める統一表現と滑らかな動作を実現するガイドアクションアルゴリズムを導入した。
原題: NebulaVLA: A Dual-Frequency Vision-Language-Action Model With Guide Action for Robotic Manipulation / Cong Zhao, Shuai Tian, Xu Zhang 他
日本語で読む → - 論文評価フレームワークAI
DeepInsight II: ベンチマークからロボットへの一つのトレース
物理AIスタックの評価を統一的に行うフレームワークを拡張し、ナビゲーションと操作のベンチマーク再現、全身制御のシミュレーションから実機への一貫した評価、そしてシステム間のハンドオフラベルと修復可能性の検証を行った。
原題: DeepInsight II: One Trace from Benchmark to Robot / Siyi Li, Yuchen Kang, Wuliang Wang 他
日本語で読む → - 論文センサ融合ロボティクス
カルマンフィルタ情報融合におけるIMUパラメータ設定
アラン分散キャリブレーションに基づくIMUパラメータ設定法をカルマンフィルタ枠組みで検討し、連続時間フィルタのプロセス不確かさを定式化して、2つの典型的なセンサ融合システムで有効性を示した。
原題: The Setting of IMU Parameters in Kalman Filtering-based Information Fusion / Qiang Hu, Yanhua Zou, Shuaiyi Huo 他
日本語で読む → - 論文世界モデル/3Dシーン理解画像認識
GaussianDWM++: 言語基盤の3Dガウス駆動世界モデルによる統一的なシーン理解・編集・マルチモーダル生成
3Dガウス表現に視覚言語特徴を蒸留し、シーン理解・言語推論・4D編集・マルチモーダル生成を単一フレームワークで統合した駆動世界モデルを提案した。
原題: GaussianDWM++: Language-Grounded 3D Gaussian Driving World Model for Unified Scene Understanding, Editing, and Multi-Modal Generation / Tianchen Deng, Xuefeng Chen, Shuang Wu 他
日本語で読む → - 論文HDRイメージング画像認識
深度ガイドによる多視点露出ブラケティングを用いたHDRロボットビジョン
極端な照明条件下での単一ショットHDR撮像を実現するため、多視点カメラに異なる露出を割り当て、深度情報で融合する手法DMEBを提案し、ロボット用の大規模HDRデータセットも構築した。
原題: Depth-guided Multi-view Exposure Bracketing for HDR Robot Vision / Jinnyeong Kim, Juhyung Choi, Woohyeok Kim 他
日本語で読む → - 論文ナビゲーション/計画ロボティクス
車輪脚ロボットの複雑地形におけるロボット身体認識トラバーサルリスクグラフ計画
車輪脚ロボットの複雑地形ナビゲーションのため、ロボットの向きと車体形状を考慮したリスクグラフ計画手法を提案し、シミュレーションと実機で成功率を向上させた。
原題: Robot-Body-Aware Traversal Risk Graph Planning for Wheeled-Legged Robots in Complex Terrain / Zhiqiao Guo, Bichi Zhang, Sören Schwertfeger
日本語で読む → - 論文地理参照/ポーズグラフ最適化ロボティクス
マーカー制約付きポーズグラフ補正によるGNSS非依存環境でのクロスプラットフォーム地理参照
GNSSが使えない環境で、カモフラージュ対応のマーカーを視覚アンカーとして用い、LiDARオドメトリとRTAB-Mapの再構成を共通座標系に地理参照するフレームワークを提案。マーカー制約付きポーズグラフ最適化によりドリフトを大幅に低減した。
原題: Marker-Constrained Pose-Graph Correction for Cross-Platform Georeferencing in GNSS-Denied Environments / Marco Giberna, Jose Luis Sanchez Lopez, Holger Voos
日本語で読む → - 論文群制御制御
センシング範囲制約下での剛性を考慮したフォーメーション追従:単一の制御バリア関数制約による実現
非線形ダイナミクスを持つ異種マルチロボットシステムにおいて、センシング範囲制約下でフォーメーション追従と剛性維持を単一のCBF制約で統合する分散制御フレームワークを提案した。
原題: Rigidity-Aware Formation Tracking under Sensing Range Constraints via Single Control Barrier Function Constraint / S. Saharsh, Pushpak Jagtap
日本語で読む → - 論文異常検知cs.CR
デジタルツイン劣化:時間的不整合によるサイバー物理攻撃の検出
デジタルツインと物理システム間の時間的不整合を監視し、サイバー物理攻撃を検出するフレームワークを提案。正常動作のみで学習した予測モデルと密度モデル、逐次変化検出を用いて攻撃を高精度に検出する。
原題: Digital Twin Degradation: Detecting Cyber Physical Attacks via Temporal Inconsistencies / Konstantinos E. Kampourakis, Vasileios Gkioulos, Sokratis Katsikas
日本語で読む → - 論文強化学習/ベンチマークAI
クロノクックド:強化学習エージェントにおける暗黙の区間タイミングのベンチマーク
調理シナリオを通じて、強化学習エージェントの時間知覚能力を評価するベンチマークスイートを提案し、時間情報が明示されない環境での性能を検証する。
原題: Chronocooked: A Benchmark for Implicit Interval Timing in Reinforcement Learning Agents / Amrapali Pednekar, Alvaro Garrido-Perez, Yara Khaluf 他
日本語で読む → - 論文具現化エージェント/自己進化ロボティクス
Zetta ζ: 自己進化する物理知能のための効率的な閉ループ具現化ハーネス
ロボットの実行中にコードベースの批評家と回復スキルをオンラインで進化させる閉ループハーネスを提案し、LIBERO-ProとRoboCasaで高い成功率と高速化を達成した。
原題: Zetta $ζ$: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence / Xin Ding, Liang Mi, Mingzhe Huang 他
日本語で読む → - 論文HRIHCI
多元的人間ロボット相互作用:多様なコミュニティとのロボット相互作用の設計
多様なユーザーとの相互作用を考慮した社会ロボット設計の枠組み「多元的HRI」を提案し、包括的で適応的、倫理的な相互作用を目指す。
原題: Pluralistic Human-Robot Interaction: Designing for Robot Interaction with Diverse Communities / Raj Korpan
日本語で読む → - 論文ソーシャルロボットHCI
感情ループを閉じる:マルチモーダルな話者・聞き手の感情ダイナミクスを考慮した共感型ソーシャルロボット
ユーザーの発話内容だけでなく、対話中の感情の動的な変化にも応答する共感型ロボットを提案。Misty IIロボットに実装し、話者と聞き手の感情状態を追跡して応答生成に活用するシステムを評価した。
原題: Closing the Affective Loop: Multimodal Speaker-Listener Emotion-Dynamics-Aware Empathetic Social Robots / Zi Haur Pang, Casey Kennington, Tatsuya Kawahara
日本語で読む → - 論文テレオペレーション/触覚ロボティクス
ViHaTeleop: 器用な操作学習のための低コスト・軽量な視覚-触覚テレオペレーションシステム
低コストで軽量な視覚-触覚テレオペレーションシステムを開発し、触覚フィードバックが接触が重要なタスクの成功率を向上させることを実証した。
原題: ViHaTeleop: A Low-Cost, Lightweight Visual-Haptic Teleoperation System for Dexterous Manipulation Learning / Fucai Zhu, Yanhou Lai, Paul Maestre 他
日本語で読む → - 論文自動運転/倫理/強化学習機械学習
倫理的判断ヘッド:人間のフィードバックからの強化学習による自動運転車の規範倫理の実装
自動運転車の倫理的判断を強化学習で実装するフレームワークを提案し、功利主義とカント主義の二つの規範を評価した。人間の好みに基づく報酬モデルを用いて訓練し、倫理フレームワークの学習可能性の非対称性を明らかにした。
原題: The Ethical Decision Head: Operationalizing Normative Ethics in Autonomous Vehicles via Reinforcement Learning from Human Feedback / Thomas Mbrice, Ammar Ali, Sami Mian 他
日本語で読む → - 論文自動運転/データセット分析ロボティクス
シナリオ特性化:軌跡データセット全体の安全性評価のためのモジュール型ツールキット
運転シナリオの軌跡データセットを自動的に分析・特性化するオープンソースのフレームワークを提案し、データセットに依存しないモジュール構成で安全性評価を可能にする。
原題: ScenarioCharacterization: A Modular Toolkit for Characterizing Safety across Trajectory Datasets / Ingrid Navarro, Yutong Duan, Jonathan Francis 他
日本語で読む → - 論文圧縮機械学習
UniTAC: 重み付き歪み尺度による普遍的なタスク認識圧縮
タスクに応じて再学習不要で動作を切り替えられる単一の画像圧縮コーデックを提案。タスクを成分ごとの重要度ベクトルで抽象化し、エンコーダ・デコーダを条件付けすることで、汎用からタスク特化までを一つのモデルで実現する。
原題: UniTAC: Universal Task-Aware Compression via Weighted Distortion Measures / Homa Esfahanizadeh, Matin Mortaheb, Jinfeng Du 他
日本語で読む → - 論文身体性ロボティクスロボティクス
身体化パーセプトロン表現に基づく神経・筋肉ネットワークの共設計
身体をニューラルネットワークとして捉える理論的枠組み「Embodied Perceptron」を提案し、筋骨格ロボットの制御器と筋肉配置を同時最適化することで、単一ニューロン制御でも安定性と学習効率が向上することを示した。
原題: Co-design of Neural and Muscle Network based on Embodied Perceptron Representation / Siyuan Tao, Yoichi Masuda, Hiroyuki Nabae 他
日本語で読む →