論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/7 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文行動生成ロボティクス
大規模離散方策:確率的反復スコアリングによる明示的行動モデリングの進展
行動方策を離散的な候補選択としてモデル化し、確率的な反復スコアリングで表現力を高める新しいフレームワークを提案。自動運転やロボット操作で連続生成モデルに匹敵する性能を示した。
原題: Large Discrete Policy: Advancing Explicit Behavior Modeling with Stochastic Iterative Scoring / Zhenxin Li, Nadine Chang, Xinglong Sun 他
日本語で読む → - 論文画像検出画像認識
CLIPとDINOを活用した不確実性を考慮したカスケード融合ネットワークによる汎用的なディープフェイク画像検出
CLIPとDINOの特徴を階層的に融合し、エントロピーに基づく不確実性で重み付けすることで、未知のディープフェイクに対する汎化性能を高めた検出ネットワークUCF-Netを提案した。
原題: Harnessing CLIP and DINO: An Uncertainty-Aware Cascaded Fusion Network for Generalizable Deepfake Image Detection / Xuechao Zou, Yi Zhou, Kai Li 他
日本語で読む → - 論文VLAロボティクス
飛行を学ぶ:コンパクトなターゲット中心キューと強化学習による安定した視覚誘導UAVサーボ
RGB画像の代わりに軽量なターゲットセグメンテーションから得られる画像空間オフセットと相対深度、機体速度・重力投影を組み合わせた12次元観測でUAVの視覚サーボを強化学習し、カリキュラム学習で安定化と外乱頑健性を実現した。
原題: Learning to Fly: Stable Vision-Guided UAV Servoing with Compact Target-Centric Cues and Reinforcement Learning / Saurbh Singh Jamwal, Nived Chebrolu
日本語で読む → - 論文聴覚/ロボット聴覚/自己雑音分離ロボティクス
脚式ロボット聴覚のためのオープンセット自己雑音分離:アノテーション不要適応と事前学習モデル転送
脚式ロボットの歩行による自己雑音を、事前にクラスを指定しない環境音を保ちながら分離するフレームワークを提案。未ラベル録音から自己雑音クリップを自動選択し、多様な環境音と混合して教師信号を作り、汎用分離器をロボットに適応させる。
原題: Open-Set Ego-Noise Separation for Legged-Robot Audition via Annotation-Free Adaptation and Pretrained-Model Transfer / Koki Shoda, Jun Younes Louhi Kasahara, Aoba Koyanagi 他
日本語で読む → - 論文時系列予測/歩行ロボティクス
非周期的視覚-運動時系列のためのマルチモーダルラベル予測手法
人間型ロボットの歩行中の転倒予測という非周期的な時系列予測タスクに着目し、実機とシミュレーションの2つのベンチマークデータセットを構築して既存手法の限界を示すとともに、内外因性変数を活用した新しい深層学習アーキテクチャを提案して精度を大幅に向上させた。
原題: A Multimodal Label Forecasting Method for Aperiodic Visuo-Motor Time Series / Borui He, Garrett E Katz
日本語で読む → - 論文歩行ロボティクス
RoboDreamer: 予測状態空間モデルによる先読み型ヒューマノイド歩行
観測マスキングと蒸留を用いた2段階教師-学生フレームワークで、不完全なセンシング下でも安定したヒューマノイド歩行を実現する。
原題: RoboDreamer: Anticipatory Humanoid Locomotion with Predictive State-Space Models / Zhe Li, Yangyang Wei, Xichen Yuan 他
日本語で読む → - 論文歩行ロボティクス
位相に注目せよ:脚式移動における有効ランクと表現の健全性
強化学習で訓練された脚式ロボットのポリシー表現を、歩行位相ごとの有効ランクで分析し、表現の健全性を高めることでシミュレーションから実機へのスムーズな転移を実現する手法を提案した論文。
原題: Mind the Phase: Effective Rank and Representation Health in Legged Locomotion / Felipe Tommaselli, Thiago H. Segreto, Juliano D. Negri 他
日本語で読む → - 論文遠隔操作/全身マニピュレーションロボティクス
M3-Tele: 全身移動マニピュレーションのための統合マルチモーダル遠隔操作フレームワーク
接触を伴うタスクの遠隔操作とデータ収集を改善するため、視覚・触覚・力覚・固有受容感覚を統合し、全身協調とコンプライアンス制御を実現するフレームワークを提案した。
原題: M3-Tele: A Unified Multimodal Teleoperational Framework for Compliant Whole-Body Mobile Manipulation / Hengxiang Chen, Shenwen Deng, Yujian Ma 他
日本語で読む → - 論文群制御ロボティクス
D3ARC: 非同期協調マルチロボットシステムのための時間制約付き分散災害検出
山火事などの災害を迅速に検出するため、複数のロボットが非同期に協調する分散型階層フレームワークD3ARCを提案し、シミュレーションで最大94%のミッション成功率を達成した。
原題: D3ARC: Time-Critical Distributed Disaster Detection for Asynchronous Cooperative Multi-Robot Systems / Nikolaos Koursioumpas, Lina Magoula, Nancy Alonistioti 他
日本語で読む → - 論文VLAロボティクス
OpenWAM: 体系的な世界行動モデル事前学習に向けたオープンでモジュール型の探求
世界行動モデルの設計空間をモジュール化し、制御実験を通じて設計原則を抽出・検証するオープンな研究基盤を構築した。
原題: OpenWAM: An Open, Modular Exploration Towards Systematic World-Action Model Pretraining / Yuran Wang, Siqiao Huang, Mingleyang Li 他
日本語で読む → - 論文キャリブレーションロボティクス
P$^2$Calib: パターン事前知識を活用したLiDAR-カメラ外部キャリブレーション
LiDARとカメラの外部キャリブレーション精度を、ターゲットボードのCADモデルから得られる幾何学的制約(穴の半径と四角形レイアウト)を事前知識として利用して向上させる手法を提案した。
原題: P$^2$Calib: Utilizing Pattern Priors for LiDAR-Camera Extrinsic Calibration / Xiangcheng Hu
日本語で読む → - 論文AGIAI
人工汎用知能における適応的絡み合いゲームモジュール
相互作用する適応エージェントの集団行動を確率波方程式でモデル化し、中国株の日中取引データが適応的絡み合いゲームモードで82-94%説明できることを示した。AGIに適応的絡み合いゲームモジュールを組み込む必要性を主張する。
原題: Adaptive Entangled Game Modules in Artificial General Intelligence / Haochen Li, Xinshuai Guo, Jingdong Ouyang 他
日本語で読む → - 論文自動運転/地図生成ロボティクス
車両視界を超えたベクトル地図生成
自動運転のためのHD地図生成において、車載センサで見える範囲を超えた先の地図を予測する「BeyondFormer」を提案し、そのためのデータセットを構築して有効性を検証した論文。
原題: Generation of Vectorized Maps Beyond Vehicle View / Clara Gomez, Alberto Jaenal, Antonio Artuñedo 他
日本語で読む → - 論文人間-ロボット相互作用ロボティクス
予測符号化に基づく人間-ロボット相互作用における内部生成処理と外部結合処理の自律的調整
予測符号化の枠組みを用いて、物理的な人間-ロボット相互作用中に、内部予測と外部感覚証拠のバランスをオンラインで調整するメカニズムを提案し、再構成誤差に基づいてメタ事前分布を選択することで、適応的な行動を実現した。
原題: Predictive-Coding-Based Autonomous Regulation of Internally Generated and Externally Coupled Processing in Human-Robot Interaction / Henrique Oyama, Hiroki Sawada, Jun Tani
日本語で読む → - 論文VLA/通信連携ロボティクス
ComVLA: 6G接続ロボティクスにおけるVLAモデルの通信認識型分割推論
言語指示に含まれる意味情報を利用して、VLAモデルの視覚トークン数を無線チャネル容量に適応させるフレームワークを提案し、計算量と遅延を削減しつつタスク成功率を維持した。
原題: ComVLA: Communication-Aware Split Inference for VLA Models in 6G-Connected Robotics / Boliang Liu, Wint Yi Poe, Jingyun Di 他
日本語で読む → - 論文群制御ロボティクス
SMaRT-Tug: 物理ベースのタグボート・バージ協調操作のための構造化マルチエージェント強化学習
複数のタグボートがバージを協調して押す操作を、物理ベースのGPUシミュレータと構造化制御事前知識を組み合わせた分散型MAPPOで学習し、PIDや集中型PPOより高い性能とゼロショット一般化を実証した論文。
原題: SMaRT-Tug: Structured Multi-Agent Reinforcement Learning for Physics-Based Tugboat-Barge Collaborative Manipulation / Junkai Lu, Jiadong Zhao, Jiacheng Zhang 他
日本語で読む → - 論文群制御ロボティクス
空間条件付きマルチエージェントトランスフォーマーによる分散巧み操作
64台のソフトデルタロボットを8x8グリッドに配置した分散巧み操作システムの制御に、空間条件付きマルチエージェントトランスフォーマーを用いたフレームワークを提案し、シミュレーションと実機で長期的な平面操作タスクを実証した。
原題: Distributed Dexterous Manipulation with Spatially Conditioned Multi-Agent Transformers / Sarvesh Patil
日本語で読む → - 論文SLAMロボティクス
LightSplat: ループ閉じ込みを備えたリアルタイム高忠実度3DガウスSLAM
3Dガウススプラッティングを用いたRGB-D SLAMで、局所特徴とデュアルスレッドバックエンドにより高速なトラッキングと高品質なマップ構築を実現し、オンラインのループ閉じ込みで全体の一貫性を向上させる。
原題: LightSplat: Real-Time High-Fidelity 3D Gaussian SLAM with Loop Closure / Junze Bao, Ye Gao, Yiming Huang 他
日本語で読む → - 論文群制御ロボティクス
大規模マルチロボットシステムにおけるステルスアクチュエータ攻撃下での分散型セキュア学習制御
マルチロボットシステム向けに、強化学習と分散モデル予測制御を統合し、悪意あるステルスなアクチュエータ攻撃に対抗する分散型セキュア学習制御フレームワークを提案した論文。
原題: Distributed Secure Learning Control for Large-scale Multirobots under Stealthy Actuator Attacks / Xinglong Zhang, Qingwen Ma, Cong Li 他
日本語で読む → - 論文姿勢制御ロボティクス
SO(3)上の特異点フリー誘導ベクトル場:設計者が指定する進行挙動を伴う手法
SO(3)上で特異点のない誘導ベクトル場を構築し、姿勢経路追従を実現する手法を提案した。経路に沿った進行速度を設計仕様として明示的に扱える点が特徴で、最小速度制約のあるプラットフォームにも適用可能である。
原題: Singularity-Free Guiding Vector Fields on SO(3) with Designer-Specified Progression Behavior / Jesus Bautista, Hector Garcia de Marina
日本語で読む → - 論文通信機械学習
汎用セマンティックおよび目標指向通信のための基盤モデル
視覚言語基盤モデルと拡散モデルを活用し、低ビットレートでも汎化性と高忠実度を両立するセマンティック通信フレームワークFMSGOCを提案した。
原題: Foundation Models for Generalizable Semantic and Goal-Oriented Communication / Boliang Liu, Wint Yi Poe, Riccardo Trivisonno 他
日本語で読む → - 論文状態推定ロボティクス
MAC-I²:ロバストな視覚慣性融合のための学習によるメトリクス対応共分散
視覚とIMUの融合において、事前定義された不確かさではなく、学習により各モダリティのノイズを反映した共分散を推定し、初期化とキャリブレーションのロバスト性を向上させる手法を提案した。
原題: MAC-I$^2$: Learned Metrics-Aware Covariance for Robust Visual-Inertial Fusion in Initialization and Calibration / Xiang Fei, Yuheng Qiu, Can Xu 他
日本語で読む → - 論文マニピュレーションロボティクス
EquiGQNet: 共有等変点群符号化による高速な把握品質評価
6自由度の把握候補を高速かつ正確に評価するため、SO(3)等変な「一度符号化してから回転」方式と中間レベル行動融合を組み合わせた把握品質評価器EquiGQNetを提案した。シミュレーションと実機で従来法と同等以上の性能を保ちつつ、計画時間を6.9倍高速化した。
原題: EquiGQNet: Fast Grasp Quality Evaluation via Shared Equivariant Point Cloud Encoding / Sungwon Seo, Jaeseog Won, Jiyou Shin 他
日本語で読む → - 論文安全性/LLM/ヒューマノイドロボティクス
あなたのロボットが無視するまでどのくらい?人間とヒューマノイドの協調におけるLLMオーケストレータの安全性ベンチマーク
LLMを用いたロボット制御の安全性を評価する初のベンチマークを提案し、複数のLLMバックエンドのコンプライアンス違反率を測定した。
原題: How Long Until Your Robot Ignores You? A Safety Benchmark for LLM Orchestrators in Human-Humanoid Collaboration / Aulon Bajrami, Mohamed Elshamouty, Werner Kraus
日本語で読む → - 論文sim2realロボティクス
自己受容感を軸にしたクロスモーダル事前学習による接触を伴う組立のゼロショットsim-to-real転移
シミュレーションと実機で差異の少ない自己受容感(関節位置・速度)を教師信号に、視覚と力覚の表現を学習し、実機での微調整なしで高精度な接触組立を実現する手法PACEを提案した。
原題: Zero-Shot Sim-to-Real Contact-Rich Assembly via Proprioception-Anchored Cross-Modal Pretraining / Yuhan Wang, Yurou Chen, Hongye Jiang 他
日本語で読む → - 論文形式手法/制御制御
重み付きイベント信号時相論理から時間に依存しない幾何制御への健全なコンパイル
時相論理仕様を時間に依存しない幾何学的制約に変換し、クロック異常に頑健なCPS制御を実現する新しい枠組みを提案した。
原題: Sound Compilation of Weighted Event Signal Temporal Logic to Timeless Geometric Control / Avinash Malik
日本語で読む → - 論文ベンチマーク画像認識
NutriBench-Kitchen:栄養管理のための身体化AIベンチマーク
調理動画における栄養関連状態の追跡と知識に基づく計画を評価するベンチマークを提案し、既存の視覚言語モデルが人間性能に及ばないことを示した。
原題: NutriBench-Kitchen: Benchmarking Embodied AI for Nutrition Management / Yulin Wei, Xiangchen Wang, Jianhui Pan 他
日本語で読む → - 論文空中マニピュレータ/ロバスト制御制御
未知外乱下における空中マニピュレータシステムのオブザーバベースロバスト制御
クアッドコプタとロボットアームからなる空中マニピュレータの動的モデルを簡略化し、外乱オブザーバを用いたフィードバック制御でサブシステム間の干渉を除去する手法を提案した。
原題: Observer-Based Robust Control for an Aerial Manipulator System under Unknown External Disturbances / Mayank Pandey, Sneha Gajbhiye
日本語で読む → - 論文姿勢推定ロボティクス
平面ベースのガウススプラッティングによるテクスチャレス物体の汎用6D姿勢推定
CADモデルを使わずにテクスチャのない物体の6D姿勢を推定するため、平面ベースのガウススプラッティングで再構成した3D表現と幾何駆動の姿勢最適化を組み合わせたフレームワークPG-Poseを提案した。
原題: Generalizable 6D Pose Estimation of Textureless Objects with Planar-based Gaussian Splatting / Jie Lu, Hengtan Zhang, Li Gong 他
日本語で読む → - 論文VLAロボティクス
ICI-VLA: 時空間的に整列したデモによる文脈内模倣を用いた視覚言語行動モデル
追加学習なしで、テスト時にデモを文脈として与えることで新しい操作タスクに適応できるVLAモデルの訓練・検索フレームワークを提案した。
原題: ICI-VLA: In-Context Imitation with Spatiotemporally Aligned Demonstrations for Vision-Language-Action Models / Songhua Yang, Ziyu Liu, Xuetao Li 他
日本語で読む →