論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/8/17 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文シミュレーション/運動制御ロボティクス
ラムダ保持制御:予測的筋骨格シミュレーションにおける最小タスク報酬から創発する人間らしい運動
平衡点仮説に着想を得たλ保持制御器を提案し、筋駆動骨格モデルが最小限の報酬だけで人間らしいスプリント動作を1時間以内に学習できることを示した。
原題: Lambda-Hold Control: Human-Like Movement Emerges from a Minimal Task Reward in Predictive Musculoskeletal Simulation / Jun Hyuk Lee, Chihyeong Lee, Jooeun Ahn
日本語で読む → - 論文ナビゲーションロボティクス
DPNet: 視覚ベースUAVナビゲーションのための効率的な行き止まり予測と回避
RGB-D入力から行き止まりの相対距離と方位を予測する軽量ニューラルネットワークを提案し、軌道ライブラリを刈り込んでUAVが行き止まりを回避しながら滑らかに飛行できるようにした。実データでの追加学習なしで実世界に適用でき、50Hzでの高速再計画を実現する。
原題: DPNet: Efficient Dead-End Prediction and Avoidance for Vision-Based UAV Navigation / Ruibin Zhang, Lun Pan, Zelong Xia 他
日本語で読む → - 論文VQA/操作計画画像認識
PROBE: VLMエージェントによる操作基盤の視覚質問応答
ロボットが隠れた物体を探すために操作が必要な動的シーンでの視覚質問応答(MG-VQA)を提案し、シミュレータとベンチマークを構築、VLMエージェントの性能を評価・微調整する手法を示した。
原題: PROBE: Manipulation-Grounded Visual Question Answering with VLM Agents / Vineet Bhat, Siyi Chen, Alex Zook 他
日本語で読む → - 論文ソフトロボティクスロボティクス
重力負荷下での大型高力ソフトロボットマニピュレータの設計最適化
ソフトロボットの腕の形状を最適化し、自重による座屈を防ぎつつブロッキング力を最大化する手法を提案。閉形式解を示し、実験で有効性を検証した。
原題: Design Optimization for Large High-Force Soft Robot Manipulators Under Gravitational Loads / Isara Cholaseuk, Penelope Llibre, Alexa Kyriacou 他
日本語で読む → - 論文センサ融合ロボティクス
カルマンフィルタ情報融合におけるIMUパラメータ設定
アラン分散キャリブレーションに基づくIMUパラメータ設定法をカルマンフィルタ枠組みで検討し、連続時間フィルタのプロセス不確かさを定式化して、2つの典型的なセンサ融合システムで有効性を示した。
原題: The Setting of IMU Parameters in Kalman Filtering-based Information Fusion / Qiang Hu, Yanhua Zou, Shuaiyi Huo 他
日本語で読む → - 論文VLAロボティクス
教えて育てる:汎用ロボット学習のためのエージェント中心アーキテクチャ
この論文は、少数のデモから再利用可能なスキルブロックを学習し、新しいシーンでそれらを組み合わせてタスクを実行するエージェント中心のアーキテクチャ(TGL)を提案し、再学習の負担を軽減する。
原題: Teach and Grow: An Agent-Centered Architecture for General Robot Learning / Chang Nie, Zhe Liu, Hesheng Wang
日本語で読む → - 論文全身制御ロボティクス
ヒューマノイドロボットによるアメリカンフットボールのタイトスパイラル投げ
ヒューマノイドロボットがアメリカンフットボールを正確に投げるための全身制御戦略を提案し、リリース時のスピン注入と接触ダイナミクスを扱う。
原題: Throwing a Tight Spiral American Football by a Humanoid Robot / Zaid Mahboob, Bowen Weng
日本語で読む → - 論文3D再構成ロボティクス
OccamView: フレーム予算制約下のアクティブ3Dガウス再構成のためのオブジェクト条件付き視点選択
限られたフレーム予算で3Dガウス再構成を行う際、物体の隠れ領域を考慮した視点選択手法を提案し、再構成の完全性を向上させた。
原題: OccamView: Object-Conditioned View Selection for Frame-Budgeted Active 3D Gaussian Reconstruction / Hongbo Gao, Wei Zhang, Zeyu Ni 他
日本語で読む → - 論文HDRイメージング画像認識
深度ガイドによる多視点露出ブラケティングを用いたHDRロボットビジョン
極端な照明条件下での単一ショットHDR撮像を実現するため、多視点カメラに異なる露出を割り当て、深度情報で融合する手法DMEBを提案し、ロボット用の大規模HDRデータセットも構築した。
原題: Depth-guided Multi-view Exposure Bracketing for HDR Robot Vision / Jinnyeong Kim, Juhyung Choi, Woohyeok Kim 他
日本語で読む → - 論文マニピュレーションロボティクス
VLCP: 視覚言語制御ポリシーによるロボット操作の閉ループコード再計画
凍結した視覚言語モデルを制御コード生成に用い、デモや微調整なしでロボット操作ポリシーを実現。エピソード内でコードを再計画することで失敗を修正し、成功率を大幅に向上させた。
原題: VLCP: Vision Language Control Policy Closed-Loop Code Replanning for Robot Manipulation / Dhia Naouali, Minghan Wu, Claudia Wong 他
日本語で読む → - 論文セキュリティロボティクス
状態が攻撃面となるとき:LLM駆動型具現化エージェントにおける状態意味注入攻撃
LLM駆動の具現化エージェントにおいて、環境状態を改ざんする「状態意味注入攻撃」を提案し、その脅威と防御の必要性を示した論文。
原題: When State Becomes an Attack Surface: State-Semantic Injection in LLM-Driven Embodied Agents / Jiawei Liu, Jiacheng Guo, Tian Zhang 他
日本語で読む → - 論文VLA/プランニングロボティクス
ニューロシンボリック具現化エージェント
視覚言語モデルとシンボリックプランニングを組み合わせ、家庭内の長期的タスクを実行可能な計画として生成するエージェントを提案。探索と制約付き計画により、実行可能性を保証しつつ高い成功率を達成。
原題: Neurosymbolic Embodied Agents / Mohammad Albinhassan, Yuming Feng, Alessandra Russo 他
日本語で読む → - 論文移動操作/sim2realロボティクス
FetchMan: シミュレーション経験から学ぶ視覚的ヒューマノイド移動操作ポリシー
シミュレーションで合成デモをクローンするだけでは性能が頭打ちになることを発見し、強化学習とFlow-GRPOによる微調整を組み合わせたエンドツーエンドのsim-to-realパイプラインを構築。実機Unitree G1で未見シーンへのゼロショット到達・把持を73.3%の成功率で達成した。
原題: FetchMan: Learning Visual Humanoid Loco-Manipulation Policies from Simulated Experiences / Omar Rayyan, Zhi Li, Max Argus 他
日本語で読む → - 論文マニピュレーションロボティクス
意味と密度を考慮したアクセシビリティ維持型マルチオブジェクト配置計画
家庭用ロボットが棚に複数の物体を順次配置する際、意味的な整理、空間の高密度利用、操作のしやすさを同時に考慮する計画手法SDPPを提案した。
原題: Semantic- and Density-Aware Planning for Accessibility-Preserving Multi-Object Placement / Benno Wingender, Nils Dengler, Nicolas Busch 他
日本語で読む → - 論文ヒューマノイド/VLA/強化学習ロボティクス
HAF: 階層的アクションフローとスペクトル潜在RLによる汎用VLAのヒューマノイド全身移動操作への適応
汎用VLA基盤モデルをヒューマノイドの全身移動操作に適応させるための2部構成フレームワークHAFを提案。階層的なアクション生成とオンラインRLによるポリシー改善を実現する。
原題: HAF: Adapting Generalist VLAs to Humanoid Whole-Body Loco-manipulation via Hierarchical Action Flow and Spectral Latent RL / Langzhe Gu, Chengkai Hou, Meng Li 他
日本語で読む → - 論文セキュリティロボティクス
基盤モデル搭載身体化エージェントのセキュリティ:攻撃面、攻撃、防御、評価
基盤モデルを使う身体化エージェントのセキュリティを、信頼境界を中心に整理したサーベイ論文。システムを5層・12の攻撃面に分け、58件の攻撃と61件の防御を分析し、研究の偏りを明らかにした。
原題: Security of Foundation-Model-Powered Embodied Agents: Attack Surfaces, Attacks, Defenses, and Evaluation / Jiawei Liu, Jiacheng Guo, Tian Zhang 他
日本語で読む → - 論文視点計画ロボティクス
円筒空洞のロボット点検のための観測制約付き関節空間視点最適化
円筒空洞の底部を観測するためのロボットカメラ視点を、可視性・運動学・衝突制約を満たしつつ関節空間で最適化する完全自律手法を提案した。
原題: Observation-Constrained Joint-Space Viewpoint Optimization for Robotic Inspection of Cylindrical Cavities / Yuezhong Wang, Rongshen Yin, Bichi Zhang 他
日本語で読む → - 論文HRIHCI
多元的人間ロボット相互作用:多様なコミュニティとのロボット相互作用の設計
多様なユーザーとの相互作用を考慮した社会ロボット設計の枠組み「多元的HRI」を提案し、包括的で適応的、倫理的な相互作用を目指す。
原題: Pluralistic Human-Robot Interaction: Designing for Robot Interaction with Diverse Communities / Raj Korpan
日本語で読む → - 論文マニピュレーションロボティクス
アーム認識型誘導による器用な把持生成:アーム非依存把持モデルの活用
事前学習済みのアーム非依存把持モデルを推論時にアーム情報と環境情報で誘導し、アーム制約を考慮した器用な把持を高確率で生成するフレームワークを提案した。
原題: Arm-Aware Guided Dexterous Grasp Generation with Arm-Agnostic Grasp Models / Yongyi Jia, Yongpeng Jiang, Kangchen Lv 他
日本語で読む → - 論文評価ベンチマーク機械学習
CaliBench: ビデオ世界モデルの確率的ダイナミクスは物理的に較正されているか?
ビデオ世界モデルの生成結果が物理現象の不確実性を正しく再現しているかを評価するベンチマークCaliBenchを提案し、複数のモデルで較正のずれを検出した。
原題: CaliBench: Are the Stochastic Dynamics of Video World Models Physically Calibrated? / Jonathan Sadeghi, Jenny Seidenschwarz, Jesse Allardice 他
日本語で読む → - 論文ナビゲーション/計画ロボティクス
車輪脚ロボットの複雑地形におけるロボット身体認識トラバーサルリスクグラフ計画
車輪脚ロボットの複雑地形ナビゲーションのため、ロボットの向きと車体形状を考慮したリスクグラフ計画手法を提案し、シミュレーションと実機で成功率を向上させた。
原題: Robot-Body-Aware Traversal Risk Graph Planning for Wheeled-Legged Robots in Complex Terrain / Zhiqiao Guo, Bichi Zhang, Sören Schwertfeger
日本語で読む → - 論文データセット/ベンチマークロボティクス
HiPHI: 高精度な人体動作と物体インタラクションのための大規模ベンチマーク
本論文は、600時間以上の高精度な全身動作と物体インタラクションを収録した大規模データセットHiPHIを構築し、動作多様性やインタラクションの接地性を評価するベンチマークを提案した。
原題: HiPHI: A Large-Scale Benchmark for High-Precision Human Motion and Object-Interaction / Jiahao Ji, Ji Ma, Runhan Zhang 他
日本語で読む → - 論文異常検知cs.CR
デジタルツイン劣化:時間的不整合によるサイバー物理攻撃の検出
デジタルツインと物理システム間の時間的不整合を監視し、サイバー物理攻撃を検出するフレームワークを提案。正常動作のみで学習した予測モデルと密度モデル、逐次変化検出を用いて攻撃を高精度に検出する。
原題: Digital Twin Degradation: Detecting Cyber Physical Attacks via Temporal Inconsistencies / Konstantinos E. Kampourakis, Vasileios Gkioulos, Sokratis Katsikas
日本語で読む → - 論文地理参照/ポーズグラフ最適化ロボティクス
マーカー制約付きポーズグラフ補正によるGNSS非依存環境でのクロスプラットフォーム地理参照
GNSSが使えない環境で、カモフラージュ対応のマーカーを視覚アンカーとして用い、LiDARオドメトリとRTAB-Mapの再構成を共通座標系に地理参照するフレームワークを提案。マーカー制約付きポーズグラフ最適化によりドリフトを大幅に低減した。
原題: Marker-Constrained Pose-Graph Correction for Cross-Platform Georeferencing in GNSS-Denied Environments / Marco Giberna, Jose Luis Sanchez Lopez, Holger Voos
日本語で読む → - 論文テレオペレーション/触覚ロボティクス
ViHaTeleop: 器用な操作学習のための低コスト・軽量な視覚-触覚テレオペレーションシステム
低コストで軽量な視覚-触覚テレオペレーションシステムを開発し、触覚フィードバックが接触が重要なタスクの成功率を向上させることを実証した。
原題: ViHaTeleop: A Low-Cost, Lightweight Visual-Haptic Teleoperation System for Dexterous Manipulation Learning / Fucai Zhu, Yanhou Lai, Paul Maestre 他
日本語で読む → - 論文具現化エージェント/自己進化ロボティクス
Zetta ζ: 自己進化する物理知能のための効率的な閉ループ具現化ハーネス
ロボットの実行中にコードベースの批評家と回復スキルをオンラインで進化させる閉ループハーネスを提案し、LIBERO-ProとRoboCasaで高い成功率と高速化を達成した。
原題: Zetta $ζ$: An Efficient Closed-Loop Embodied Harness for Self-Evolving Physical Intelligence / Xin Ding, Liang Mi, Mingzhe Huang 他
日本語で読む → - 論文群制御制御
センシング範囲制約下での剛性を考慮したフォーメーション追従:単一の制御バリア関数制約による実現
非線形ダイナミクスを持つ異種マルチロボットシステムにおいて、センシング範囲制約下でフォーメーション追従と剛性維持を単一のCBF制約で統合する分散制御フレームワークを提案した。
原題: Rigidity-Aware Formation Tracking under Sensing Range Constraints via Single Control Barrier Function Constraint / S. Saharsh, Pushpak Jagtap
日本語で読む → - 論文ソーシャルロボットHCI
感情ループを閉じる:マルチモーダルな話者・聞き手の感情ダイナミクスを考慮した共感型ソーシャルロボット
ユーザーの発話内容だけでなく、対話中の感情の動的な変化にも応答する共感型ロボットを提案。Misty IIロボットに実装し、話者と聞き手の感情状態を追跡して応答生成に活用するシステムを評価した。
原題: Closing the Affective Loop: Multimodal Speaker-Listener Emotion-Dynamics-Aware Empathetic Social Robots / Zi Haur Pang, Casey Kennington, Tatsuya Kawahara
日本語で読む → - 論文圧縮機械学習
UniTAC: 重み付き歪み尺度による普遍的なタスク認識圧縮
タスクに応じて再学習不要で動作を切り替えられる単一の画像圧縮コーデックを提案。タスクを成分ごとの重要度ベクトルで抽象化し、エンコーダ・デコーダを条件付けすることで、汎用からタスク特化までを一つのモデルで実現する。
原題: UniTAC: Universal Task-Aware Compression via Weighted Distortion Measures / Homa Esfahanizadeh, Matin Mortaheb, Jinfeng Du 他
日本語で読む → - 論文車両位置推定画像認識
路側レーダーとコネクテッド車両センシングを用いたマルチオブザーバ車両位置推定のケーススタディ
路側レーダーとLiDAR搭載コネクテッド車両の物体検出を統合する車両位置推定フレームワークを提案し、ヘルシンキの実データで評価した。
原題: Multi-Observer Vehicle Localization Case Study with Roadside Radar and Connected Vehicle Sensing / Aleksi Pippuri, Nilusha Jayawickrama, Risto Ojala
日本語で読む →