論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/12 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文触覚ロボティクス
GIFT: 装着型センシンググローブから触覚センサなしのロボットハンドへの力認識型スキル転移
人間の指先力をグローブで計測し、ロボット側ではモータ電流から力を推定することで、触覚センサのないハンドでも力に基づく技能転移を可能にした手法を提案した。
原題: GIFT: Glove-Inferred Force Transfer: Force-Aware Human-to-Robot Skill Transfer from a Wearable Sensing Glove to a Robot Hand Without Tactile Sensors / Tzah Sarusi
日本語で読む → - 論文LiDAR慣性オドメトリロボティクス
オンライン重力推定は重要か?LiDAR慣性オドメトリにおける静かな設計分岐の再検討
LiDAR慣性オドメトリにおいて重力をオンライン推定し続けるか固定するかの設計選択を比較し、通常時は差が小さいがLiDAR停止時や動的開始時に影響が出ることを示した。
原題: Does Online Gravity Estimation Matter? Revisiting a Silent Design Split in LiDAR-Inertial Odometry / Jie Xu, Ziyi Jin, Kangjin Yu 他
日本語で読む → - 論文sim2realロボティクス
擬似剛体モデルは実植物をどこまで再現できるか?ブルーベリー茎の圃場検証
ブルーベリーの茎を擬似剛体モデルでシミュレーションし、実際の圃場で計測した変形データと比較してモデルの精度と感度を検証した。
原題: How Well Do Pseudo-Rigid Body Models Capture Real Plants? In-Field Validation of Simulated Blueberry Canes / Hannah Kolano, Chelse VanAtter, Wei Yang 他
日本語で読む → - 論文VLAロボティクス
VLAモデルをより良く訓練する方法:ICRA 2026 REAL-Iチャレンジからの教訓
ICRA 2026の実世界 embodied AI 学習チャレンジREAL-Iの結果を報告し、NUS-CLEAR、RCL-Lab、Deeptouch.aiの3チームのVLAと模倣学習を組み合わせたアプローチを比較して、固定データからのロボット学習の教訓をまとめた論文。
原題: How to Better Train VLAs: Lessons Learned From the REAL-I Challenge at ICRA 2026 / Jiaming Wang, Jizhuo Chen, Diwen Liu 他
日本語で読む → - 論文VLAロボティクス
ReWeight: 実演検索とサンプル重み付けによる人間データを活用したVLAポストトレーニング
一人称視点の人間実演をロボット実演と行動類似度で照合し、重み付けしてVLAモデルの追加学習に活用することで、実機タスクの成功率を大幅に向上させた研究。
原題: ReWeight: Leveraging Human Data for VLA Post-Training via Demonstration Retrieval and Sample Weighting / Chenwei Wang, Dianye Huang, Match W. L. Ko 他
日本語で読む → - 論文マニピュレーションロボティクス
手先内での物体の6D姿勢到達を学習する
把持した物体を指の協調動作で手のひら基準の目標6D姿勢へ移動させる強化学習フレームワークPOISEを提案し、シミュレーションと実機で有効性を示した。
原題: Learning In-Hand Object Reaching to General 6D Poses / Junxiao Lin, Tianyue Wu, Jie Yin 他
日本語で読む → - 論文VLAロボティクス
GeomVLA: 3D空間でシーン・運動・行動を統合するVLAモデル
深度とカメラキャリブレーションでVLM特徴を3Dシーントークンに持ち上げ、シーン点の将来運動を潜在表現として予測し、それを条件に3Dフロー型行動生成を行うVLAモデルを提案。CALVINなどで高性能を示した。
原題: GeomVLA: Unifying Scene, Motion, and Action in 3D / Ziyin Xiong, Nikos Gkanatsios, Moritz Reuss 他
日本語で読む → - 論文ワールドモデルロボティクス
LePlanner: ワールドモデル向け反復償却コントローラ
凍結したワールドモデル上で潜在行動列を反復的に生成・洗練する償却型コントローラを提案し、探索ベースの計画手法と同等以上の性能を大幅に少ない計算量で実現した。
原題: LePlanner: An Iterative Amortized Controller For World Models / Saksham Bansal, Om Naphade, Chayan Aggarwal 他
日本語で読む → - 論文選好学習ロボティクス
人間フィードバックの含意を再考する:協働ロボットのための選好学習
人間のフィードバックからロボットの選好を学ぶ際、固定ルールで含意ラベルを導出する従来法の問題点を示し、その含意自体を学習するIMPLIEDを提案した論文。
原題: Rethinking the Implications of Human Feedback for Preference Learning in Human-Robot Collaboration / Qiping Zhang, Kate Candon, Debasmita Ghose 他
日本語で読む → - 論文VLAロボティクス
GROOVE: 幾何学誘導によるVLA実行時の操作空間ジャーク低減
VLAポリシーのチャンク実行時に生じるジャークを、再学習なしでオンライン補正する手法を提案。LIBEROベンチマークとUR5eで動作の滑らかさとタスク成功率を改善。
原題: GROOVE: Geometry-Guided Reduction of Operational-Space Jerk in VLA Execution / Sangho Yun, Minsoo Kim, Minwoo Cho 他
日本語で読む → - 論文VLAロボティクス
効率的なVLAを決めるもの:アクションヘッド設計・スケーリング・レイテンシの探求
VLAモデルにおいて、アクションヘッドの性能はデコーダ構造よりも言語バックボーンの最終層を初期化に使うことが最大の要因であり、アラインメント後はスケーリングが有効になることを実験的に示した研究。
原題: What Makes an Efficient VLA? Navigating Action-Head Design, Scaling, and Latency / Luoyang Sun, Guoyang Xia, Fengfa Li 他
日本語で読む → - 論文モーション生成画像認識
UniMo: 人間と動物のモーション生成を統合するフレームワーク
骨格の違いを点群表現に変換することで種を問わず統一的に扱えるモーション生成手法を提案し、人間と動物を合わせた大規模データセットUniML3Dも構築した。
原題: UniMo: Unifying Human and Animal Motion Generation / Zeyu Zhang, Zhiyuan Zhang, Siheng Wang 他
日本語で読む → - 論文データセット/セグメンテーション画像認識
CoralscapesV2:サンゴ礁におけるパノプティックかつ細粒度な視覚シーン理解
サンゴ礁の一般的な映像から細粒度のシーン理解を行うため、95クラスのセマンティックセグメンテーションと6.5万の魚インスタンスマスクを備えた初のパノプティックセグメンテーション用データセットを構築した。
原題: CoralscapesV2: Panoptic and Fine-Grained Visual Scene Understanding in Coral Reefs / Jonathan Sauder, Thomas Ruckli, Gabrielė Strodomskytė 他
日本語で読む → - 論文模倣学習ロボティクス
Bi-MoDe: 双方向制御に基づく模倣学習における修飾子条件付きデコーディングによる実行速度と接触強度の調整
Transformer行動デコーダの各層に制約付き潜在変数を注入し、実行速度や接触強度などの指示に従って模倣学習した動作を調整できるようにした。実機のホワイトボード拭きタスクで有効性を検証した。
原題: Bi-MoDe: Bilateral Control-based Imitation Learning via Modifier-Conditioned Decoding for Modulation of Execution Speed and Contact Intensity / Takumi Kobayashi, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文VLAロボティクス
視覚から収穫へ:マルチアームロボット果実収穫のための視覚言語モデルベンチマーク
実世界の果樹園画像を用いて、事前学習済み視覚言語モデルがゼロショットでマルチアーム収穫計画を生成できるかを評価する初のベンチマークを提案し、従来手法と比較した。
原題: From Vision to Harvest: Benchmarking Vision-Language Models for Multi-Arm Robotic Fruit Harvesting / Vrishan Inukollu, Adyan Zaman, Anvi Kudaraya 他
日本語で読む → - 論文3Dセグメンテーション画像認識
UniPart: 実世界インタラクションのためのゼロショット言語接地3Dパーツセグメンテーション
自由なテキスト指示から点群上の機能パーツを切り出すクロスモーダル3D Transformerを提案し、大規模データセット構築によりゼロショット性能と実機把持への転移を実現した。
原題: UniPart: Towards Zero-shot Language-Grounded 3D Part Segmentation for Embodied Interaction / Xinqiang Yu, Zekun qi, Jiawei He 他
日本語で読む → - 論文強化学習AI
SCQ: シグモイド有界エントロピーによる保守的Q学習の安定化
オフラインからオンラインへの強化学習において、負になりうる対数エントロピー項をシグモイドで有界化し常に正に保つことで、方策更新を安定化させる手法SCQを提案。D4RLや実機4種で性能と安定性を検証した。
原題: SCQ: Stabilizing Conservative Q-Learning with Sigmoid-Bounded Entropy / Xiefeng Wu, Shu Zhang, Zhaojie Chu 他
日本語で読む → - 論文遠隔操作ロボティクス
MR-GLi: 双方向制御による水中ロボットアーム遠隔操作のための混合現実ベースのグリッパ連動オーバーレイ
水中双方向遠隔操作において、反力トルク表示と手首カメラ映像をロボットグリッパに空間的に重畳するMRインタフェースを提案し、2Dモニタと比較してトルク調整性能は同等ながら注意切替の負担が軽減されることを示した。
原題: MR-GLi: Mixed Reality-Based Gripper-Linked Overlays for Underwater Robot Arm Teleoperation via Bilateral Control / Masashi Sasago, Masato Kobayashi, Yuki Uranishi
日本語で読む → - 論文プライバシーcs.CR
銀行の中のカナリア:Private Evolutionにおけるユーザーレベルプライバシーの監査
Private Evolutionの連合学習において、共有候補バンクを操作する攻撃を実証的に監査し、形式的な最悪ケースの差分プライバシー保証と実際に達成可能な漏洩のギャップを定量化した。
原題: Canaries in the Bank: Auditing User-Level Privacy in Private Evolution / Sai Aparna Aketi, Enayat Ullah, Shripad Gade
日本語で読む → - 論文深層偽造検出画像認識
曖昧な視覚手がかりを超えて:ディープフェイク動画における生理的乱れとクロスモーダル不整合の研究
rPPGと顔行動を双方向コアテンションで統合するディープフェイク検出器を提案し、被験者分割5分割評価で高いAUCを達成した。
原題: Beyond Ambiguous Visual Cues: Studying Physiological Disruptions and Cross-Modal Inconsistencies in Deepfake Videos / Chenxi Yang, Yassine Ouzar, Larbi Boubchir
日本語で読む → - 論文モデル予測制御/自動運転レースロボティクス
限界とその先の自動運転レースのための走行文脈誘導型モデル予測計画・制御
走行文脈(追い越し、通常走行、カウンターステア)に適応するモデル予測制御ベースの計画・制御パイプラインを提案し、完全自律レースカーで人間のベストラップの2%以内を達成した。
原題: Driving Context-guided Model Predictive Planning and Control for Autonomous Car Racing at the Limit and Beyond / Ayoub Raji, Federico Sacco, Nicola Musiu 他
日本語で読む → - 論文自動運転ロボティクス
READ: エンドツーエンド自動運転のためのリスク情報に基づく場の学習
幾何学的・行動的制約から計画に整合した明示的なリスク表現を学習し、候補軌道に沿って微分可能に評価することで、エンドツーエンド自動運転の安全性を向上させるフレームワークを提案。
原題: READ: Learning Risk-Informed Fields for End-to-End Autonomous Driving / Zhiyuan Liu, Yuanxin Tian, Zehong Ke 他
日本語で読む → - 論文ガバナンスロボティクス
ARC:自律ロボティクスコンプライアンス — 実運用自律システムのための三層ガバナンスアーキテクチャ
自律ロボットシステムのための三層コンプライアンスアーキテクチャ(ARC)を提案し、モデル安全性検証・認知認証ベンチマーク・運用認可基準によって具体化する。
原題: ARC: Autonomous Robotics Compliance A Three-Layer Governance Architecture for Deployed Autonomous Systems / Tord Eide, Einar Holt
日本語で読む → - 論文sim2realロボティクス
自動運転レース向け高忠実度マルチボディシミュレータ
Dymolaで車両のマルチボディモデルを構築し、CRG規格の3D路面と組み合わせてリアルタイムで動作する自動運転レース用シミュレータを開発した。
原題: High-Fidelity Multi-Body Simulator for Autonomous Racing / Nicola Musiu, Francesco Iacovacci, Fausto Lupo 他
日本語で読む → - 論文経路計画ロボティクス
地形に応じて運動モデルを切り替えるマルチモデル対応の大域経路計画
地形解析と見通し考慮A*で経路を生成し、地形やロボット状態に応じて運動モデルをリアルタイムに切り替えるPure Pursuit制御で追従する手法を提案し、四足歩行ロボットとドローンのシミュレーションで有効性を示した。
原題: Global Path Planner with Multi-Model Switching / Pietro Gori, Francesco Iotti, Eduard Zelenay 他
日本語で読む → - 論文社会的ロボティクスロボティクス
人々の間のロボット:社会的模倣から人間集団の社会的生成へ
公共空間のロボットを、問題を解決する自律エージェントではなく、集団の意味形成を促す関係的な存在として捉え直す概念論文。
原題: A Robot Among People:From Social Imitation to the Social Becoming of Human Groups / Victor Tuan Vu Pham, Judith Dörrenbächer, Thomas H. Weisswange 他
日本語で読む → - 論文水中把持ロボティクス
防水パッシブ適応グリッパによる傾斜物体のロバストな水中把持
傾斜や非対称な物体を水中でも安定して把持できるよう、回転関節と可変剛性パッドを備えた防水パッシブ適応グリッパを開発し、乾燥・水中環境での把持性能を実証した。
原題: Robust Underwater Grasping of Sloped Objects with a Waterproof Passive Adaptive Gripper / Jooyoung Hong, Daewon Hong, Joohyung Kim
日本語で読む → - 論文歩行ロボティクス
DWMP:双対世界モデルによるヒューマノイドの障害物踏破
固有感覚と視覚の特性の違いに着目し、Koopmanベースの動力学世界モデルとRSSMベースの視覚世界モデルを組み合わせてヒューマノイドの障害物踏破を実現する手法を提案した。
原題: DWMP: Leveraging Dual World Models for Humanoid Obstacle Traversal / Rongjun Jin, Jianming Ma, Yue Gao
日本語で読む → - 論文状態推定制御
反復等変フィルタ
等変フィルタの更新ステップをガウス・ニュートン法による反復計算に置き換え、移動ロボットの距離ベース自己位置推定で性能向上を実証した論文。
原題: The Iterative Equivariant Filter / Pieter van Goor, James Richard Forbes
日本語で読む → - 論文自動運転データセットロボティクス
カメラ・LiDAR・レーダーとスキャン3Dモデルを備えたマルチビークルデータセット:RTK-GNSSによるカスタム自動アノテーション向け
自動運転の知覚アルゴリズム評価用に、7台の対象車両のスキャン3DモデルとRTK-GNSSによる姿勢・運動情報を提供するマルチセンサデータセットを構築し、遮蔽や反射などの測定効果を評価可能にした。
原題: A Multi-Vehicle Dataset with Camera, LiDAR, and Radar Sensors and Scanned 3D Models for Custom Auto-Annotation using RTK-GNSS / Philipp Berthold, Bianca Forkel, Mirko Maehlisch
日本語で読む →