論文
フィジカルAI関連の最新論文を、日本語のひとことで。原題は英語です。
最新論文: 2026/9/15 / arXivを3時間ごとに自動収集
📖 UMIデバイス・カタログ(日本語版)UMI式データ収集デバイスと主要データセットを日本語で俯瞰 →- 論文水陸両用ロボットロボティクス
手のひらサイズの水陸両用ロボット:舵と二重プロペラによる推力差ピッチ制御
手のひらサイズ(65mm、34g)の水中ロボットを開発し、二重プロペラの推力差とPID制御でピッチを、尾舵でヨーを制御。遊泳から跳躍までシームレスに行い、毎秒13.9体長で泳ぎ、体長の1.6倍の高さと3.7倍の距離を跳ぶ。
原題: Swim-and-Breach at Palm Scale: A Rudder-Steered Two-Propeller Underwater Robot Platform with Differential-Thrust Pitch Control / Daehyun Choi, Ian Bergerson, Hengjia Zhu 他
日本語で読む → - 論文宇宙ロボティクスロボティクス
AIによる宇宙ロボット運用:技術・課題・展望
宇宙ロボットの自律性と適応性を高めるAI技術を、能力構築の観点から3層フレームワークで整理し、今後の研究方向を提示したレビュー論文。
原題: Artificial Intelligence-Enabled Space Robot Operations: Technologies, Challenges and Prospects / Zeyuan Huang, Gang Chen, Zixuan Hao 他
日本語で読む → - 論文スキル発見機械学習
拡散モデルによる多様で再利用可能な運動スキルの発見
拡散モデルで状態分布のエントロピー勾配を推定し、高次元ヒューマノイド制御において多様で再利用可能な運動スキルを獲得する手法を提案。
原題: DSD: Learning Diverse and Reusable Motor Skills via Diffusion Skill Discovery / Sun Woo Kim, Xue Bin Peng
日本語で読む → - 論文歩行ロボティクス
複雑な多点接触における脚式ロボットのリアルタイム安定性制御のための最適化レンチポリトープ解析
任意の接触シナリオで実行可能なレンチポリトープを高速に評価するアルゴリズムを提案し、49Hzの制御周期で関節トルクを計算可能にした。シミュレーションと実機で検証し、従来困難だった複雑な状況での安定性を実現した。
原題: Optimized Wrench Polytope Analysis for Real-Time Stability Control of Legged Robots in Complex Multi-Contact Configurations / Friedrich Graaf, Elias Birkefeld, Christian Eichmann 他
日本語で読む → - 論文産業部品認識画像認識
CALIPER: 視覚的に類似した産業部品をメトリック情報で認識するモデルフリー手法
RGB-D動画と少数の実画像からクラスごとの外観サポートと実寸プロファイルを構築し、外観が紛らわしい場合にサイズ情報を融合して、視覚的に類似した産業部品をモデル更新なしで高精度に認識するフレームワーク。
原題: CALIPER: Metric-Grounded Model-Free Recognition of Visually Similar Industrial Parts / Alankrit Gupta, Chenxi Tao, Seung-Kyum Choi
日本語で読む → - 論文人工発生/進化ロボティクスcs.NE
マシン・ザイゴート:生殖細胞-体細胞型人工エージェントにおける学習前の因果的二親遺伝
二つの親生殖系列を組み換えて作った人工接合子から、学習なしで発生・評価するエージェントを構築し、行動形質に二親依存の遺伝が因果的に現れることを示した。
原題: Machine Zygote: Causal Biparental Heredity Before Learning in a Germline--Soma Artificial Agent / Lyes Saad Saoud
日本語で読む → - 論文安全強化学習ロボティクス
CALOS: クアッドロータ向け安全深層強化学習のための制御アフィン・リャプノフ多様体上安全層
クアッドロータの姿勢制約をリアルタイムで強制する安全層CALOSを提案し、強化学習方策のトルク出力を最小ノルムで補正することで、制約違反ゼロと追従誤差の大幅低減を実現した。
原題: CALOS: Control-Affine Lyapunov On-manifold Safety Layer for Safe Deep Reinforcement Learning for Quadrotors / Fabrizio Cesareo, Sebastiano Mengozzi, Nicola Mimmo 他
日本語で読む → - 論文VLAロボティクス
内在的ロボット報酬:VLA表現を再利用した自律評価と方策改善
VLAモデルの視覚表現と成功デモを再利用し、追加の評価器なしでロボット自身の成果を評価して方策改善に役立てる報酬機構IRRを提案。
原題: Intrinsic Robot Rewarding: Reusing VLA Representations for Autonomous Evaluation and Policy Improvement / Tobias Schaffer, Mohab Elkhayat, Daniela Nicklas 他
日本語で読む → - 論文VLAロボティクス
SAVLA: ロボットマニピュレーションのための対称性を考慮した視覚-言語-行動モデル
事前学習済みの視覚言語モデルを固定し、同変フローマッチング行動ヘッドと正規化器を組み合わせることで、データ効率が高く回転に頑健なロボット操作ポリシーを実現した。
原題: SAVLA: Symmetry-Aware Vision-Language-Action Models for Robotic Manipulation / Junle Li, Weixian Waylon Li, Fuxiang Wu 他
日本語で読む → - 論文動作推定画像認識
MEgoVista: 実環境におけるメートル単位の4D手・頭部動作推定のための多視点自己中心運動推定
未準備の自己中心視点録画から、キャリブレーション済みステレオを用いてメートル単位の両手と頭部の動作を重力整合した世界座標系で再構成するオフラインパイプラインを提案。
原題: MEgoVista: Multi-view Ego-aware Motion Estimation for Metric 4D Hands and Head in the Wild / Jiangong Xiao, Zhihao Zhang, Yifei Dong 他
日本語で読む → - 論文VLAロボティクス
RAF-VLA: 未来表現との整合によるエンドツーエンド自動運転
将来フレームの表現を直接教師信号として方策の内部表現を整列させることで、未来生成を伴わずに自動運転VLAの計画性能を高める手法を提案。
原題: RAF-VLA: Representation Alignment with the Future for End-to-End Autonomous Driving / Dogun Kim, Yongjae Lee, Joonhee Lim 他
日本語で読む → - 論文模倣学習ロボティクス
視覚言語に基づくタスク文脈認識型模倣学習によるロボット分解
言語指示を視覚空間表現に接地させ、階層的なタスク選択とタスク文脈認識型模倣学習を組み合わせることで、多様な形状や配置の部品を対象としたロボット分解の長期的タスク遂行を実現した。
原題: Vision-Language Grounded Task-Context-Aware Imitation Learning for Robotic Disassembly / Jeon Ho Kang, Igal Tamarkin, Ethan Niu 他
日本語で読む → - 論文機構設計ロボティクス
過拘束空間リンク機構の柔軟体モデリング・運動学同定・組立精度
過拘束な単ループリンク機構を柔軟マルチボディとしてモデル化し、3Dプリント試作機で組立精度を検証した。構造コンプライアンスにより理想形状へ自己組立する傾向を明らかにした。
原題: Flexible-body Modeling, Kinematic Identification, and Assembly Accuracy of Overconstrained Spatial Linkages / Daniel Huczala, Michael Pieber, Johannes Gerstmayr 他
日本語で読む → - 論文走行可能性予測/継続学習ロボティクス
不確実性を考慮した適応による走行可能性予測の継続学習
生成的な経験リプレイモデルを用いて、過去データを保存せずに新しい地形へ継続的に適応し、不確実性を考慮した走行可能性予測を実現するフレームワークを提案。
原題: Continual Learning for Traversability Prediction with Uncertainty-Aware Adaptation / Hojin Lee, Yunho Lee, Daniel A Duecker 他
日本語で読む → - 論文全身移動操作ロボティクス
Weave: 人間-物体インタラクションから全身巧みな移動操作を学習する
人間の物体操作デモを接触を考慮してロボット用に変換し、29体関節と12指関節を協調制御する全身移動操作ポリシーを学習するフレームワーク。
原題: Weave: Learning Whole-Body Dexterous Loco-Manipulation from Human-Object Interactions / Liu Cao, Xingze Wu, Jingzhi Cui 他
日本語で読む → - 論文歩行ロボティクス
LEAP: 四足歩行ナビゲーションのための創発的能動知覚の学習
危険地形での目標探索ナビゲーションにおいて、タスク目的のみから視線制御を創発させる能動知覚ポリシーを学習し、四足歩行の運動制御にも直接適用可能であることを示した。
原題: LEAP: Learning Emergent Active Perception for Quadruped Navigation / Ü. Bora Gökbakan, Stéphane Caron, Philippe Souères
日本語で読む → - 論文動画生成画像認識
PhysStream: 構造化シーンメモリと細粒度運動制御による物理に基づくストリーミング動画生成
生成途中でも物理的に意味のある速度変化信号で動画内の物体運動を細かく操作できる自己回帰型の画像から動画への生成モデルを提案し、物理的一貫性と軌道精度を改善した。
原題: PhysStream: Streaming Physics-Grounded Video Generation with Structured Scene Memory and Fine-Grained Motion Control / Chuhao Chen, Peter Wonka, Chaoyang Wang 他
日本語で読む → - 論文自動運転AI
CARLAにおける自動運転のための模倣学習
CARLAシミュレータで、RGB画像・LiDAR・車両テレメトリ・車線ウェイポイントの履歴からスロットル・ブレーキ・ステアリングを予測する小型マルチモーダル方策をオフラインの模倣学習で訓練し、閉ループ走行性能を評価した。
原題: Imitation Learning for Autonomous Driving in CARLA / Jordy Kieto
日本語で読む → - 論文Visual SLAMロボティクス
HuMemSLAM: 人間の記憶に着想を得た効率的な意味的場所認識による堅牢なVisual SLAM
人間の記憶と知覚に着想を得た意味的場所認識手法HuMem-VPRを提案し、ORB-SLAM3と統合したHuMemSLAMにより、低遅延かつ高精度な場所認識を実現した。
原題: HuMemSLAM: Efficient Human-Inspired Semantic Place Recognition for Robust Visual SLAM / Mayowa Adebambo, Sebastian Donnelly, Armand Amaritei 他
日本語で読む → - 論文リセット不要RL機械学習
REVERSAL-BENCH:リセット不要強化学習の限界を測る可逆性軸とリセットオラクル
環境の可逆性を連続パラメータで制御し、リセット不要RLが不可逆状態に吸収されて学習停止する「可逆性の崖」を8つの操作タスクで実証するベンチマークを提案。
原題: REVERSAL-BENCH: A Reversibility Axis and Reset Oracle for Measuring the Reset-Free RL Cliff / Riyaaz Shaik, Chandru Venkataraman
日本語で読む → - 論文ランタイム検証ロボティクス
予測型Varanus:CSP適合性監視と予測的LTLランタイム検証の融合
CSPモデルによる適合性チェックと予測的LTLランタイム検証を組み合わせ、ロボットシステムの違反を事前に検出する二段階パイプラインを提案し、原子力貯蔵施設点検ローバーで有効性を示した。
原題: Predictive Varanus: Combining CSP Conformance Monitoring with Predictive LTL Runtime Verification / Angelo Ferrando, Matt Luckcuck, Pedro Ribeiro
日本語で読む → - 論文SLAM/位置合わせロボティクス
LiLi: リー理論に基づく3D LiDARスキャン位置合わせの退化検出
リー群SE(3)のリー代数を用いて、直線通路や平坦な環境で生じる位置合わせの退化変換を体系的に検出する手法を提案し、ノイズ下での精度と実環境での自己位置推定性能を向上させた。
原題: LiLi: Lie Theory Based 3D LiDAR Scan Alignment Degeneracy Detection / Vsevolod Hulchuk, Jan Bayer, Jan Faigl
日本語で読む → - 論文協調知覚/敵対的攻撃画像認識
異種協調知覚の敵対的ロバスト性の検証
異種センサ構成の協調知覚は攻撃に自然に強いという通説を覆し、ラベル不要の単一順伝播で物体除去攻撃を生成するHetPoisonを提案した研究。
原題: Investigating Adversarial Robustness of Heterogeneous Cooperative Perception / Chenyi Wang, Yutong Liu, Qingzhao Zhang 他
日本語で読む → - 論文画像フォレンジック画像認識
MoE-JEPA:意味事前知識と高周波痕跡を統合した合成画像フォレンジック
JEPAの世界モデルを事前知識として活用し、Residual Mixture-of-Expertsとノイズストリームを組み合わせて、圧縮やSNS経由でも頑健にディープフェイクを検出する手法を提案。
原題: Unifying Semantic Priors and High-Frequency Traces: Enhancing V-JEPA with Mixture-of-Experts for Robust Synthetic Image Forensics / Simone Teglia, Irene Amerini
日本語で読む → - 論文異常検知画像認識
RoboVAD: ロボットアーム操作動画における異常検知のための大規模クロスドメイン評価ベンチマーク
ロボットアーム操作動画の異常検知を、未見のタスクや異常タイプを含むクロスドメイン設定で評価する大規模ベンチマークを構築し、既存手法と新手法を比較した。
原題: RoboVAD: A Large Cross-Domain Evaluation Benchmark for Anomaly Detection in Robotic Arm Manipulation Videos / Alexandru-Bogdan Dura, Sebastian Balmus, Radu Tudor Ionescu
日本語で読む → - 論文VLAロボティクス
FluxVLAエンジン:具現化知能のためのワンストップVLAエンジニアリングプラットフォーム
VLAモデルや世界行動モデル、オフライン強化学習を実ロボットに展開するための、データ形式・学習・評価・推論・ロボットインターフェースを統一するオープンな設定駆動型プラットフォームを提案。
原題: FluxVLA Engine: A One-Stop VLA Engineering Platform for Embodied Intelligence / Yinhao Li, Weixin Mao, Zihan Lan 他
日本語で読む → - 論文ロボットビジョン画像認識
知識転移パラメータは学習可能か?効率的なロボットビジョンのためのLePoKet
知識継承を順伝播に組み込み、転移パラメータを子ネットワークと同時最適化するLePoKetを提案し、CIFARやオプティカルフロー推定で精度向上を実証した。
原題: Can Knowledge Transfer Parameters Be Learned? LePoKet for Efficient Robotic Vision / Yanick C. Tchenko, Felix Mohr, Hicham Hadj-Abdelkader 他
日本語で読む → - 論文VLA画像認識
EgoPathBench:視覚言語モデルのゼロショット一人称視点ウェイポイント意思決定の評価
一人称視点の画像と目標から経路を選ぶ能力を測る5タスクのベンチマークを提案し、既存の視覚言語モデルが完全な経路計画を苦手とすることを示した。
原題: EgoPathBench: Evaluating Zero-Shot Egocentric Waypoint Decision-Making in Vision-Language Models / Yang Zhao, Zhuo Chen, Xubo Yang
日本語で読む → - 論文タスクプランニングロボティクス
HINT-Plan: 視覚言語モデルを用いた人間意図を考慮したロボットタスクプランニング
視覚言語モデルで人間の高レベル意図を予測し、階層的シーングラフと組み合わせて人間とロボットの共同タスクプランニングを行う手法を提案。
原題: HINT-Plan: Human Intention-Aware Robot Task Planning in Context-Rich Environments using Vision Language Models / Yuchen Liu, Luigi Palmieri, Lujun Li 他
日本語で読む → - 論文ナビゲーションロボティクス
直接レーダー教示&再現:スピニングレーダーによるナビゲーション
スピニングレーダーの生スキャンを直接利用し局所マップと組み合わせることで、オンロード・オフロード両環境で高精度な自己位置推定と閉ループ自律走行を実現した。
原題: DRT&R: Direct Radar Teach & Repeat / Alexander Krawciw, Daniil Lisus, Cedric Le Gentil 他
日本語で読む →