Pengwei Zhang
収録論文 5本 ・ フィジカルAI/ロボット学習
触覚/VLA/操作触覚VLASLAM自動運転/マルチモーダル知覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 予期せぬ感覚を捉える:残差触覚表現によるResTacVLAの接触豊富な操作触覚/VLA/操作2026/7/1
視覚言語行動モデルに触覚を統合する際、視覚特徴が触覚を覆い隠す問題を解決するため、視覚予測と実際の触覚の差を残差表現として用い、視覚的に予測できない重要な接触イベントを捉えるResTacVLAを提案した。
- TouchThinker:大規模データと行動認識表現による触覚常識推論のオープンワールドへの拡張触覚2026/6/10
触覚常識推論をオープンワールドに拡張するため、大規模データセットと行動認識表現を備えた触覚言語フレームワークTouchThinkerを提案した。
- DM0: フィジカルAIに向けた身体性ネイティブな視覚-言語-行動モデルVLA2026/2/1
身体性を後付けでなく最初から統合し、大規模事前学習からフローマッチング行動専門家と空間Chain-of-Thoughtで操作とナビゲーションを統一的に学習するVLAフレームワークDM0を提案。
- HS-SLAM:低速自動運転向けの高速ハイブリッド戦略ベースSLAM手法SLAM2025/5/1
IMUによる相対位置推定と多層直接法を組み合わせ、特徴点マッチングを効率化することで、ORB-SLAM3より高精度かつ15%高速な追跡を実現したSLAMフレームワーク。
- MIPD: 身体性知能運転のためのマルチセンサー対話型知覚データセット自動運転/マルチモーダル知覚2024/11/1
カメラ・LiDAR・4Dレーダーに加え音・光・振動・車速も含むマルチモーダルデータセットMIPDを構築し、身体性知能運転の研究を支援する。