Shwai He
収録論文 4本 ・ フィジカルAI/ロボット学習
解釈性触覚/表現学習VLA世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Transformerにおける表現進化の方向分解による分離解釈性2026/9/14
Transformerの表現更新を平行・垂直成分に分解し、編集ロバスト性や圧縮誤差、事前学習への介入効果を解析した研究。
- TacGen: 触覚は物理世界表現に不可欠な次元である -- スケーラブルな視覚-触覚アライメントと生成による触覚データ不足への対処触覚/表現学習2026/6/1
触覚データ不足を解決するため、視覚と触覚のコントラスト学習と潜在空間での視覚から触覚への生成モデルを組み合わせ、RGB画像から触覚表現を合成してデータを拡張する手法を提案した。
- ドロップ・ザン・リカバリー:視覚言語行動モデルはどの程度冗長か?VLA2026/6/1
VLAモデルの冗長性を調べるため、トランスフォーマーブロックを除去して再学習する手法を提案し、言語バックボーンが操作タスクに冗長である一方、視覚・行動経路は重要であることを示した。
- ThinkJEPA:大規模視覚言語推論モデルで潜在世界モデルを強化世界モデル2026/3/1
VLMの長期的な意味推論とJEPAの密な動力学モデリングを二重時間経路で統合し、手の操作軌道予測の精度を向上させた研究。