William T. Freeman
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA画像トークン化
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 大規模動画プランナーによる汎用ロボット制御VLA2025/12/1
インターネット規模の人間活動動画で生成的なロボット計画モデルを基盤モデル規模で学習し、新しい場面やタスクに対してゼロショットで動画計画を生成して実機の行動に変換する手法を提案した。
- 再帰的割り当てによる適応的可変長画像トークン化画像トークン化2024/11/1
画像の情報量に応じて32〜256個のトークン数を再帰的に増減させる可変長トークナイザを提案し、再構成誤差とFIDで有効性を検証した。
- Bayes3D: fast learning and inference in structured generative models of 3D objects and scenes2023/12/1
- Reasoning About Physical Interactions with Object-Oriented Prediction and Planning2018/12/1
- ChainQueen: A Real-Time Differentiable Physical Simulator for Soft Robotics2018/10/1
- 3D Shape Perception from Monocular Vision, Touch, and Shape Priors2018/8/1