Jennifer Dy
収録論文 4本 ・ フィジカルAI/ロボット学習
量子化動画生成ビデオ生成/物理推論世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ActQuant: 視覚言語行動モデルのための4ビット未満の行動誘導量子化量子化2026/5/19
VLAモデルのエッジ展開を可能にするため、行動予測への寄与度に基づいてビット幅を割り当てる行動誘導型混合精度量子化フレームワークActQuantを提案し、シミュレーションと実機で高い性能を維持しつつ大幅な圧縮を実現した。
- PanoWorld: 幾何学的に一貫したパノラマ動画の世界モデリング動画生成2026/5/14
単一画像とキャプションから、3Dシーン状態を明示的に考慮した幾何学的に一貫した360度動画を生成する世界モデルを提案。深度と軌跡の一貫性を保つ軽量正則化を導入し、専用データセットで評価した。
- PhyGround: 生成ワールドモデルにおける物理推論のベンチマークビデオ生成/物理推論2026/5/11
ビデオ生成モデルの物理法則遵守を評価するための、基準に基づいたベンチマークと自動評価器を提案した論文。
- 機械における人間の認知:世界モデルの統一的視点世界モデル2026/4/1
世界モデルの研究を認知機能の観点から分類し、人間のような認知能力を目指すための統一的枠組みを提案した論文。特に動機付けとメタ認知の研究不足を指摘し、今後の研究方向を示している。