Pardis Taghavi
Texas A&M University
収録論文 3本 ・ フィジカルAI/ロボット学習
世界モデルビデオ生成/スパースアテンション自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ActionSplice: インタラクティブな世界モデルのための飛行中アクション編集世界モデル2026/9/8
ビデオ世界モデルで、生成中にアクションが変更された際に、ロールバックせずに状態を補正してサンプリングを再開する推論フレームワークActionSpliceを提案した。
- サポートを分割し、残差を再構成する:ビデオ生成とワールドモデルのための学習不要スパースアテンションビデオ生成/スパースアテンション2026/8/19
ビデオ生成やワールドモデルのトランスフォーマーを高速化するため、学習不要のブロックスパースアテンション手法SparsePRを提案。応答結合分割とプローブフィット残差再構成を組み合わせ、アテンション再構成誤差を低減しつつ、実行ペア密度22-26%で1.48-2.61倍の高速化を達成。
- NaviDriveVLM: 自動運転のための高レベル推論と動作計画の分離自動運転2026/3/1
自動運転向けに、大規模な推論モデルと軽量な動作生成モデルを分離したフレームワークを提案し、nuScenesベンチマークで性能を向上させた。