Jiaying Zhou
収録論文 4本 ・ フィジカルAI/ロボット学習
ビデオ生成VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 制御可能な人間中心ビデオ生成における合成データ拡張の役割の探求ビデオ生成2026/4/23
合成データが人間のビデオ生成に与える影響を体系的に調査し、拡散ベースのフレームワークで合成データと実データの補完的役割を明らかにした。
- TAG: 物体中心推論のためのターゲット非依存ガイダンスによるVLAポリシーの安定化VLA2026/3/1
VLAポリシーが散らかった環境で誤った物体や位置を掴む問題を、物体を消した観察との差分を利用した推論時ガイダンスで改善する手法を提案。
- 視覚言語行動モデルのための安定した言語ガイダンスVLA2026/1/1
VLAモデルが言語の言い回しの変化に弱い「モダリティ崩壊」を解決するため、意味意図と視覚的アフォーダンスを分離する確率的フレームワークRSSを提案し、敵対的な言語摂動下でも頑健な操作性能を実現した。
- E0: Tweedie離散拡散によるVLAモデルの汎化性と細粒度制御の向上VLA2025/11/1
量子化された行動トークン上でTweedie離散拡散を行うVLAフレームワークE0を提案し、視点摂動拡張と合わせて多様な環境での汎化と細かい制御を実現した。