Jiayi Zhu
Shanghai Jiao Tong University
収録論文 3本 ・ フィジカルAI/ロボット学習
エージェントメモリ管理VLA映像編集
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MemForest: EventTree分割と段階的マージによる効率的なエージェントメモリ管理エージェントメモリ管理2026/9/8
エージェントの履歴メモリをイベント単位に分割し、最大全域木と冗長ノードの段階的マージで圧縮するフレームワークを提案。メモリ圧縮率50%で性能をほぼ維持しつつ、検索を高速化した。
- 視覚言語行動モデルにおける位置依存の盲点の発見と緩和VLA2026/8/1
視覚言語行動モデルが作業空間内の特定領域で失敗しやすい「位置盲点」を発見し、その領域のデモデータで微調整することで性能を改善する手法を提案した。
- CameraAnything: 任意のカメラ制御による映像の再撮影映像編集2026/7/27
カメラの内部・外部パラメータを同時に制御できる映像編集の統一フレームワークを提案し、焦点距離や解像度の変更を伴う再撮影を単一の生成プロセスで実現した。