Hairui Zhu
収録論文 1本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- CanvasAgent: 視覚ツールのオーケストレーションによる複雑な画像生成・編集の実現VLA2026/7/6
複雑な画像生成・編集を、複数の視覚ツールを順次呼び出すマルチモーダルエージェントで実現する。大規模データセットと強化学習でツール選択を学習する。
世界のフィジカルAIを、日本語で。
収録論文 1本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
複雑な画像生成・編集を、複数の視覚ツールを順次呼び出すマルチモーダルエージェントで実現する。大規模データセットと強化学習でツール選択を学習する。