Zhenhong Sun
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAカメラプランニング
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Text-to-3D Policy: 未見仕様への汎化のための細粒度言語-行動アラインメントVLA2026/9/30
言語指示と行動の対応をトークン単位で双方向に結びつけ、未見の細かい仕様変化にも対応できる3D拡散方策を実現した研究。
- 跳ぶ前に見よ:凍結VLAモデルのためのツリー探索を行動評価へ蒸留するVLA2026/7/1
凍結したVision-Language-Actionモデルの出力分布から有望な行動を選ぶため、シミュレーションでのモンテカルロ木探索で得た知識を軽量なQ値モデルに蒸留し、不確実性を考慮した評価で行動を選択するフレームワークSVAを提案した。
- 動く前に見る:動的3Dストーリーワールドにおける物語に基づく視覚的注意カメラプランニング2026/6/25
動的3D環境でのカメラプランニングにおいて、観察すべき視覚情報を能動的に決定するフレームワークを提案し、物語意図と物理的制約を満たす視点選択と軌道生成を行う。