Zheyang Qin
収録論文 3本 ・ フィジカルAI/ロボット学習
物理推論/LLM/強化学習画像生成動画生成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 物理シミュレータ上での強化学習による物理オリンピック問題解決物理推論/LLM/強化学習2026/4/1
物理シミュレータでランダムなシーンを生成し、合成の問答データを作ってLLMを強化学習で訓練し、実世界の物理ベンチマーク(IPhOなど)へのゼロショット転移を実証した論文。
- 反復的な自己修正による構成的画像生成の改善画像生成2026/1/1
視覚言語モデルを批評役として用い、テキスト画像生成モデルが複数ステップで生成を反復的に洗練させる手法を提案し、構成的なプロンプトでの生成精度を向上させた。
- 報酬勾配による動画拡散モデルのアラインメント動画生成2024/7/1
事前学習済み報酬モデルから動画拡散モデルへ勾配を逆伝播させ、少ない計算量とサンプルで下流タスクに適応させる手法を提案。