Alan Aspuru-Guzik
収録論文 4本 ・ フィジカルAI/ロボット学習
拡散ポリシー/強化学習強化学習/拡散ポリシー自己駆動型実験室
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DIA: 拡散ポリシー最適化のためのデノイジング中間アドバンテージ拡散ポリシー/強化学習2026/9/10
拡散ポリシーの強化学習ファインチューニングにおいて、各デノイジングステップに中間アドバンテージを割り当てる手法を提案し、複数のロボット操作ベンチマークで性能を向上させた。
- QPILOTS: フローポリシーのための効率的なテスト時Qステアリング強化学習/拡散ポリシー2026/6/11
フローマッチングや拡散ポリシーを強化学習で最適化する際、推論時にノイズ除去プロセスをQ値の勾配で操縦する手法QPILOTSを提案し、オフラインからオンラインへのRLベンチマークで高い成功率を達成した。
- RAISE:界面特性の処方探索を自律実行する自己駆動型実験室自己駆動型実験室2025/10/1
液体の混合・液滴の画像取得・接触角測定を自動化し、ベイズ最適化と組み合わせて界面特性の処方を自律的に探索するシステムを開発した。
- MVTrans: Multi-View Perception of Transparent Objects2023/2/1