Huayu Chen
収録論文 6本 ・ フィジカルAI/ロボット学習
ビデオ生成/拡散蒸留マニピュレーション3D再構成VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Causal-rCM: ストリーミング動画生成と対話型ワールドモデルのための自己回帰拡散蒸留における教師強制と自己強制の統一的オープンレシピビデオ生成/拡散蒸留2026/6/24
自己回帰ビデオ拡散モデルに対して、拡散蒸留フレームワークrCMを拡張し、教師強制と自己強制の相補性を活用した統一的な蒸留手法Causal-rCMを提案。カスタムマスクFlashAttention-2 JVPカーネルにより連続時間CMを実装し、10倍の収束高速化と最先端のストリーミング動画生成性能を達成した。
- PACT: 拡散ポリシーの身体的操作における自己進化型物理安全性アライメントマニピュレーション2026/6/7
事前学習済みの拡散ポリシーを、デモデータや報酬なしで制約適合領域に投影する自己進化型の後処理フレームワークを提案し、安全性違反を平均31.0%削減しつつタスク成功率を30.7%向上させた。
- VideoArtGS: 単眼動画から関節物体のデジタルツインを構築3D再構成2025/9/1
単眼動画から関節物体の形状・部位分割・関節パラメータを同時に復元し、高精度なデジタルツインを構築する手法を提案。
- Cosmos-Reason1:物理的常識から身体性推論へVLA2025/3/1
物理世界を理解し、長い思考連鎖を通じて自然言語で身体的行動決定を生成するマルチモーダル大規模言語モデルCosmos-Reason1を提案し、物理的常識と身体性推論のベンチマークで評価した。
- RDT-1B:双腕マニピュレーションのための拡散基盤モデルマニピュレーション2024/10/1
双腕ロボット操作のための12億パラメータの拡散ベース基盤モデルRDTを提案し、統一行動空間と大規模マルチロボットデータで事前学習することで、未知物体へのゼロショット汎化や言語指示追従、少数デモからの新スキル学習を実現した。
- Score Regularized Policy Optimization through Diffusion Behavior2023/10/11