Shuaiyi Huang
収録論文 3本 ・ フィジカルAI/ロボット学習
選好ベース強化学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TREND: デモンストレーションを用いたノイズに頑健な選好ベース強化学習のための三者相互学習選好ベース強化学習2025/5/1
少数の専門家デモンストレーションと三者相互学習戦略を組み合わせ、ノイズの多い選好フィードバック下でもロボットマニピュレーションタスクで高い成功率を達成する選好ベース強化学習フレームワークを提案。
- TraceVLA:視覚トレースプロンプトで汎用ロボットポリシーの時空間認識を強化VLA2024/12/1
状態行動軌跡を視覚的にエンコードする視覚トレースプロンプトを導入し、VLAモデルの時空間認識を改善。15万件の操作軌跡でOpenVLAを微調整したTraceVLAは、シミュレーションと実機で大幅な性能向上を達成。
- ARDuP: 汎用ポリシーのためのアクティブ領域動画拡散VLA2024/6/1
動画生成ベースのポリシー学習において、動きの手がかりから自動的に「アクティブ領域」を抽出し、その領域に注目して拡散モデルで計画・行動生成する手法を提案。シミュレータと実世界データで成功率を改善。