Fengshuo Bai
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DexFlyWheel:器用なマニピュレーションのためのスケーラブルで自己改善するデータ生成フレームワークマニピュレーション2025/9/1
模倣学習と残差強化学習を組み合わせた自己改善サイクルにより、多様な器用マニピュレーションのデータを自動生成し、ポリシー性能を向上させるフレームワークを提案。
- 視覚-言語-行動モデルサーベイ:行動トークン化の観点からVLA2025/7/1
視覚と言語の入力を行動トークンに変換して実行するVLAモデルを、行動トークンの種類(言語記述・コード・アフォーダンス・軌道など)で分類し、各手法の長所と課題を整理したサーベイ。
- RetrDex: 多指ハンドによる散らかった環境での効率的な物体取り出しマニピュレーション2025/2/1
散らかった環境で目標物体を取り出すため、大規模並列強化学習と遮蔽状況を考慮した空間表現を用い、押す・かき混ぜる・突くなどの多様な操作を学習する枠組みを提案し、実機へのゼロショット転移も示した。
- RAT: 深層強化学習エージェントの標的行動を誘導する敵対的攻撃強化学習2024/12/1
人間の選好に沿った意図方策を標的として学習させ、リプレイバッファ内の状態占有度を動的に調整することで、強化学習エージェントを特定の行動へ誘導する敵対的攻撃手法RATを提案した。