Dongchi Huang
Alibaba Group
収録論文 4本 ・ フィジカルAI/ロボット学習
価値基盤モデルVLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RynnValue: 時間的距離によるロボット価値基盤モデルのスケーリング価値基盤モデル2026/8/1
ロボット操作のための価値基盤モデルRynnValueを提案。時間的距離を報酬ラベルとして用いることで、大規模データから好みラベルなしで学習し、実世界の成功率を向上させた。
- CO-RFT: チャンク型オフライン強化学習による視覚-言語-行動モデルの効率的ファインチューニングVLA2025/8/1
VLAモデルをアクションチャンキング対応のオフライン強化学習でファインチューニングする手法を提案し、実環境で成功率57%向上・サイクルタイム22.3%短縮を達成した。
- 物体注目アクター:データ効率的なロボットの汎化器用把持操作マニピュレーション2025/5/1
巧みな操作タスクにおいて、物体認識と姿勢推定を行い、事前操作姿勢に到達してから物体に注目したアクターで操作を実行する階層的パイプラインを提案し、10回のデモンストレーションだけで背景や位置の変化に汎化できることを示した。
- 実世界強化学習による巧みな把持マニピュレーション2025/3/1
実環境で直接強化学習を行い、模倣学習で事前学習した方策を微調整することで、多様な物体の巧みな把持を約92%の成功率で実現した。