Yidong Wang
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーション報酬モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- STAR: 視覚・触覚・言語・行動モデルにおけるスパース触覚表現学習による巧みなマニピュレーションマニピュレーション2026/9/11
200時間の双腕巧みな操作データセットを構築し、触覚信号のスパース性に対処する視覚・触覚・言語・行動モデルSTARを提案。実世界4タスクで平均61%の成功率を達成した。
- TrustRoboReward: 選好順序付き等調スコア編集によるマルチパラダイムロボット報酬モデル報酬モデル2026/8/9
ロボット操作の強化学習における報酬モデルのボトルネックを解決するため、ペアワイズ選好とビデオQAを統合したマルチパラダイム報酬モデリングフレームワークを提案し、スコアと選好の矛盾を等調回帰で解消する。
- Pelican-Unify 1.0: 理解・推論・想像・行動を統合した身体化基盤モデルVLA2026/5/1
単一のVLMと統一未来生成器を用いて、理解・推論・想像・行動を一つのモデルで統合的に学習・実行する身体化基盤モデルを提案し、各能力のベンチマークで高い性能を達成した。
- Pelican-VL 1.0:身体知能のための基盤ブレインモデルVLA2025/11/1
7B〜72Bパラメータのオープンソース身体知能向けマルチモーダル基盤モデルを開発し、大規模データと新学習機構DPPOにより既存モデルを上回る性能を達成した。