Kevin Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
スキル学習データ収集/模倣学習自己教師あり強化学習LLM計画
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VASO: 物理AIエージェントのための形式的検証可能な自己進化スキルスキル学習2026/6/3
LLMが生成したロボットスキル契約を、モデル検査による形式的検証と反例に基づくテキスト勾配で自己進化させるフレームワークVASOを提案。未テスト条件下でも時間的安全性を満たすスキルを少数サンプルで獲得できる。
- XRZero-G0:インターフェース、品質、比率で器用なロボット操作の最前線を押し広げるデータ収集/模倣学習2026/4/1
ロボットを使わない人間のデモデータ収集システムXRZero-G0を提案し、閉ループの品質管理とデータ混合比率の最適化により、少量の実機データで大規模なロボットフリーデータと組み合わせて同等性能を達成し、コストを20分の1に削減した。
- 自己教師あり強化学習のための1000層ネットワーク:深さのスケーリングが新たな目標到達能力を可能にする自己教師あり強化学習2025/3/19
自己教師あり強化学習において、ネットワークを最大1024層まで深くすることで、目標到達タスクの成功率が2倍から50倍に向上し、学習される行動も質的に変化することを示した。
- OpenAI o1モデルの計画能力:実現可能性・最適性・汎化性の評価LLM計画2024/9/1
OpenAIのo1モデルの計画能力を、制約の多いタスクや空間的に複雑な環境で評価し、制約遵守や状態遷移管理に優れる一方、冗長な行動や空間的汎化に課題があることを明らかにした。
- Enabling Mammography with Co-Robotic Ultrasound2023/12/1
- Data-Driven Model Predictive Control of Autonomous Mobility-on-Demand Systems2017/9/1