Shangkun Sun
収録論文 6本 ・ フィジカルAI/ロボット学習
自動運転VLAVLAビデオ生成/物理シミュレーション自動運転/VLAマニピュレーション世界モデル
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 走ってから歩け:VLM自動運転のためのRun-then-Walkスケジューリング戦略自動運転VLA2026/9/22
VLMベースの自動運転プランナー向けに、進捗探索を優先する「Run」段階と安全性を修復する「Walk」段階を分けた2段階GRPO報酬スケジューリングを提案し、性能と収束速度を両立させた。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- PhysisForcing: ロボット操作のための物理強化ワールドシミュレータビデオ生成/物理シミュレーション2026/6/1
ビデオ生成モデルをロボット操作の世界シミュレータとして使う際に、物理的に不自然な動きが生じる問題を解決するため、物理的に重要な領域に注目した学習フレームワークを提案した。
- AutoDrive-P^3: 強化学習による認識・予測・計画の統合チェーン思考自動運転/VLA2026/3/1
自動運転向けVLMに、認識・予測・計画を段階的に推論するチェーン思考と階層的強化学習を導入し、安全性と解釈性を向上させるフレームワークを提案した。
- Openpi Comet:2025 BEHAVIORチャレンジ競技解法マニピュレーション2025/12/1
2025 BEHAVIORチャレンジに向けた解法を提案し、事前学習と事後学習のスケーリング効果を明らかにして、検証Qスコア0.345を達成した。
- 物理AIのための動画基盤モデルによる世界シミュレーション世界モデル2025/11/1
テキスト・画像・動画から世界を生成する動画基盤モデルCosmos-Predict2.5と、Sim2Real/Real2Real変換を行うCosmos-Transfer2.5を発表し、ロボティクス向けの合成データ生成やシミュレーションを可能にした。