Sunshine Jiang
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA/強化学習強化学習/探索異常検知VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 少ないデータから多くを学ぶ:後知恵からの強化学習VLA/強化学習2026/7/10
VLAモデルの強化学習後訓練において、失敗したロールアウトを実際に達成したタスクに再ラベル付けする「後知恵からの学習」を提案し、サンプル効率を5倍向上させた。
- プロンプト駆動探索強化学習/探索2026/7/9
ロボット操作や推論タスクにおいて、報酬が得られない初期状態からでも、視覚言語モデルがロールアウト動画を分析してプロンプトを書き換えることで探索を促進し、強化学習の成功を可能にする手法を提案した。
- 合成による異常検知:オフロードナビゲーションのための生成拡散モデルを用いた異常検出異常検知2025/5/1
拡散モデルで入力画像から異常を除去した画像を合成し、その編集箇所を解析することで、訓練データにない異常を画素単位で検出する手法を提案。
- ストリーミングフローポリシー:行動軌道をフロー軌道として扱う拡散・フローマッチングポリシーの簡略化VLA2025/5/1
拡散・フローマッチングポリシーを簡略化し、行動軌道をフロー軌道として扱うことで、サンプリング中にリアルタイムで行動をロボットにストリーミング可能にした手法を提案。