Dong Jing
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TempoVLA: 速度制御可能な視覚言語行動ポリシーの学習VLA2026/6/1
ロボット操作の速度を明示的な条件で制御できる単一のVLAモデルを提案。デモの軌道を任意の速度に再タイミングするデータ拡張と、速度をポリシーに供給する機構を組み合わせ、低リスク区間での高速化と高リスク区間での低速化を実現した。
- クロスエンボディメントロボット操作のための行動事前学習VLA2026/6/1
視覚言語行動モデルにおいて、行動モジュールに事前に運動の事前知識を学習させる2段階トレーニング手法を提案し、クロスエンボディメント設定での性能を向上させた。
- 視覚が言語を上書きするとき:VLAにおける反事実的失敗の評価と緩和VLA2026/2/1
VLAモデルが言語指示ではなく視覚的ショートカットに従ってしまう「反事実的失敗」を評価するベンチマークLIBERO-CFを提案し、言語条件付けを正則化する二分岐推論手法CAGで改善する。
- アクションチャンキングにおける地平線の混合VLA2025/11/1
VLAモデルで問題となる行動チャンク長(地平線)のトレードオフを解消するため、異なる地平線のセグメントを並列処理して統合するMixture of Horizons戦略を提案し、性能と汎化性を向上させた。