Gokul Swamy
収録論文 10本 ・ フィジカルAI/ロボット学習
VLA/言語指示最適化制御ポリシー世界モデル/操作VLA安全制御模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VLAに何を言うべきかを学ぶ:ほぼ無害なビジョン言語行動モデルの操縦VLA/言語指示最適化2026/6/10
VLAモデルへの言語指示を自動で探索・改善し、性能向上を予測するヘッドを学習して、有害な介入を防ぎつつタスク成功率を高めるフレームワークを提案した。
- ELASTIC: 生成制御ポリシーのテスト時計算を適応的にスケールする効率的学習制御ポリシー2026/6/1
ロボット制御の生成ポリシー(拡散ポリシーやVLAモデル)において、状態に応じて推論時の計算量(逐次ステップ数と並列サンプル数)を強化学習で適応的に割り当てる手法を提案し、シミュレーションと実機で性能と効率を両立した。
- WEAVER:ロボット操作のための高性能・高速・長期的な世界モデル世界モデル/操作2026/6/1
ロボット操作のための世界モデルWEAVERを提案し、忠実性・一貫性・効率性を同時に達成。実機でポリシー評価・改善・計画に有効であることを示した。
- 先見から熟慮へ:潜在空間アライメントによるVLM-in-the-Loop方策ステアリングVLA2025/2/1
生成的なロボット方策の失敗を減らすため、潜在世界モデルで行動の結果を予測し、それをVLMが言語で評価して低レベル行動を選別する枠組みを提案。
- 学習された制約は実は後方到達可能チューブである安全制御2025/1/1
逆制約学習(ICL)が理論的・実践的に何を復元するかを解析し、失敗集合ではなく失敗が不可避な状態集合(後方到達可能チューブ)を復元することを示した論文。
- 状態拡散とスコアマッチングによる模倣学習の新枠組み模倣学習2024/10/17
拡散モデルの考え方を逐次意思決定に持ち込み、状態をノイズ拡散させてスコアマッチングで専門家と学習者の状態分布の差を測る、敵対的でない安定な模倣学習手法を提案。
- Causal Imitation Learning under Temporally Correlated Noise2022/2/1
- Of Moments and Matching: A Game-Theoretic Framework for Closing the Imitation Gap2021/3/1
- Scaled Autonomy: Enabling Human Operators to Control Robot Fleets2019/10/1
- On the Utility of Model Learning in HRI2019/1/1