Gunshi Gupta
収録論文 5本 ・ フィジカルAI/ロボット学習
ナビゲーションVLA身体性エージェント/記憶/ベンチマーク
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ロボストラル・ナビゲート:単眼RGBのみで動作するスケーラブルな視覚言語ナビゲーションモデルナビゲーション2026/7/1
単眼RGB画像のみを入力とし、画像空間上でウェイポイントを予測することで、様々なロボット形態に再較正なしで適用可能な8B視覚言語モデルを提案。大規模シミュレーションデータと効率的な学習手法により、実世界データへの依存を低減しつつ高性能を実現した。
- Memo: 強化学習による記憶効率の良い身体性エージェントの訓練VLA2025/10/1
Transformerベースの強化学習において、定期的な要約トークンを入力に挟み込むことで記憶の生成と検索を行い、長期的なタスクを効率的に学習する手法を提案。
- FindingDory: 身体性エージェントの記憶評価ベンチマーク身体性エージェント/記憶/ベンチマーク2025/6/1
Habitatシミュレータ上で長期的な記憶を要する60の身体性タスクを評価するベンチマークを提案し、視覚言語モデルの長期記憶能力を測定する。
- 事前学習済みテキスト画像拡散モデルは制御のための万能な表現学習器であるVLA2024/5/1
テキストから画像を生成する拡散モデルの内部表現を制御ポリシー学習に転用し、操作・ナビゲーションタスクで既存手法に匹敵する性能を達成した。
- Geometric Consistency for Self-Supervised End-to-End Visual Odometry2018/4/1