Karmesh Yadav
収録論文 12本 ・ フィジカルAI/ロボット学習
VLA身体性エージェント/記憶/ベンチマーク移動マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Memo: 強化学習による記憶効率の良い身体性エージェントの訓練VLA2025/10/1
Transformerベースの強化学習において、定期的な要約トークンを入力に挟み込むことで記憶の生成と検索を行い、長期的なタスクを効率的に学習する手法を提案。
- 二段階で考えよう:自己接地検証によるMLLMの同意バイアス緩和VLA2025/7/1
マルチモーダルLLM検証器がエージェント行動を過剰に承認する「同意バイアス」を指摘し、望ましい行動の事前知識を自己生成してから評価する軽量手法SGVを提案。失敗検出を25ポイント改善した。
- FindingDory: 身体性エージェントの記憶評価ベンチマーク身体性エージェント/記憶/ベンチマーク2025/6/1
Habitatシミュレータ上で長期的な記憶を要する60の身体性タスクを評価するベンチマークを提案し、視覚言語モデルの長期記憶能力を測定する。
- 家庭内でのオープンワールド移動マニピュレーションに向けて:NeurIPS 2023 HomeRobotオープン語彙移動マニピュレーションチャレンジからの教訓移動マニピュレーション2024/7/1
家庭環境で任意の物体を見つけて任意の場所に置くオープン語彙移動マニピュレーションのベンチマークを提案し、NeurIPS 2023コンペを実施。シミュレーションと実世界で評価し、成功チームに共通するエラー検出・回復と知覚・意思決定の統合の重要性を示した。
- 事前学習済みテキスト画像拡散モデルは制御のための万能な表現学習器であるVLA2024/5/1
テキストから画像を生成する拡散モデルの内部表現を制御ポリシー学習に転用し、操作・ナビゲーションタスクで既存手法に匹敵する性能を達成した。
- What do we learn from a large-scale study of pre-trained visual representations in sim and real environments?2023/10/1
- HomeRobot: Open-Vocabulary Mobile Manipulation2023/6/1
- Navigating to Objects Specified by Images2023/4/1
- Where are we in the search for an Artificial Visual Cortex for Embodied Intelligence?2023/3/1
- Last-Mile Embodied Visual Navigation2022/11/1
- Learning to Prevent Monocular SLAM Failure using Reinforcement Learning2018/12/1
- Learning to Prevent Monocular SLAM Failure using Reinforcement Learning2016/7/1