Nikita Kachaev
収録論文 8本 ・ フィジカルAI/ロボット学習
VLAVLA/強化学習VLA評価VLA/操作強化学習モバイルマニピュレーション強化学習ベンチマーク
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MIKASA-Robo-VLA:長期的マニピュレーションにおけるVLAモデルの記憶能力を評価するベンチマークVLA2026/9/30
言語条件付きマニピュレーション90タスクからなるベンチマークを構築し、タスク遂行に必要な手がかりを隠すことでVLAモデルの記憶能力を評価する。
- VLA Grounder: ブラックボックスVLAモデルのための言語条件付け空間最適化VLA/強化学習2026/7/5
凍結されたVLAモデルの動作を改善するため、人間の指示をVLAに適したコマンドへ変換する言語条件付け空間ポリシーを強化学習で最適化する手法を提案。
- VLAは基本を知っているか?視覚言語行動モデルにおける常識・世界知識の保持を測るVLA評価2026/6/17
VLAモデルがロボットデータで微調整後も常識や世界知識を保持しているかを、行動で回答する新しい評価プロトコルAct2Answerを導入して検証した。
- μVLA:VLAモデルにおける部分観測操作のためのリカレントメモリVLA/操作2026/6/10
VLAモデルに小さな学習可能なメモリトークンを追加し、時間ステップ間で自己注意により更新することで、部分観測下での操作性能を向上させる手法を提案した。
- オンライン強化学習におけるTransformerの新たな可能性:連続制御への応用強化学習2025/10/1
オンラインのモデルフリー強化学習においてTransformerを安定して訓練するための設計指針を調査し、連続制御タスクで競争力のある性能を実現した。
- VLAモデルの視覚表現を劣化させない:OOD汎化のためのアラインメントVLA2025/10/1
VLAモデルのファインチューニングで視覚表現が劣化する問題を分析し、視覚表現をアラインメントする簡便な手法でOOD汎化を改善した。
- 心と動きの統合:モバイルマニピュレーションにおけるタスク計画と低レベルポリシーのためのIsaacSimベンチマークモバイルマニピュレーション2025/8/1
Isaac Sim上に構築したキッチン環境で、言語指示に基づくタスク計画と低レベル制御を統合評価するベンチマークKitchen-Rを提案し、VLMベースの計画と拡散ポリシーによる制御のベースラインを提供した。
- 記憶・ベンチマーク・ロボット:強化学習で複雑なタスクを解くためのベンチマーク強化学習ベンチマーク2025/2/1
記憶を必要とする強化学習タスクの分類と、多様な場面で記憶能力を評価できる統一ベンチマークMIKASA、および卓上ロボット操作向けの32タスクを提案した。