Daniel Khashabi
収録論文 7本 ・ フィジカルAI/ロボット学習
世界モデル視覚推論マルチエージェント協調動画推論VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- JEPA-TTT: ダイナミクス変化下の計画のための潜在世界モデルの持続的テスト時訓練世界モデル2026/9/30
事前学習済みJEPA世界モデルの潜在ダイナミクス予測器をテスト時に自己教師あり学習で適応させ、環境のダイナミクス変化下でも計画性能を向上させる手法を提案。
- VBVR-Pro: ネイティブ視覚推論のためのスケーラブルで検証可能なスイート視覚推論2026/8/26
視覚生成を推論の媒体として扱うネイティブ視覚推論の研究を進めるため、300の手続き生成タスクからなる閉ループテストベッドVBVR-Proを導入し、検証可能な報酬スコアラと制御されたモダリティ比較を提供する。
- 安全で解釈可能なマルチモーダル経路計画によるマルチエージェント協調マルチエージェント協調2026/2/1
VLMを用いて言語指示を経路編集プログラムに変換し、モデルベース計画で安全性を検証することで、ロボットが他者と協調しながら経路を適応させる手法CaPEを提案。
- 超大規模動画推論スイート動画推論2026/2/1
200種類の推論タスクと100万本以上の動画からなる大規模データセットVBVRと、ルールベースで検証可能な評価ベンチマークVBVR-Benchを構築し、動画推論のスケーリング則と未見タスクへの汎化の兆候を示した。
- GenEx: 探索可能な世界を生成する世界モデル2024/12/1
1枚のRGB画像から3D一貫性のある想像上の環境を生成し、AIエージェントがその中を探索・ナビゲートできるシステムを提案。
- 生成的ワールドエクスプローラーVLA2024/11/1
エージェントが大規模3D世界を心的に探索し、想像した観測で信念を更新して意思決定に活かすフレームワークを提案。
- Generating Motion Patterns Using Evolutionary Computation in Digital Soccer2012/12/1