Unnat Jain
University of California, Irvine
収録論文 18本 ・ フィジカルAI/ロボット学習
模倣学習VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人間が実演できないタスクを学習するためのガードレール生成フレームワークGLIDE模倣学習2026/9/21
人間が実演困難なロボット操作タスクに対し、失敗モードを推論して実行可能なガードレールを生成し、データ収集と方策実行を改善するGLIDEを提案した。
- TEMPO: 動的ロボットマニピュレーションのための時間的文脈学習VLA2026/9/15
事前学習済みVLAモデルに動きの要約と固有受容感覚の履歴を追加し、動的マニピュレーションにおける運動の曖昧さと状態のエイリアシングを解決する手法を提案。
- 統一視覚運動ターゲット:物理的行動を超えたVLAの教師信号VLA2026/8/1
VLAモデルの予測ターゲットを、物理的な行動だけでなく視覚的なシーン遷移情報も含む統一潜在表現に変更し、追加データやアーキテクチャ変更なしで学習効率と性能を向上させる手法を提案した。
- DeVA: 物理的ガイダンスを備えた分離型ビデオ・アクションモデルによるロボットポリシー学習VLA2026/7/1
ビデオ生成とアクション予測を分離した専門家モジュールと物理的ガイダンスを導入し、ロボット操作ポリシーの学習効率と汎化性能を向上させた。
- 表現アンカリングと言語-行動整合による汎化可能なVLAファインチューニングVLA2026/7/1
事前学習済みVLMをロボットデモでファインチューニングする際に生じる表現劣化と言語-行動の不整合を防ぐため、凍結VLMからの層別蒸留と行動を離散方向ラベル化して同一観測で言語・行動を学習する手法を提案し、実機とシミュレーションで性能向上を確認した。
- CRAFT:ハイブリッド硬軟コンプライアンスを備えた腱駆動ハンドマニピュレーション2026/3/1
関節に軟質材料、リンクに硬質材料を配置した腱駆動型ロボットハンドを開発し、把持性能と耐久性を向上させた。
- ViPRA: 動画予測によるロボット行動生成VLA2025/11/1
ラベルなし動画から将来の視覚観測と潜在行動を予測するモデルを事前学習し、少数の実演で連続ロボット制御を微調整するフレームワークを提案。
- 生成動画を模倣するロボットマニピュレーション:物理的実演なしで複雑タスクを実現マニピュレーション2025/7/1
言語指示と初期画像からAIが生成した動画を模倣し、物理的な実演やロボット固有の訓練なしに、注ぐ・拭く・混ぜるなどの複雑な操作をロボットに実行させるシステムを開発した。
- Exploitation-Guided Exploration for Semantic Embodied Navigation2023/11/1
- Habitat 3.0: A Co-Habitat for Humans, Avatars and Robots2023/10/1
- An Unbiased Look at Datasets for Visuo-Motor Pre-Training2023/10/1
- Adaptive Coordination in Social Embodied Rearrangement2023/6/1
- MOPA: Modular Object Navigation with PointGoal Agents2023/4/1
- Affordances from Human Videos as a Versatile Representation for Robotics2023/4/1
- Last-Mile Embodied Visual Navigation2022/11/1
- Language-Aligned Waypoint (LAW) Supervision for Vision-and-Language Navigation in Continuous Environments2021/9/1
- MultiON: Benchmarking Semantic Map Memory using Multi-Object Navigation2020/12/1
- AllenAct: A Framework for Embodied AI Research2020/8/1