Jun Yu
Harbin Institute of Technology (Shenzhen)
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA動画理解マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 再構成は行動ではない:行動中心の潜在ダイナミクスモデリングVLA2026/9/14
再構成誤差と下流性能の不一致を指摘し、行動クエリと行動トークンで行動抽出・利用を強化する軽量な潜在行動モデルACT-LAMを提案した論文。
- ShallowStream: 浅い層で索引し、深い層で答えるストリーミング動画理解動画理解2026/9/2
動画ストリーミング理解の計算コストを削減するため、MLLMの浅い層でフレームの索引を構築し、質問時には浅い層の注意スコアで関連フレームを選択して深い層で回答するフレームワークを提案した。
- 見て、計画して、巻き戻す:進捗認識型視覚言語行動モデルによる堅牢なロボット操作マニピュレーション2026/3/1
ロボット操作のタスク進捗を明示的なマイルストーンで測定し、失敗時に回復可能な状態へ巻き戻すことで堅牢性を高める、進捗認識型の視覚言語行動フレームワークSPRを提案した。
- ガイド付き自己注意行動クローニングによる軟体物操作スキルの汎化学習マニピュレーション2024/10/1
点群から意味特徴を抽出し、ガイド付き自己注意と二段階ファインチューニングで軟体物の操作スキルを汎化可能に学習する行動クローニング方策を提案した。
- The RoboDepth Challenge: Methods and Advancements Towards Robust Depth Estimation2023/7/1
- Lightweight Neural Path Planning2023/7/1