Gan Sun
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA/生涯学習キャリブレーション/継続学習VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 人間らしい物理的知能に向けて:ロボット操作のための生涯視覚言語行動学習VLA/生涯学習2026/7/1
ロボット操作におけるVLAモデルの生涯学習を実現するため、二重タイムスケール適応機構とキャッシュ効率的なリプレイ戦略を備えたLifelongVLAフレームワークを提案した。
- オープンワールドロボット操作のための継続的手眼較正キャリブレーション/継続学習2026/4/1
ロボット操作における手眼較正の継続学習フレームワークを提案し、空間的リプレイ戦略と構造保存蒸留により、逐次的に遭遇する新しいシーンへの適応時の破滅的忘却を軽減する。
- OpenVLN: オープンワールド空中視覚言語ナビゲーションVLA2025/11/1
限られたデータでUAVの言語誘導飛行を実現するため、強化学習でVLMを微調整し、長期的軌道計画を可能にするフレームワークを提案。
- PixelVLA:視覚言語行動モデルにおけるピクセルレベル理解の推進VLA2025/11/1
ピクセル単位のシーン理解とテキスト・画像のマルチモーダル指示に対応したVLAモデルを提案し、大規模ピクセル注釈データセットで学習することで、低コストながら操作成功率を大幅に向上させた。
- ロボットマニピュレーションのための終わりなき行動クローニングエージェントマニピュレーション2024/3/1
言語条件付きで新たな3Dシーン意味論と操作スキルを継続的に学習する終わりなき行動クローニングエージェントNBAgentを提案し、ベンチマークで有効性を示した。
- Generative Partial Visual-Tactile Fused Object Clustering2020/12/1
- Visual Tactile Fusion Object Clustering2019/11/1