Taegeon Park
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAオフライン強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HABILIS Brain 0: 視覚言語行動と残差フロー回復のための幾何変化監督VLA2026/9/22
現在の観測からマルチビューの未来-現在の幾何変化トークンを予測するGC-VLAを提案し、4段階の学習でLIBEROにおいて99.55%の成功率を達成した。
- Habilis-β: 高速動作と長時間稼働を実現するオンデバイス視覚言語行動モデルVLA2026/2/1
実環境での連続稼働を想定し、大規模プレイデータでの事前学習と整流フロー蒸留を組み合わせることで、エッジデバイス上で高速かつ長時間安定して動作するVLAモデルを実現した。
- グラフ支援スティッチングによるオフライン階層強化学習オフライン強化学習2025/6/1
サブゴール選択をグラフ探索問題として定式化し、異なる軌跡の状態を統合して効率的に遷移を接続するオフライン階層強化学習フレームワークを提案。