Tianyuan Yuan
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA模倣学習/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- G0.5: ロボットの推論と行動のための単一自己回帰ストリームVLA2026/8/1
単一のトランスフォーマーデコーダが推論トークンと行動トークンを同一の目的で生成する、事前学習済み自己回帰VLAモデルG0.5を提案。異なるロボットの行動を共有語彙に変換するトークナイザーや、チェーン・オブ・ソート、視覚メモリを導入し、複数のベンチマークでSOTAを達成。
- VolumeDP: 操作ポリシー学習のためのボリューム表現モデリング模倣学習/操作2026/3/1
2D画像から直接3D動作を予測する既存手法の2D-3Dミスマッチを解消するため、画像特徴を3Dボリューム表現に変換し、タスク関連ボクセルを選択して動作予測を行う新しいポリシーアーキテクチャを提案した。
- FASTer: ニューラル行動トークン化による効率的な自己回帰型視覚言語行動モデリングVLA2025/12/1
行動チャンクを単一チャネル画像として符号化する学習可能なトークナイザと、ブロック単位の自己回帰復号化を組み合わせ、推論速度とタスク性能を両立させたVLAフレームワークを提案。
- GalaxeaオープンワールドデータセットとG0デュアルシステムVLAモデルVLA2025/9/1
実環境で収集した大規模ロボット行動データセットを構築し、VLMによる計画とVLAによる実行を組み合わせた二重システムモデルG0を3段階学習で訓練した。
- VectorMapNet: End-to-end Vectorized HD Map Learning2022/6/1