Amir Taherin
収録論文 3本 ・ フィジカルAI/ロボット学習
世界モデルVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 機械における人間の認知:世界モデルの統一的視点世界モデル2026/4/1
世界モデルの研究を認知機能の観点から分類し、人間のような認知能力を目指すための統一的枠組みを提案した論文。特に動機付けとメタ認知の研究不足を指摘し、今後の研究方向を示している。
- エッジからクラウドGPUまでのVision-Language-ActionモデルのクロスプラットフォームスケーリングVLA2025/9/1
5つの代表的なVLAモデルをエッジとデータセンターGPUで評価し、精度・遅延・スループット・メモリ使用量を測定してスケーリング傾向を明らかにした。
- VOTE: 軌道アンサンブル投票による視覚-言語-行動モデルの最適化VLA2025/7/1
VLAモデルの推論遅延と学習コストを削減するため、少ない行動トークンで並列生成する学習フレームワークと、過去と現在の予測を投票で統合する推論最適化を提案し、成功率と推論速度を大幅に向上させた。