Jiaming Tang
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- FlashVLA: 高速かつ非同期なVLA推論のためのストリーミング行動デコードVLA2026/8/27
VLAモデルの推論遅延と非同期実行の不安定さを解決するため、ストリーミング行動バッファとチャンク単位の因果注意を用いたフレームワークを提案し、単一GPUで30Hz以上の制御周波数を実現した。
- π0.7: 操縦可能な汎用ロボット基盤モデルと創発的能力VLA2026/4/1
多様なコンテキスト条件付けを用いて、未見環境での言語指示追従やゼロショットの身体汎化を実現するロボット基盤モデルπ0.7を提案した。
- MEM: 視覚言語行動モデルのためのマルチスケール具現化メモリVLA2026/3/1
ロボットの長期タスク遂行のために、ビデオベースの短期記憶とテキストベースの長期記憶を組み合わせたマルチスケールメモリアーキテクチャを提案し、15分に及ぶ複雑なタスクを可能にした。
- VLASH: 未来状態を考慮した非同期推論によるリアルタイムVLAVLA2025/12/1
ロボットの状態を前回の行動チャンクで先読みし、予測と実行の時間ずれを解消することで、追加コストなしにVLAの非同期推論を高速化・安定化する手法を提案。