Suyan Dai
収録論文 2本 ・ フィジカルAI/ロボット学習
VLA自動運転/LLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PixelVLA:視覚言語行動モデルにおけるピクセルレベル理解の推進VLA2025/11/1
ピクセル単位のシーン理解とテキスト・画像のマルチモーダル指示に対応したVLAモデルを提案し、大規模ピクセル注釈データセットで学習することで、低コストながら操作成功率を大幅に向上させた。
- 大規模言語モデルを用いた自動運転のためのエッジ・クラウド協調動作計画自動運転/LLM2024/8/1
データドリフト検出を活用し、重要なデータのみをクラウドのGPT-4で処理、通常データはエッジ上の小型LLMで処理するエッジ・クラウド協調自動運転システムEC-Driveを提案した。