Shiyu Huang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA視覚グラウンディング群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GroundingPI:視覚プリミティブで物理知能に挑むグラウンディング基盤モデルVLA2026/9/30
点やボックスを量子化座標として生成する4Bのグラウンディング基盤モデルを提案し、ロボット操作や自動運転の視覚バックボーンとして性能を向上させた。
- GroundAnything: 並列デコーディングと高精度視覚グラウンディングをフラッシュ速度で両立視覚グラウンディング2026/9/30
拡散モデルによる並列デコーディングで視覚グラウンディングを高速化し、4Bモデルで同規模の最先端性能を達成した研究。
- MQE: マルチエージェント四足歩行環境で相互作用の可能性を解き放つ群制御2024/3/1
複数の四足ロボットが協調・競争するタスクを学習・評価するための新しいマルチエージェント強化学習環境MQEを提案し、最先端アルゴリズムをベンチマークした。
- SwiftSage: A Generative Agent with Fast and Slow Thinking for Complex Interactive Tasks2023/5/1
- Learning Graph-Enhanced Commander-Executor for Multi-Agent Navigation2023/2/1