Quan Wang
収録論文 8本 ・ フィジカルAI/ロボット学習
教育支援ロボティクス視覚推論具現化エージェント/四足ロボットドローン/LLMエージェントVLA空間知能評価
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ASD児童向けロボット支援学習法:教えることで学ぶ pedagogy の提案教育支援ロボティクス2026/9/13
自閉症スペクトラム児の社会的スキル向上のため、ロボットを「教える相手」として用いる学習法を提案し、人間相手よりロボット相手の方が成績・集中度が高いことを示した。
- VBVR-Pro: ネイティブ視覚推論のためのスケーラブルで検証可能なスイート視覚推論2026/8/26
視覚生成を推論の媒体として扱うネイティブ視覚推論の研究を進めるため、300の手続き生成タスクからなる閉ループテストベッドVBVR-Proを導入し、検証可能な報酬スコアラと制御されたモダリティ比較を提供する。
- Y-BotFrame: 四足ロボットアシスタントのための拡張可能な具現化エージェントフレームワーク具現化エージェント/四足ロボット2026/6/1
四足ロボットを音声・視覚・LiDARによるマルチモーダル認識と大規模言語モデルを組み合わせた知的アシスタントに変える、拡張可能なフレームワークを提案した。自然言語の指示を実行可能なタスクに変換し、リモコン不要の対話を実現する。
- AerialClaw: LLM駆動の自律型空中エージェントのためのオープンソースフレームワークドローン/LLMエージェント2026/6/1
自然言語のミッションを理解し、実行可能な空中スキルを呼び出し、フィードバックを閉ループで反映するLLMベースの自律UAVエージェントを実現するオープンソースフレームワークを提案する。
- マルチモーダル基盤モデルによる空間知能のスケーリングVLA2025/11/1
800万件の多様な空間データでマルチモーダル基盤モデルを訓練し、空間知能ベンチマークで大幅な性能向上を達成するとともに、データスケーリングや創発的汎化の兆候を分析した。
- マルチモーダルLLMの空間知能を包括的に評価するEASI空間知能評価2025/8/1
GPT-5など最先端マルチモーダルモデルの空間理解・推論能力を、統一的なタスク分類に基づく8つのベンチマークで大規模に評価し、人間との差や限界を明らかにした。
- Distributed Simulation Platform for Autonomous Driving2017/5/1
- Implementing a Cloud Platform for Autonomous Driving2017/4/1