Minghao Zhu
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA/基盤モデルVLAゼロショット認識/RAG自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RynnBrain 1.1:より高機能で汎用的な具現化基盤モデルを目指してVLA/基盤モデル2026/7/1
RynnBrain 1.1は、2Bから122B-A10Bまでの規模を持つ具現化基盤モデル群で、接触点予測や3Dグラウンディングを導入し、ロボット操作に直接対応する表現と出力を実現。実機実験では、Qwenベースや汎用VLAを上回る性能を示した。
- RynnBrain: オープンな身体性基盤モデルVLA2026/2/1
知覚・推論・計画を統合した時空間基盤モデルRynnBrainを提案し、2B/8B/30B-A3B MoEの3規模と下流タスク向け4変種を公開、20の身体性ベンチマークで既存モデルを大幅に上回った。
- SignRAG: スケーラブルなゼロショット道路標識認識のための検索拡張システムゼロショット認識/RAG2025/12/1
視覚言語モデルで標識を記述し、ベクトルDBから候補を検索、LLMで推論するRAGベースのゼロショット道路標識認識フレームワークを提案。303種の標識で95.58%(理想画像)、82.45%(実世界)の精度を達成。
- 不確実性重み付きDecision Transformerによる密集複雑運転シーンでのナビゲーション自動運転2025/9/1
鳥瞰図占有グリッドとTransformerを組み合わせ、予測エントロピーで損失を重み付けするUWDTを提案し、ラウンドアバウトでの自動運転判断を安全かつ効率的にした。
- Training Adversarial yet Safe Agent to Characterize Safety Performance of Highly Automated Vehicles2024/2/1
- A Formal Safety Characterization of Advanced Driver Assist Systems in the Car-Following Regime with Scenario-Sampling2022/2/1