Daniel Milan
The University of Texas at Austin
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- もし、ならば、そうでなければ:視覚言語ナビゲーションにおける条件分岐の診断VLA2026/8/18
視覚言語ナビゲーションエージェントの条件分岐能力を診断するためのベンチマークCondVLNを導入し、分岐条件をシーングラフに基づいて生成し、エージェントの失敗原因を分析した。
- UNCAP: 不確実性誘導型ニューロシンボリック計画と自然言語通信による協調自動運転VLA2025/10/1
自動運転車同士が自然言語メッセージで通信し、知覚の不確実性を明示的に考慮して協調計画を行う視覚言語モデルベースの手法を提案。通信帯域を削減しつつ安全性を向上させる。
- VLN-Zero:ゼロショット移動のための高速探索とキャッシュ活用型ニューロシンボリック視覚言語ナビゲーションVLA2025/9/1
VLMでシーングラフを効率的に構築し、ニューロシンボリックな計画とキャッシュ実行を組み合わせることで、未知環境でのゼロショット視覚言語ナビゲーションを高速・高精度に実現した研究。
- マルチモーダル基盤モデルによる計画時の不確実性を分離・定量化する形式的手法VLA2024/11/1
視覚理解に起因する知覚不確実性と計画生成の決定不確実性を分離し、形式検証とConformal Predictionで定量化して、能動的再観測や高確信データでの微調整によりロボットタスクの信頼性を高める枠組みを提案した。