Yuxiang Zhang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA模倣学習自動運転
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PhysBrain 1.5:視覚言語モデルから物理基盤モデルへVLA2026/9/14
人間のインタラクション動画から身体動作を学習し、行動生成と未来状態予測を統合した8Bの物理基盤モデルを構築、28の身体理解ベンチマークでオープンソース最高性能を達成した。
- ヒューマン・アズ・ヒューマノイド:人間に合わせた身体を持つエゴ・エクソ人間ビデオからのゼロショット人型ロボット学習模倣学習2026/6/1
人間のデモ動画を高自由度ヒューマノイドのVLA学習に使えるように、身体・センシング・行動ラベルを揃えるフレームワークを提案し、実機で検証した。
- VLM-UDMC: 都市自動運転のためのVLM強化型統合意思決定・運動制御自動運転2025/7/1
視覚言語モデルとRAGを活用した上位意思決定と、軽量LSTMによる軌道予測を組み合わせ、都市環境での自動運転の安全性と解釈性を高める統合フレームワークを提案し、実車実験で有効性を検証した。