Zeyu Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
設計自動化長尺動画理解VLA視覚ナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- LLMを活用したマルチエージェント自律メカトロニクス設計フレームワーク設計自動化2025/4/1
LLMベースのマルチエージェントシステムで、機械設計・最適化・電子工学・ソフトウェアを統合し、水質モニタリング用の自律型船舶を設計・試作した。
- 長尺動画理解のための時間的選好最適化長尺動画理解2025/1/1
長尺動画における時間的グラウンディングを改善するため、局所的・包括的な2粒度の選好データセットを用いた自己学習型の事後学習フレームワークTPOを提案し、複数のベンチマークで有効性を示した。
- CogACT: 認知と行動を融合するロボット操作のための基盤的視覚-言語-行動モデルVLA2024/11/1
VLMの出力を条件とする専用の拡散行動トランスフォーマーを組み込んだ新しいVLAアーキテクチャを提案し、ロボット操作の成功率と汎化性能を大幅に向上させた。
- MemoNav: 視覚ナビゲーションのための作業記憶モデル視覚ナビゲーション2024/2/1
画像ゴールナビゲーションにおいて、短期・長期・作業記憶を組み合わせてゴールに関連するシーン特徴を効率的に抽出する新しい記憶モデルを提案し、複数の難易度で従来手法を上回る性能を示した。
- Scenario Diffusion: Controllable Driving Scenario Generation With Diffusion2023/11/1
- DistillBEV: Boosting Multi-Camera 3D Object Detection with Cross-Modal Knowledge Distillation2023/9/1