Yuzhen Liu
収録論文 7本 ・ フィジカルAI/ロボット学習
sim2realナビゲーションマニピュレーションVLAアクティブSLAM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 実世界クラフトランナーにおける協調・競合チームプレイsim2real2026/2/1
シミュレーションと実機ロボットからなるシステムを構築し、マルチエージェント強化学習で協調・競合方策を効率的に学習させ、OODSIでsim2realギャップを軽減して実世界タスクを実現した。
- MAG-Nav: 記憶保持型能動的グラウンディングによる言語駆動物体ナビゲーションナビゲーション2025/8/1
視点を動かして対象を能動的に見つけ、過去の記憶をたどって曖昧さを解消するVLMベースのゼロショット物体ナビゲーション手法を提案し、四足歩行ロボットでも実証した。
- VLM-TDP:視覚言語モデル誘導の軌道条件付き拡散ポリシーによる堅牢な長期的マニピュレーションマニピュレーション2025/7/1
視覚言語モデルで長期タスクをサブタスクに分解し、各サブタスクのボクセル軌道を生成して拡散ポリシーの条件付けに用いることで、画像ノイズや環境変化に強い長期的マニピュレーションを実現した。
- MinD: リアルタイム計画と暗黙的リスク分析のためのデュアルシステム世界モデルの学習VLA2025/6/1
低頻度の映像生成と高頻度の拡散ポリシーを非同期に組み合わせ、単一ステップの潜在特徴でリアルタイムに行動計画とリスク予測を行う世界モデルを提案。
- ViDARデバイスと強化学習によるアクティブSLAMアクティブSLAM2025/6/1
モータエンコーダを統合したViDARデバイスと、深層強化学習を用いたプラットフォーム運動から分離したアクティブSLAM手法を提案し、状態推定精度を向上させた。
- VLN-Game: 視覚言語均衡探索によるゼロショット意味的ナビゲーションナビゲーション2024/11/1
事前学習済み視覚言語特徴と3D再構成を統合した物体中心の空間マップを構築し、ゲーム理論的視覚言語モデルで言語記述に最も合致する対象を選定することで、未知環境でのゼロショット物体・言語ナビゲーションを実現した。
- Lifelike Agility and Play in Quadrupedal Robots using Reinforcement Learning and Generative Pre-trained Models2023/8/1