Ziyu Wang
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EndoWAM: 汎用内視鏡ナビゲーションのための接地された世界行動モデル医療ロボティクス2026/8/1
内視鏡ナビゲーションのための世界行動モデルを初めて提案し、将来の目標領域予測と行動生成を統合することで、変形や視点変化に対するロバスト性を向上させた。
- VRUD: 混在交通における複雑な車両と脆弱な道路利用者の相互作用のためのドローンデータセットデータセット2026/4/1
都市部の無秩序な環境での自動運転研究のために、ドローンで撮影した脆弱な道路利用者(VRU)と車両の相互作用データセットVRUDを構築した。
- グレートマーチ100:身体性AIエージェント評価のための100の詳細指向タスクVLA評価ベンチマーク2026/1/1
ロボット学習の評価に向けて、多様な相互作用とロングテール行動を網羅する100の詳細設計タスク「GM-100」を提案し、複数のVLAモデルの性能差を明確に評価できることを示した。
- 実用的なVLA基盤モデルVLA2026/1/1
9種類の双腕ロボットから約2万時間の実世界データを収集し、4つのロボットプラットフォームで評価した汎用性の高いVLA基盤モデルLingBot-VLAを開発した。
- IPR-1: 対話型物理推論器VLA2025/11/19
1000以上の多様なゲームで物理法則と因果関係を学習し、世界モデルの予測とVLMの推論を統合して未知のゲームにもゼロショットで対応するエージェントを提案。
- RL-100: 実世界強化学習による高性能ロボットマニピュレーションマニピュレーション2025/10/1
拡散視覚運動ポリシーに模倣学習と強化学習を統合し、軽量な蒸留で高速制御を実現した実世界ロボットマニピュレーションのフレームワーク。8つの多様な実タスクで100%の成功率を達成。
- EDEN: 大規模3次元環境における高速UAV自律探査のための効率的二層探査計画UAV探査2025/6/1
大規模3次元環境でのUAV自律探査を高速化するため、長期的な領域経路計画と曲率ペナルティを考慮した局所的な視点選択を組み合わせた二層探査計画手法を提案し、シミュレーションと実機実験で有効性を示した。
- UniSTPA:エンドツーエンド自動運転のための安全分析フレームワーク自動運転安全分析2025/5/1
エンドツーエンド自動運転システムのライフサイクル全体を対象に、STPAを拡張してモデル内部層まで危険分析を行うUniSTPAを提案し、高速道路の自動運転機能で有効性を示した。
- ArticuBot: 大規模シミュレーションによる汎用関節物体操作ポリシーの学習sim2real2025/3/1
物理シミュレーションで大量のデモを生成し、点群ベースの階層的模倣学習ポリシーを訓練することで、未知の関節物体を実機でゼロショット操作できるようにした研究。
- FSMP: 複雑大規模3次元環境の高速自律探査のためのフロンティアサンプリング混合プランナ自律探査2025/2/1
フロンティア検出と決定論的サンプリングによるロードマップを組み合わせ、2段階の経路計画で複雑・大規模3次元環境を高速に探査するMAV向けフレームワークを提案した。
- 視覚言語モデルのフィードバックによる実世界オフライン強化学習オフライン強化学習2024/11/1
視覚言語モデルからの選好フィードバックとタスクのテキスト記述を用いてオフラインデータセットに自動で報酬ラベルを付与し、実世界のロボット支援着衣タスクなどで有効な方策を学習するシステムを提案した。
- 動的トポロジカルグラフ上のボロノイ分割による高速・通信効率の良いマルチUAV探索群制御2024/8/1
探索済み・探索中領域をノードとする動的トポロジカルグラフを構築し、グラフボロノイ分割でUAVにタスクを割り当てることで、通信量を抑えつつ大規模環境のマルチUAV探索を高速化する手法を提案した。
- VeTraSS: グラフモデリングと表現学習による車両軌跡類似検索軌跡検索2024/4/1
車両軌跡データをマルチスケールグラフに変換し、注意機構付きGNNで埋め込みを学習することで、類似軌跡を高精度に検索する手法を提案した。
- DiffTORI: 深層強化学習と模倣学習のための微分可能な軌道最適化強化学習/模倣学習2024/2/1
軌道最適化をポリシー表現として用い、そのコストとダイナミクス関数を微分可能最適化によりエンドツーエンドで学習する手法を提案し、強化学習と模倣学習の両方で従来手法を上回る性能を達成した。
- Generalizable Visual Reinforcement Learning with Segment Anything Model2023/12/1
- Offline Learning from Demonstrations and Unlabeled Experience2020/11/1
- Task-Relevant Adversarial Imitation Learning2019/10/1
- Scaling data-driven robotics with reward sketching and batch reinforcement learning2019/9/1
- One-Shot High-Fidelity Imitation: Training Large-Scale Deep Nets with RL2018/10/1
- Reinforcement and Imitation Learning for Diverse Visuomotor Skills2018/2/1
- Learning human behaviors from motion capture by adversarial imitation2017/7/1