Wei Zhan
University of California, Berkeley
収録論文 82本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- X-Reset: クロスエンボディメント・リセットによる物体中心強化学習のスケーリングマニピュレーション2026/9/28
人間の手と物体のデモンストレーションをロボットのリセット状態に変換し、汎用物体中心報酬での強化学習の探索問題を解決するフレームワークを提案。
- DexTacWAM: 巧みな操作のための視触覚ワールドアクションモデルマニピュレーション2026/9/21
各指先の触覚を個別に符号化し、指・姿勢を考慮した圧縮器で統合して動画拡散ワールドモデルに注入する視触覚ワールドアクションモデルを提案し、接触の多い両手巧み操作タスクで大幅な性能向上を達成した。
- AdaDexGrasp: 3次元視覚触覚表現融合による適応的器用把持マニピュレーション2026/8/1
視覚と触覚を統合した表現を用いて、把持計画と接触後の適応的修正を行う統一フレームワークを提案し、多様な物体での把持成功率と汎化性を向上させた。
- TerraZero: ゼロデモンストレーション自己対戦スケールのための手続き型運転シミュレーション自動運転/シミュレーション2026/7/1
強化学習スケールで高速かつ現実的な地図構造に基づく多様な運転シナリオを生成する手続き型シミュレータと自己対戦学習スタックを提案し、ゼロデモンストレーションで汎化する運転ポリシーを訓練した。
- TerraTransfer: 専門家のデモなしで学ぶエンドツーエンド運転ポリシー自動運転2026/6/1
ベクトル化シミュレータでの自己対戦により運転ポリシーを事前学習し、視覚バックボーンとの潜在空間を整列させることで、専門家デモなしでエンドツーエンド運転を実現する手法を提案。
- T-Rex: 触覚反応型巧みな操作触覚/操作2026/6/1
触覚信号に動的に反応する操作を実現するため、大規模な触覚データセットと可変レートのMixture-of-Transformersアーキテクチャを導入し、12の操作タスクで成功率を大幅に向上させた。
- スペクトラルスプラット:運転シーンのための外観分離型フィードフォワードガウシアンスプラッティング3D再構成/ガウシアンスプラッティング2026/4/1
運転シーンの3D再構成において、幾何学と外観(照明・天候など)を分離するフィードフォワードガウシアンスプラッティング手法を提案し、外観の転送や再照明を可能にした。
- LMGenDrive: マルチモーダル理解と生成的ワールドモデルを統合したエンドツーエンド運転自動運転2026/4/1
本論文は、LLMベースのマルチモーダル理解と生成的ワールドモデルを統合した初のエンドツーエンド自動運転フレームワークLMGenDriveを提案し、将来の運転ビデオと制御信号を同時生成することで、長尾・オープンワールドシナリオへの一般化を向上させる。
- HetroD: 異種交通環境における自動運転のための高忠実度ドローンデータセットとベンチマーク自動運転データセット2026/2/1
歩行者・自転車・二輪車などが混在する異種交通環境を対象に、ドローンで収集した大規模データセットと、予測・計画・シミュレーションの標準ベンチマークを構築した。
- SPACeR: 集中参照モデルによる自己対戦アンカリング自動運転/自己対戦RL2025/10/1
事前学習済みのトークン化自己回帰運動モデルを集中参照ポリシーとして自己対戦強化学習を誘導し、人間らしい運転行動を効率的に学習するフレームワークを提案。
- R3D2: 拡散モデルによる自動運転シミュレーションへのリアルな3Dアセット挿入sim2real2025/6/1
拡散モデルを用いて、自動運転のニューラルレンダリングシーンに影や照明を考慮したリアルな3Dアセットをリアルタイムで挿入する手法を提案。
- LangTraj: 言語条件付き軌道シミュレーションのための拡散モデルとデータセット拡散モデル/交通シミュレーション2025/4/1
自然言語で交通シナリオ内の全エージェントの挙動を制御できる拡散モデルと、その学習用の大規模データセットを提案し、自動運転のテストを柔軟かつ現実的にする。
- 高速レースにおけるフェアプレイ:自律レーシングシステムへのスポーツマンシップの統合自律レーシング2025/3/1
自律レーシングにスポーツマンシップを組み込むため、二段階のゲーム理論的枠組みを提案し、競争性能を保ちつつ安全で公正な走行を実現する。
- 物理特性を考慮したオンラインマスキング推論によるロボットパレタイズマニピュレーション2025/2/1
強化学習とオンライン学習で動的に更新する行動空間マスキングを用い、箱の密度や剛性といった物理特性を考慮して積み付け計画を立てる手法を提案し、実機のロボットパレタイザで有効性を検証した。
- DexHandDiff: 適応的巧みな操作のための相互作用を考慮した拡散計画マニピュレーション2024/11/1
接触を伴う巧みな操作のための拡散計画フレームワーク。接触前後の二段階拡散とLLMによるガイダンス生成で、訓練分布外の目標にも適応できる。
- 言語駆動型方策蒸留によるマルチエージェント強化学習の協調運転VLA2024/10/1
LLMを教師エージェントとして用い、その意思決定を小規模な生徒エージェントに蒸留することで、協調運転タスクにおけるMARLの学習効率と性能を向上させる手法を提案した。
- 物体部分シーンフローによる具現化非依存の行動計画行動計画2024/9/1
対象物体の部分運動を3Dシーンフローとして予測し、その変換から多様なロボットの行動軌道を生成する具現化非依存の手法を提案。
- P2 Explore: 階層予測を用いた未知の雑然環境における効率的探索探索2024/9/1
雑然とした屋内環境の間取りを予測するFPUNetを提案し、予測した部屋のトポロジーに基づいて訪問順を最適化することで、ロボット探索の経路長を短縮する手法を実現した。
- DSLO: 不整合な時空間伝播に基づく深層シーケンスLiDARオドメトリLiDARオドメトリ2024/9/1
LiDAR点群の時系列から自己位置推定を行う深層学習手法を提案し、空間特徴の再利用やゲート付き階層的姿勢精緻化、時間的特徴伝播により、KITTIとArgoverseで精度と速度を両立した。
- Residual-MPPI:連続制御のためのオンラインポリシーカスタマイズオンライン計画2024/7/1
学習済みポリシーの行動分布のみを用い、実行時にMPPIで残差行動を計画することで、追加学習なしに新しい性能指標へ数ショット/ゼロショットで適応させる手法を提案。
- WOMD-Reasoning: 運転シーンにおけるインタラクション推論のための大規模データセットVLA2024/7/1
実世界の運転シーンにおける交通ルールに基づくインタラクションを記述・推論する300万件のQ&Aデータセットを構築し、それを用いた運転動作言語モデルMotion-LLaVAを提案した。
- スパース拡散方策:ロボット学習のためのスパースで再利用可能かつ柔軟な方策VLA2024/7/1
Transformerベースの拡散方策にMixture of Expertsを組み込み、タスクごとに専門家を選択的に活性化することで、マルチタスク学習や継続学習を効率化する手法を提案した。
- MEReQ: 人間の介入からサンプル効率よく方針を整合させる最大エントロピー残差Q逆強化学習模倣学習/逆強化学習2024/6/1
人間の介入フィードバックから、事前方針と人間の報酬の差分を残差報酬として推定し、残差Q学習でサンプル効率よくロボットの方針を人間の好みに整合させる手法を提案。
- ロボティクスにおけるNeRF:サーベイNeRF2024/5/1
NeRFのロボティクスへの応用と、ロボティクス展開に向けたNeRF自体の改良に関する研究を体系的にまとめたサーベイ論文。
- 反復的行動マスキング学習によるロボットパレタイズのためのタスクプランナの効率的強化学習マニピュレーション2024/4/1
ロボットパレタイズのタスク計画において、教師あり学習で行動空間を反復的に枝刈りすることで強化学習を効率化する手法を提案した。
- DrPlanner: 大規模言語モデルを用いた自動運転車のモーションプランナーの診断と修復自動運転/モーションプランニング2024/3/1
大規模言語モデルを活用し、自動運転車のモーションプランナーを自動的に診断・修復するフレームワークを提案。
- 汎化性と解釈性を両立する運動予測:深層変分ベイズアプローチ運動予測2024/3/1
周囲車両の将来挙動を予測するため、目的地の空間分布を変分混合ガウスで推定する解釈可能な生成モデルGNeVAを提案し、分布外ケースへの汎化性も向上させた。
- PhyGrasp: 物理常識推論でロボット把持を汎化するマルチモーダル大規模モデルマニピュレーション2024/2/1
言語と3D点群を統合した大規模モデルで物体の物理的性質を推論し、未知の素材や形状でも人間の指示に沿った把持姿勢を生成する。
- BeTAIL: 人間のレーシングゲームプレイからの行動トランスフォーマー敵対的模倣学習模倣学習2024/2/1
人間のレースゲームプレイのデモから学ぶ行動トランスフォーマー方策に、オンライン敵対的模倣学習の残差方策を組み合わせ、環境適応性とサンプル効率を改善した手法を提案。
- Learning Online Belief Prediction for Efficient POMDP Planning in Autonomous Driving2024/1/1
- SAFE-SIM: Safety-Critical Closed-Loop Traffic Simulation with Diffusion-Controllable Adversaries2024/1/1
- RSRD: A Road Surface Reconstruction Dataset and Benchmark for Safe and Comfortable Autonomous Driving2023/10/1
- LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving2023/10/1
- Adaptive Spatio-Temporal Voxels Based Trajectory Planning for Autonomous Driving in Highway Traffic Flow2023/10/1
- Human-oriented Representation Learning for Robotic Manipulation2023/10/1
- Long-Term Dynamic Window Approach for Kinodynamic Local Planning in Static and Crowd Environments2023/10/1
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1
- Guided Online Distillation: Promoting Safe Reinforcement Learning by Offline Demonstration2023/9/1
- Double-Iterative Gaussian Process Regression for Modeling Error Compensation in Autonomous Racing2023/5/1
- Editing Driver Character: Socially-Controllable Behavior Generation for Interactive Traffic Simulation2023/3/1
- Outracing Human Racers with Model-based Planning and Control for Time-trial Racing2022/11/1
- Time Will Tell: New Outlooks and A Baseline for Temporal Multi-View 3D Object Detection2022/10/1
- Analyzing and Enhancing Closed-loop Stability in Reactive Simulation2022/8/1
- SST-Calib: Simultaneous Spatial-Temporal Parameter Calibration between LIDAR and Camera2022/7/1
- Efficient Game-Theoretic Planning with Prediction Heuristic for Socially-Compliant Autonomous Driving2022/7/1
- Hierarchical Planning Through Goal-Conditioned Offline Reinforcement Learning2022/5/1
- Interventional Behavior Prediction: Avoiding Overly Confident Anticipation in Interactive Prediction2022/4/1
- Domain Knowledge Driven Pseudo Labels for Interpretable Goal-Conditioned Interactive Trajectory Prediction2022/3/1
- DetMatch: Two Teachers are Better Than One for Joint 2D and 3D Semi-Supervised Object Detection2022/3/1
- Transferable and Adaptable Driving Behavior Prediction2022/2/1
- Causal-based Time Series Domain Generalization for Vehicle Intention Prediction2021/12/1
- Hierarchical Adaptable and Transferable Networks (HATN) for Driving Behavior Prediction2021/11/1
- Dealing with the Unknown: Pessimistic Offline Reinforcement Learning2021/11/1
- Iterative Imitation Policy Improvement for Interactive Autonomous Driving2021/9/1
- Constrained Iterative LQG for Real-Time Chance-Constrained Gaussian Belief Space Planning2021/8/1
- Automatic Construction of Lane-level HD Maps for Urban Scenes2021/7/1
- Image2Point: 3D Point-Cloud Understanding with 2D Image Pretrained Models2021/6/1
- You Only Group Once: Efficient Point-Cloud Processing with Token Representation and Relation Inference Module2021/3/1
- Diverse Critical Interaction Generation for Planning and Planner Evaluation2021/3/1
- A Simple and Efficient Multi-task Network for 3D Object Detection and Road Understanding2021/3/1
- Interaction-Aware Behavior Planning for Autonomous Vehicles Validated with Real Traffic Data2021/1/1
- A Safe Hierarchical Planning Framework for Complex Driving Scenarios based on Reinforcement Learning2021/1/1
- Labels Are Not Perfect: Inferring Spatial Uncertainty in Object Detection2020/12/1
- Prediction-Based Reachability for Collision Avoidance in Autonomous Driving2020/11/1
- IDE-Net: Interactive Driving Event and Pattern Extraction from Human Data2020/11/1
- Socially-Compatible Behavior Design of Autonomous Vehicles with Verification on Real Human Data2020/10/1
- Towards Better Performance and More Explainable Uncertainty for 3D Object Detection of Autonomous Vehicles2020/6/1
- Efficient Sampling-Based Maximum Entropy Inverse Reinforcement Learning with Application to Autonomous Driving2020/6/1
- Scenario-Transferable Semantic Graph Reasoning for Interaction-Aware Probabilistic Prediction2020/4/1
- Inferring Spatial Uncertainty in Object Detection2020/3/1
- UrbanLoco: A Full Sensor Suite Dataset for Mapping and Localization in Urban Scenes2019/12/1
- INTERACTION Dataset: An INTERnational, Adversarial and Cooperative moTION Dataset in Interactive Driving Scenarios with Semantic Maps2019/10/1
- Multiple criteria decision-making for lane-change model2019/10/1
- Generic Tracking and Probabilistic Prediction Framework and Its Application in Autonomous Driving2019/8/1
- Interpretable Modelling of Driving Behaviors in Interactive Driving Scenarios based on Cumulative Prospect Theory2019/7/1
- Behavior Planning of Autonomous Cars with Social Perception2019/5/1
- Coordination and Trajectory Prediction for Vehicle Interactions via Bayesian Generative Modeling2019/5/1
- A Framework for Probabilistic Generic Traffic Scene Prediction2018/10/1
- Generic Vehicle Tracking Framework Capable of Handling Occlusions Based on Modified Mixture Particle Filter2018/9/1
- Towards a Fatality-Aware Benchmark of Probabilistic Reaction Prediction in Highly Interactive Driving Scenarios2018/9/1
- Probabilistic Prediction of Interactive Driving Behavior via Hierarchical Inverse Reinforcement Learning2018/9/1
- Courteous Autonomous Cars2018/8/1