Wei Yang
USTC
収録論文 34本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OPIS: ビデオ世界モデルにおけるマルチオブジェクト記憶のための入力接地ベンチマークビデオ世界モデル2026/9/28
ビデオ世界モデルが初期観測の物体をどれだけ記憶できるかを評価するベンチマークOPISを提案し、8モデルで物体の存在・同一性・構造を測定した。
- 擬似剛体モデルは実植物をどこまで再現できるか?ブルーベリー茎の圃場検証sim2real2026/9/12
ブルーベリーの茎を擬似剛体モデルでシミュレーションし、実際の圃場で計測した変形データと比較してモデルの精度と感度を検証した。
- 表現豊かなロボットピアニスト:グラフ模倣と音楽的ダイナミクスで複雑なピアノ曲を演奏マニピュレーション2026/9/9
強化学習とグラフベースの運指最適化、物理に基づく音響モデルを組み合わせ、人間らしい表現力で多様なピアノ曲を演奏できるロボットハンドを実現した。
- NavArena: 3Dガウススプラッティング再構成からの目標指向ナビゲーションベンチマークの自動構築ナビゲーション2026/9/4
固定された3DGS再構成を、到達可能性や衝突判定、意味的目標を備えたナビゲーションベンチマークへ自動変換するフレームワークを提案し、2,000以上のシーンで2,220万の専門家軌道を生成して評価する。
- LATO.2: 頂点とトポロジーフローによる分解型3Dメッシュ生成3D生成2026/7/12
メッシュ生成を頂点生成と接続生成に分解し、粗いボクセル構造を基盤にしたフローマッチングで高品質な3Dメッシュを生成する手法を提案。
- ViPSim: 視覚空間とパラメータ空間の協調による一貫した長期ホライズン身体化ワールドモデルワールドモデル2026/6/1
身体化ワールドモデルにおける低次元アクションと高次元ビデオ合成の表現ギャップを埋めるため、視覚空間(幾何学的先行知識)とパラメータ空間(数値的駆動)を協調させるフレームワークViPSimを提案し、長期ロールアウトでの軌道ドリフトやロボットと物体の相互作用の不整合を改善した。
- UI-Oceanus: 合成環境ダイナミクスによるGUIエージェントのスケーリングGUIエージェント2026/2/11
GUIエージェントの学習を高価な人間デモの模倣から環境フィードバックによる未来状態予測へと転換し、低コストな自律探索を生成的な教師信号に変換することでスケーラブルな世界モデルを構築した研究。
- 予測的エネルギー認識に基づく公称歩容選択による車輪付き四脚ロボットの省エネ全方向移動歩行2026/1/1
車輪付き四脚ロボットの消費電力を1秒先まで予測するネットワークを構築し、最も省エネな歩容を選んで強化学習で微調整することで、速度追従性能を保ちつつ最大35%の省エネを実現した。
- VT-Refine: 視触覚フィードバックによる両手組立のシミュレーション微調整学習マニピュレーション2025/10/1
少数の実演と高忠実度の触覚シミュレーションを組み合わせ、強化学習で両手組立ポリシーを微調整することで、接触の多い精密作業の実世界性能を向上させた研究。
- Dexplore: 参照スコープ探索による器用な操作のためのスケーラブルなニューラル制御マニピュレーション2025/9/1
人間の手のモーションキャプチャをソフトなガイドとして活用し、リターゲティングと追従を単一ループで統合最適化することで、器用なロボット操作の制御方策を大規模に学習する手法を提案。
- 人間の単一動画からの視覚的模倣によるスロット単位のロボット配置模倣学習2025/4/1
人間の作業動画を1本見せるだけで、どの物体をどこに置くかを理解し、ロボットが同じ配置作業を再現できるモジュール式システムSLeRPを提案した。
- 物理AIのためのCosmos世界基盤モデルプラットフォーム世界モデル2025/1/1
物理AI開発者向けに、カスタマイズ可能な世界モデルを構築するための基盤モデル・動画キュレーション・トークナイザを提供するオープンソースプラットフォーム。
- 股関節・膝関節制御を可能にする8ニューロン四足歩行ネットワーク歩行2024/6/1
対称性理論に基づき、スタイン神経モデルで構成された8ニューロン回路を設計し、5種類の歩容と股関節・膝関節の協調制御を実現した。
- FoundationPose: Unified 6D Pose Estimation and Tracking of Novel Objects2023/12/1
- SynH2R: Synthesizing Hand-Object Motions for Learning Human-to-Robot Handovers2023/11/1
- AnyTeleop: A General Vision-Based Dexterous Robot Arm-Hand Teleoperation System2023/7/1
- MIMONet: Multi-Input Multi-Output On-Device Deep Learning2023/7/1
- Learning Human-to-Robot Handovers from Point Clouds2023/3/1
- Learning Robust Real-World Dexterous Grasping Policies via Implicit Shape Augmentation2022/10/1
- Neural Motion Fields: Encoding Grasp Trajectories as Implicit Value Functions2022/6/1
- HandoverSim: A Simulation Framework and Benchmark for Human-to-Robot Object Handovers2022/5/1
- Model Predictive Control for Fluid Human-to-Robot Handovers2022/4/1
- Multi-Modal Fusion in Contact-Rich Precise Tasks via Hierarchical Policy Learning2022/2/1
- Learning Free Gait Transition for Quadruped Robots via Phase-Guided Controller2022/1/1
- Learning Perceptual Concepts by Bootstrapping from Human Queries2021/11/1
- RaP-Net: A Region-wise and Point-wise Weighting Network to Extract Robust Features for Indoor Localization2020/12/1
- Reactive Human-to-Robot Handovers of Arbitrary Objects2020/11/1
- Goal-Auxiliary Actor-Critic for 6D Robotic Grasping with Point Clouds2020/10/1
- DXSLAM: A Robust and Efficient Visual SLAM System with Deep Features2020/8/1
- Human Grasp Classification for Reactive Human-to-Robot Handovers2020/3/1
- Are We Ready for Service Robots? The OpenLORIS-Scene Datasets for Lifelong SLAM2019/11/1
- DexPilot: Vision Based Teleoperation of Dexterous Robotic Hand-Arm System2019/10/1
- Collaborative Behavior Models for Optimized Human-Robot Teamwork2019/10/1
- Visual Semantic Navigation using Scene Priors2018/10/1