Shiguang Wu
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- OmniEVA: タスク適応型3Dグラウンディングと身体性考慮推論による汎用エンボディドプランナーVLA2025/9/1
タスクに応じて3D情報の融合を切り替えるゲート付き機構と、ロボットの身体制約を推論に組み込む枠組みにより、実機で実行可能な計画を立てるエンボディドAIプランナーを提案。
- SpatialCoT:座標アライメントと思考連鎖による身体性タスク計画の空間推論強化VLA2025/1/1
視覚言語モデルの空間推論能力を高めるため、座標の双方向アライメントと思考連鎖に基づく空間グラウンディングを組み合わせたSpatialCoTを提案し、ナビゲーションとマニピュレーションのタスクで従来手法を上回る性能を示した。
- Astra: 身体性指示追従のための効率的Transformerアーキテクチャと対照的ダイナミクス学習VLA2024/8/1
異なるモダリティのセグメントからなる軌跡を効率的に処理する新しいTransformerと、環境ダイナミクス理解を深める対照的学習目的を提案し、ロボット操作ベンチマークで性能を大幅に向上させた。
- 粗から細へのアフォーダンス学習による点群ノイズに頑健な関節物体操作マニピュレーション2024/2/1
実世界の点群ノイズに対処するため、遠距離の粗い点群で操作箇所を推定し、近距離の精細な点群で最終動作を決定する2段階のアフォーダンス学習手法を提案した。
- Tree-Planner: Efficient Close-loop Task Planning with Large Language Models2023/10/1