Zhengshen Zhang
National University of Singapore
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA/操作VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 手首から世界へ:微細ロボット操作のためのタスク条件付き未来手首モデリングVLA/操作2026/8/1
VLAモデルにおいて、主視点と手首視点を並列に扱うのではなく、タスク文脈に基づいて手首の未来の動きを予測する新しいモデルW2-VLAを提案。これにより、微細で接触を伴う操作の精度が向上し、80Hz以上の高速な行動生成を維持する。
- SG-WAM: 幾何認識ポリシー空間における自己誘導型ワールドモデリングVLA2026/8/1
ポリシー由来の表現空間で幾何認識の行動条件付きダイナミクスを学習し、将来状態予測と行動生成を統合する自己誘導型フレームワークを提案。
- World Guidance: 行動生成のための条件空間における世界モデリングVLA2026/2/1
未来の観測をコンパクトな条件に圧縮して行動推論に注入し、VLAモデルが未来の行動と条件を同時に予測することで、精密な行動生成と高い汎化性能を実現するフレームワークを提案した。
- ロボットマニピュレーションのための3Dアフォーダンスキーポイント検出マニピュレーション2025/11/1
RGB-D画像から物体のアフォーダンスを3Dキーポイントで検出し、把持位置・方向・範囲を推定してロボット操作を実現する手法を提案。
- 空間から行動へ:空間基盤事前分布に基づく視覚-言語-行動モデルVLA2025/10/1
RGB画像から空間基盤モデルで3D幾何事前分布を抽出し、行動ヘッドに注入することで、追加センサーなしにVLAモデルの空間推論能力を高めるFALCONを提案。
- DexGrasp-Diffusion:多様な多指ロボットハンドのための拡散モデルによる統合的な機能把持生成手法マニピュレーション2024/7/1
拡散モデルを用いて、様々な多指ロボットハンドに対応した機能的な把持を生成する統合手法を提案し、物体のアフォーダンス指示に沿った把持を実現した。
- 一度のスキャンで実現する動的シーン再構成パイプライン:未知物体の6自由度ロボット把持マニピュレーション2024/4/1
シーンを一度スキャンして物体メッシュと姿勢追跡を登録し、操作中もリアルタイムで姿勢追跡して再構成点群を更新することで、遮蔽に強く高精度な6自由度把持を可能にする二段階パイプラインを提案した。