Shuang Wu
Artificial Intelligence Laboratory (Leibniz)
収録論文 7本 ・ フィジカルAI/ロボット学習
世界モデル/3Dシーン理解マニピュレーションVLA遠隔操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GaussianDWM++: 言語基盤の3Dガウス駆動世界モデルによる統一的なシーン理解・編集・マルチモーダル生成世界モデル/3Dシーン理解2026/8/17
3Dガウス表現に視覚言語特徴を蒸留し、シーン理解・言語推論・4D編集・マルチモーダル生成を単一フレームワークで統合した駆動世界モデルを提案した。
- SSC: 双腕操作ラベリングのための検証可能な構造化表現マニピュレーション2026/8/1
長期的な操作デモを意味的なサブタスクに分割するための新しい構造化表現「Structured Subtask Chain (SSC)」を提案。自然言語の柔軟性とテンプレートの厳格性を橋渡しし、状態遷移ルールによる自動検証と未指定フィールドの補完を可能にする。
- ロボットポリシー学習における視点汎化のための効率的なカメラポーズ拡張VLA2026/3/1
3Dガウススプラッティングを用いて、少数の非校正画像から高品質な3Dシーンを再構成し、多様な合成視点を生成することで、視覚運動ポリシーの未知視点への汎化性能を向上させる手法を提案した。
- CaFe-TeleVision: 没入型状況可視化による人間工学的遠隔操作システム遠隔操作2025/12/1
粗から細への制御機構と没入型状況可視化を組み合わせ、遠隔操作の効率と人間工学を改善するシステムを提案し、6つの両手操作タスクで有効性を検証した。
- SpatialCoT:座標アライメントと思考連鎖による身体性タスク計画の空間推論強化VLA2025/1/1
視覚言語モデルの空間推論能力を高めるため、座標の双方向アライメントと思考連鎖に基づく空間グラウンディングを組み合わせたSpatialCoTを提案し、ナビゲーションとマニピュレーションのタスクで従来手法を上回る性能を示した。
- Autonomy 2.0: The Quest for Economies of Scale2023/7/1
- Learning Bifunctional Push-grasping Synergistic Strategy for Goal-agnostic and Goal-oriented Tasks2022/12/1