Ziyang Zhou
HKUST(GZ)
収録論文 10本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniWAM:統合された世界行動モデルVLA2026/10/1
物理推論・映像生成・行動予測を統合したモデルで、人間の一人称視点データとロボットデータを活用し、複数の評価でSOTAを達成した。
- 4D-WAM: 軌跡フィールドによる世界行動モデルへの時空間認識の注入VLA2026/8/1
ロボットの行動生成と動画予測を統合する世界行動モデルに対し、3D軌跡フィールドからの時空間知識を表現整合で注入する訓練戦略を提案し、空間理解と実行精度を向上させた。
- CapVector: パラメトリック空間における転移可能な能力ベクトルの学習による視覚言語行動モデルの強化VLA2026/5/1
事前学習済みVLAモデルの標準的な教師あり微調整では性能向上が限定的である問題に対し、補助目的の効果をパラメータ差分として抽出し、軽量な正則化で統合する能力ベクトル手法を提案した。
- 決定論的折り紙テンタクルの確率的絡み合いによるロバストなロボット把持把持2026/4/1
腱駆動の折り紙テンタクルグリッパーを提案し、局所的な決定論的変形と大域的な確率的絡み合いを組み合わせることで、単純な設計と駆動でランダム形状の物体をロバストに把持できることを示した。
- 統合拡散VLA:離散デノイジング拡散プロセスによる視覚・言語・行動モデルVLA2025/11/1
視覚・言語・行動を単一の離散デノイジング拡散過程で統合し、画像生成と行動予測を同時に最適化するVLAモデルを提案。CALVINやLIBEROなどで最高性能を達成。
- ソフトロボットに物理コンピューティングを具現化するソフトロボティクス2025/10/1
ソフトロボットに物理コンピューティングを組み込み、アナログ発振器・物理リザバー計算・物理アルゴリズム計算の3手法を概説し、将来展望を示した展望論文。
- ReconVLA:再構成型視覚-言語-行動モデルによる効果的なロボット知覚VLA2025/8/1
視覚的注意を対象領域に正しく向けるため、注視領域を再構成する拡散トランスフォーマを組み込んだVLAモデルを提案し、精密操作と汎化性能を実証した。
- ハイパー吉村折り紙:古典的折りパターンの小さな改良が展開型ロボットにメタ安定性をもたらす展開構造2025/5/1
吉村折り紙の設計ルールを破ることで、自己収納やポップアウトなどのメタ安定状態を持つ新しい折り紙構造を開発し、展開型ブームや宇宙クレーンへの応用を示した。
- 黄金比ヨシムラ折りによる準安定かつ大規模再構成可能な展開構造展開構造2024/5/1
黄金比の角度を導入した新しいヨシムラ折りパターンを提案し、モジュール数mで8^m通りの形状に再構成できる展開構造を実現した。
- Self-Sustained And Coordinated Rhythmic Deformations With SMA For Controller-Free Locomotion2023/10/1