Zhuo Yang
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAVLA/操作マニピュレーションシーングラフ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GE-Act 2.0: ロボット操作のためのワールドアクションモデルの事前学習とスケーリングVLA2026/9/4
操作データのみで生成・行動コンポーネントをゼロから学習するワールドアクションモデルを提案し、大規模データでの事前学習とスケーリングの効果を検証した。
- SpatialCLI: 空間ツールで推論し、その後ツールなしで推論する学習VLA2026/7/30
視覚言語モデルに空間ツールを使った推論を教え、徐々にその能力を内部化させる3段階フレームワークを提案。ベンチマークで大幅な性能向上を実証した。
- Dexora: 高自由度両腕巧緻操作のためのオープンソースVLAVLA/操作2026/5/1
両腕・両手の高自由度操作を対象とした初のオープンソースVLAシステムDexoraを提案し、ハイブリッド遠隔操作とデータ品質を考慮した学習手法により、巧緻操作の成功率を大幅に向上させた。
- ロボットポリシー学習における視点汎化のための効率的なカメラポーズ拡張VLA2026/3/1
3Dガウススプラッティングを用いて、少数の非校正画像から高品質な3Dシーンを再構成し、多様な合成視点を生成することで、視覚運動ポリシーの未知視点への汎化性能を向上させる手法を提案した。
- トルク対応VLAモデルの設計空間の解明VLA2025/9/1
トルク信号をVLAモデルに統合する設計空間を体系的に検討し、デコーダへのトルクアダプタ導入と補助出力としてのトルク予測が有効であることを示した。
- 不整地における階層型強化学習による四足ロボットの動的ボール操作マニピュレーション2025/4/1
四足ロボットが不整地でボールをドリブルするため、高レベル方策が事前学習済みの低レベルスキルを切り替える階層型強化学習フレームワークを提案し、実機実験で有効性を示した。
- DynamicGSG: 環境適応のための動的3Dガウシアンシーングラフシーングラフ2025/2/1
ガウシアンスプラッティングを用いて動的で高忠実度なオープンボキャブラリのシーングラフを構築し、環境変化に応じて局所的に更新することでロボットの長期的な環境適応を可能にするシステムを提案。