Zhiyong Xiong
収録論文 3本 ・ フィジカルAI/ロボット学習
医療ロボティクス映像予測医療ロボティクス/VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EndoWAM: 汎用内視鏡ナビゲーションのための接地された世界行動モデル医療ロボティクス2026/8/1
内視鏡ナビゲーションのための世界行動モデルを初めて提案し、将来の目標領域予測と行動生成を統合することで、変形や視点変化に対するロバスト性を向上させた。
- CrossScope: 役割非対称な世界モデルによる二視野同時手術映像予測映像予測2026/8/1
内視鏡手術の二つの視点(母視点と子視点)の映像を、役割に応じて非対称に情報をやり取りしながら未来予測する世界モデルを提案した。
- BiliVLA: 強化学習を用いた自律的胆道内視鏡ナビゲーションのためのシーン認識型視覚言語行動モデル医療ロボティクス/VLA2026/6/1
胆道内視鏡ナビゲーションを指示条件付き視覚運動学習問題として定式化し、シーン認識型のVLAフレームワークを提案。対象カテゴリ、接地バウンディングボックス、3自由度モーターコマンドを予測し、2段階訓練で性能を向上させた。