Shan Yu
Chinese Academy of Sciences
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション医療ロボティクス
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HiWE: 視覚キーポイント強化による階層的ワールド知識モデルを用いたゼロショット3D経路計画VLA2026/9/30
視覚的グラウンディングと言語ベースの計画を点ベースのインターフェースで結び、ゼロショットで3D操作経路を計画する階層的フレームワークを提案。
- 細粒度物体操作に向けて:SAM3誘導視覚運動ポリシーと持続的メモリ学習および集中視覚条件付けマニピュレーション2026/9/18
SAM3を凍結したまま少数の多視点画像から対象物体のメモリトークンを学習し、バウンディングボックス座標と外観特徴を組み合わせて拡散ポリシーやACTを条件付けすることで、類似物体や妨害物がある実環境での細粒度物体操作を実現した。
- MicroHookACT: 単眼顕微鏡視覚による柔軟マイクロ電極フッキングのための視覚運動ポリシーマニピュレーション2026/9/18
単眼顕微鏡下での柔軟マイクロ電極の自動フッキングを実現する模倣学習ベースの視覚運動ポリシーを提案し、人間の実演60回から学習して96.7%の成功率を達成した。
- GeneralVLA:知識誘導型軌道計画による汎化可能な視覚-言語-行動モデルVLA2026/2/1
基盤モデルの汎化能力を活かし、アフォーダンス認識・3D軌道計画・制御を階層化したVLAモデルを提案。実機データや人間の実演なしでゼロショットのマニピュレーションを実現する。
- 柔軟マイクロ電極アレイの信頼性高いロボット移植のための視覚的異常検出医療ロボティクス2025/10/1
ロボットによる柔軟マイクロ電極の脳移植において、顕微鏡カメラ画像から異常を検出するフレームワークを開発し、4つのチェックポイントで信頼性と安全性を向上させた。