Hanyi Zhang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA把持/ベンチマーク医療ロボティクス模倣学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- グリッパー認識型視覚言語行動モデルVLA2026/8/25
異なるグリッパー種別に応じた戦略を学習できるよう、5種類のグリッパーを含む大規模データセットと、専用トークナイザーとポリシールーティングを備えたモデルを提案した。
- 視覚的把持を超えて:検出から実行までの複雑な把持のベンチマーキング把持/ベンチマーク2026/7/1
複雑な実世界の把持タスクを評価するための新しいベンチマークGCA-Benchを提案し、従来の視覚ベースの把持検出を超えて、シーン推論と意味的制約を含むタスクでの大規模基盤モデルの性能を評価した。
- ロボット支援放射線誘導手術における放射性トレーサ局在化のためのハイブリッド深層強化学習医療ロボティクス2025/3/1
深層強化学習と適応的グリッドスキャンを組み合わせ、ロボット支援手術でプローブを放射性標的に自律的に誘導する手法を提案。シミュレーションで95%、実機(dVRK)で80%の成功率を達成した。
- X-IL: 模倣学習ポリシーの設計空間を探る模倣学習2025/2/1
模倣学習ポリシーの構成要素を自由に組み替えられるオープンソースフレームワークX-ILを提案し、設計空間を体系的に探索して既存手法を上回る新構成を発見した。
- 模倣学習のための点群と視覚表現の融合に向けて模倣学習2025/2/1
点群とRGB画像の両方を活用する模倣学習手法FPV-Netを提案し、点群エンコーダを画像トークンで条件付けすることでRoboCasaベンチマークで最先端性能を達成した。