Qingyu Fan
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション把持/表面再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PEAfowl: 知覚強化型マルチビュー視覚-言語-行動モデルによる両腕マニピュレーションVLA2026/1/1
両腕ロボット操作のためのVLAモデル。トークンごとの深度分布予測と微分可能な3Dリフティングで視点間の幾何学的整合性を高め、Perceiver型のテキスト認識読み出しで指示の接地を改善。訓練時のみの深度蒸留でノイズの多い深度を補い、RoboTwin 2.0で成功率を23ポイント向上させた。
- MISCGrasp:マルチスケール統合と対照学習による3次元把持の強化マニピュレーション2025/7/1
複数スケールの特徴抽出と対照学習を組み合わせ、形状や大きさが異なる物体に適応する3次元把持手法を提案した。
- NeuGrasp: 背景事前分布を活用した素材非依存の物体把持検出のための汎化可能なニューラル表面再構成把持/表面再構成2025/3/1
透明・鏡面物体でも把持できるよう、背景事前分布とTransformerを組み合わせて多視点から物体表面を再構成する手法を提案し、実機・シミュレーションで従来法を上回る把持性能を示した。