Xueyang Guo
収録論文 2本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視線プロンプト:Vision-Language-Actionファインチューニングのための時間的に密な人間の注意VLA2026/9/28
VRテレオペレーション中の視線をフレーム単位の視覚プロンプトとしてVLAモデルに与え、展開時は軽量予測器で視線を推定することで、実世界の両手マニピュレーション成功率を26.3%から56.0%に向上させた。
- UniDiffGrasp:VLM推論とパーツ拡散を統合した双腕オープンボキャブラリ制約把持フレームワークマニピュレーション2025/5/1
VLMで対象物の機能パーツを特定し、その幾何制約を拡散モデルに与えて6自由度把持を生成、双腕協調把持も行う統合フレームワークを提案。実機で単腕0.876、双腕0.767の成功率を達成。