Tuan Van Vo
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ReFineVLA: 教師ガイドによるファインチューニングを用いたマルチモーダル推論対応の汎用ロボットポリシーVLA2026/4/1
VLAモデルに推論能力を組み込むため、専門家教師モデルが生成した推論根拠をデータセットに追加し、事前学習済みVLAをファインチューニングする手法を提案。シミュレーション操作ベンチマークで評価し、視覚・言語・行動の整合性と汎化性能の向上を示した。
- ReFineVLA:推論を考慮した教師ガイド付き転移ファインチューニングVLA2025/5/1
専門家モデルが生成した推論根拠でデータセットを拡張し、VLAモデルに行動の理由を考えさせるファインチューニング手法を提案。複雑な操作タスクでの汎化性能と解釈性を向上させた。
- マスク誘導アテンションによる言語駆動型把持検出マニピュレーション2024/7/1
セグメンテーションマスクと言語指示をTransformerのアテンションで統合し、遮蔽に強い言語駆動型の把持検出を実現した研究。
- Open-Vocabulary Affordance Detection using Knowledge Distillation and Text-Point Correlation2023/9/1
- Language-Conditioned Affordance-Pose Detection in 3D Point Clouds2023/9/1