Thieu Vo
収録論文 9本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- GraspMAS: マルチエージェントシステムによるゼロショット言語駆動型把持検出マニピュレーション2025/6/1
複雑な言語指示や混雑環境に対応するため、Planner・Coder・Observerの3エージェントで把持を計画・実行・評価するゼロショット言語駆動型把持検出フレームワークを提案。
- Robotic-CLIP: ロボット応用のための行動データによるCLIPの微調整VLA2024/9/1
大規模な行動動画データでCLIPを対照学習により微調整し、動的な行動理解を可能にしたRobotic-CLIPを提案。言語駆動型ロボットタスクで既存CLIPモデルを上回り、実世界の把持タスクでも有効性を示した。
- 条件付き一貫性モデルによる軽量な言語駆動型把持検出マニピュレーション2024/7/1
拡散モデルを軽量化した一貫性モデルと言語プロンプトを組み合わせ、高速推論を実現する言語駆動型把持検出法を提案し、実機実験で有効性を示した。
- マスク誘導アテンションによる言語駆動型把持検出マニピュレーション2024/7/1
セグメンテーションマスクと言語指示をTransformerのアテンションで統合し、遮蔽に強い言語駆動型の把持検出を実現した研究。
- ネガティブプロンプト誘導を用いた言語駆動型6自由度把持検出マニピュレーション2024/7/1
自然言語の指示に基づき、散らかった点群の中から目的の物体を6自由度で把持する手法を提案。大規模データセットGrasp-Anything-6Dと、不要物体を避けるネガティブプロンプト誘導拡散モデルを導入した。
- Open-Vocabulary Affordance Detection using Knowledge Distillation and Text-Point Correlation2023/9/1
- Language-Conditioned Affordance-Pose Detection in 3D Point Clouds2023/9/1
- Grasp-Anything: Large-scale Grasp Dataset from Foundation Models2023/9/1
- Open-Vocabulary Affordance Detection in 3D Point Clouds2023/3/1