Hongan Wang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BFA++: マルチビュー視覚言語行動モデルのための階層的ベスト特徴認識トークンプルーニングVLA2026/2/1
VLAモデル向けに、視点内・視点間の2段階重要度予測で動的にトークンを削減し、マルチビュー入力の計算効率と操作成功率を両立させるフレームワークを提案した。
- Multi-GraspLLM:多様なロボットハンドのための意味誘導型把持生成マルチモーダルLLMマニピュレーション2024/12/1
自然言語指示に基づき、複数のロボットハンドに対応した把持姿勢を生成する統合フレームワークを提案し、接触注釈付き大規模データセットMulti-GraspSetを構築した。
- SegGrasp: セマンティック・幾何学誘導セグメンテーションによるゼロショットタスク指向把持マニピュレーション2024/10/1
視覚言語モデルと凸分解による幾何情報を組み合わせ、学習なしで対象物の機能部位を狙うゼロショット把持を実現したフレームワーク。