Junwen Huang
収録論文 5本 ・ フィジカルAI/ロボット学習
セグメンテーション物体姿勢推定VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SOS!:モデルフリーセグメンテーションのための合理化されたオブジェクト条件付きトランスフォーマーセグメンテーション2026/8/15
3Dモデルを必要とせず、参照画像1枚だけで未知物体を正確にセグメンテーションする新しい手法を提案。オブジェクト条件付きトランスフォーマーにより、マスク生成と対象特定を単一のフィードフォワードで統合し、効率と精度を両立した。
- 任意参照からのモデルフリー物体姿勢推定:PANY物体姿勢推定2026/6/22
CADモデルや追加学習なしで、任意の参照画像から未知物体の6D姿勢を推定する統一フレームワークPANYを提案。RGBとRGB-Dの両対応で、単一または疎な参照ビューから頑健に姿勢を推定する。
- DM0: フィジカルAIに向けた身体性ネイティブな視覚-言語-行動モデルVLA2026/2/1
身体性を後付けでなく最初から統合し、大規模事前学習からフローマッチング行動専門家と空間Chain-of-Thoughtで操作とナビゲーションを統一的に学習するVLAフレームワークDM0を提案。
- Dexbotic: オープンソース視覚-言語-行動ツールボックスVLA2025/10/1
複数のVLAモデルを単一環境で再現・開発できるPyTorchベースのオープンソースツールボックスを提供し、高性能な事前学習済みモデルも公開した。
- RoboChallenge:実機ロボットによる具現化ポリシーの大規模評価VLA2025/10/1
多数のモデルとタスクを実機で評価するオンラインシステムRoboChallengeを構築し、初期ベンチマークTable30で最新VLAモデルを調査した。