Wenbin Tang
収録論文 6本 ・ フィジカルAI/ロボット学習
ナビゲーションエージェントOS四足歩行VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ABot-N1: 汎用視覚言語ナビゲーション基盤モデルへの一歩ナビゲーション2026/7/1
視覚と言語を統合したナビゲーション基盤モデルABot-N1を提案。認知と制御を分離し、ピクセル目標と明示的な推論で汎用性・堅牢性・解釈性を両立する。
- ABot-AgentOS: 生涯マルチモーダルメモリを備えた汎用ロボットエージェントOSエージェントOS2026/7/1
低レベル制御の上に推論・記憶・ツール使用・検証・クロス実体実行を提供する汎用ロボットエージェントOSを提案し、実行可能なベンチマークと永続的なマルチモーダルグラフメモリを導入した。
- 四足ロボットのための行動基盤:ABot-C0 テクニカルレポート四足歩行2026/7/1
四足ロボット向けの汎用動作制御システムABot-C0を提案し、大規模データパイプラインとフローマッチングポリシーにより、動作追跡のスケーリング則を初めて実証した。
- DM0: フィジカルAIに向けた身体性ネイティブな視覚-言語-行動モデルVLA2026/2/1
身体性を後付けでなく最初から統合し、大規模事前学習からフローマッチング行動専門家と空間Chain-of-Thoughtで操作とナビゲーションを統一的に学習するVLAフレームワークDM0を提案。
- Dexbotic: オープンソース視覚-言語-行動ツールボックスVLA2025/10/1
複数のVLAモデルを単一環境で再現・開発できるPyTorchベースのオープンソースツールボックスを提供し、高性能な事前学習済みモデルも公開した。
- RoboChallenge:実機ロボットによる具現化ポリシーの大規模評価VLA2025/10/1
多数のモデルとタスクを実機で評価するオンラインシステムRoboChallengeを構築し、初期ベンチマークTable30で最新VLAモデルを調査した。