Haolan Kang
収録論文 4本 ・ フィジカルAI/ロボット学習
基盤モデルデータ生成VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ACE-Brain-0: 空間知能を共通の足場とする普遍的身体性知能基盤モデル2026/3/1
多様な身体(自動運転、ロボット、ドローン)を統合する基盤モデルを提案し、空間知能を共通の足場として、専門化と融合を経て高い性能を達成した。
- IGen: オープンワールド画像からのロボット学習のためのスケーラブルなデータ生成データ生成2025/12/1
オープンワールド画像から3Dシーン表現とVLM推論を用いてロボットの視覚運動データを生成し、実世界データに匹敵する性能のポリシー学習を可能にするフレームワークを提案。
- ロボット視覚指示:手描きシンボルによるロボット操作の新パラダイムVLA2025/5/1
手描きの矢印や丸などの2Dシンボルでロボットに3D操作を指示するRoVIを提案し、VLMで解釈して行動に変換するVIEWを実現した。
- 欲しいものを掴む:音声で駆動する身体性を備えた巧みな把持システムマニピュレーション2024/12/1
音声指示と視覚情報を視覚言語モデルで統合し、雑然とした環境でも対象物体を正確に把持する身体性把持システム(EDGS)を提案。人間の手と物体の相互作用に着想を得た把持戦略で高い成功率を実現した。