Jie He
収録論文 7本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション自動運転レース
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ATI-VLA: 行動中心の予測型視覚-言語-行動モデルVLA2026/10/1
予測観測と行動の表現を共有コードブックで揃え、予測潜在を行動生成に適応的に注入することで、操作タスクの性能と収束速度を向上させたVLAモデル。
- SkillFM: 潜在フローマッチングによるLLMエージェント向けスキル生成VLA2026/9/30
テキストスキルを連続潜在空間で符号化し、条件付きフローモデルでタスクに応じたスキルを直接生成する手法を提案。ALFWorldやSearch-QAなどで検索ベース手法を上回る性能を示した。
- UniMPA:行動接地型遷移モデリングによる統合記憶・予測・行動モデルVLA2026/9/10
視覚言語行動モデルの遷移実現性ギャップを、記憶・予測・行動を統合した行動接地型インターフェースで解決する手法を提案。
- H-GAR: 目標駆動型の観測・行動洗練による階層的インタラクションフレームワークマニピュレーション2025/11/1
目標観測と粗い行動スケッチを起点に、観測と行動を相互に洗練させる階層的フレームワークを提案し、ロボットマニピュレーションの精度を向上させた。
- CogVLA: 指示駆動型ルーティングとスパース化による認知整合型視覚-言語-行動モデルVLA2025/8/1
人間のマルチモーダル協調に着想を得て、指示に応じて視覚トークンを選択・圧縮し、行動意図に基づき不要トークンを刈り込む3段階のVLAアーキテクチャを提案。学習コストと推論遅延を大幅に削減しつつ、LIBEROベンチマークで97.4%の成功率を達成した。
- MCTR: デジタルツインシミュレーションを用いた自動運転レースのための中点補正三角測量自動運転レース2025/8/1
LiDARデータから直接制御する自動運転レース向けに、軌道の滑らかさを改善するMCTRアルゴリズムを提案し、CARLAでのデジタルツイン検証と実車実験で有効性を示した。
- OccupancyDETR: Using DETR for Mixed Dense-sparse 3D Occupancy Prediction2023/9/1