Huashuo Lei
収録論文 5本 ・ フィジカルAI/ロボット学習
sim2realベンチマーク/VLA/記憶ナビゲーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- EmbodiedSmith:シミュレーションにおける再帰的自己改善フライホイールによる身体性データのスケーリングsim2real2026/10/6
シミュレーション内でアセット・シーン・タスク生成を統合し、シーンとタスクが相互に洗練し合う再帰的自己改善ループにより、多様な身体性データを自動生成するフレームワークを提案。
- RoboMemArena:ロボット記憶のための包括的で挑戦的なベンチマークベンチマーク/VLA/記憶2026/5/1
ロボットの長期タスクにおける記憶能力を評価するため、26タスク・平均1000ステップ超の大規模ベンチマークRoboMemArenaを構築し、VLMによるサブタスク生成と実世界評価を備えた。さらに、記憶管理と予測符号化を統合したVLAモデルPrediMemを提案し、既存手法を上回る性能を示した。
- HCSG: 視覚言語ナビゲーションのための人間中心の意味・幾何推論ナビゲーション2026/5/1
動的な人間環境での視覚言語ナビゲーションにおいて、人間の行動意図を理解するための人間中心フレームワークを提案し、幾何予測と意味解釈を統合して社会的に適切なナビゲーションを実現する。
- Vision-language-actionモデルの実用性を再考する:包括的ベンチマークと改良ベースラインVLA2026/2/1
VLAモデルの実用性を評価する新ベンチマークCEBenchを提案し、その知見に基づき軽量で実用的なLLaVA-VLAを開発した。
- 静的・動的分離による効率的な長期間視覚言語行動モデルVLA2026/2/1
視覚入力を静的・動的トークンに分離し、静的トークンの共有とKVキャッシュ再利用で、長期間のマルチフレーム統合と推論を効率化するVLAフレームワークDyStaを提案。