Shuai Liang
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Imagine-RL:予測残差信頼度で導くクロスアテンションによる世界モデル拡張VLA強化学習VLA2026/9/21
凍結したVLA方針をノイズ空間強化学習で微調整する際、視覚・力覚の潜在世界モデルで将来の結果を予測し、その予測残差を信頼度として活用することで接触の多い操作タスクの成功率を大幅に向上させた。
- OpenFly: 空中視覚言語ナビゲーションのための包括的プラットフォームVLA2025/2/1
空中視覚言語ナビゲーションのための多様なレンダリングエンジンと自動データ収集ツールチェーンを統合したプラットフォームを提案し、10万軌道の大規模ベンチマークとキーフレーム重視のナビゲーションモデルを構築した。
- DaDu-E:ロボット計算パイプラインにおける大規模言語モデルの役割を再考するVLA2024/12/1
軽量LLMとスキル命令・フィードバック・記憶拡張を組み合わせた閉ループ計画フレームワークDaDu-Eを提案し、大規模モデル並みの成功率を6.6倍少ない計算量で実現した。
- KARMA:長期・短期記憶システムで身体性AIエージェントを強化VLA2024/9/1
長期記憶に3Dシーングラフ、短期記憶に物体の位置・状態変化を記録する二重記憶構造をLLMに組み込み、家庭内の長系列タスク計画の成功率と効率を大幅に改善した。
- FastUMI: スケーラブルでハードウェア非依存の汎用マニピュレーションインターフェースとデータセットマニピュレーション2024/9/1
ロボットアームの実世界データ収集を低コスト・ハードウェア非依存で実現するため、UMIを再設計したFastUMIを提案し、22タスク・1万軌跡超のデータセットを公開した。