Limin Wang
収録論文 8本 ・ フィジカルAI/ロボット学習
マニピュレーション動画フォレンジックVLA身体性表現学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 部分観測下のロボットマニピュレーションにおけるスキルレベル記憶のベンチマークと強化マニピュレーション2026/9/30
部分観測下での操作記憶を評価するベンチマークHIDEを提案し、履歴保持と実行状態追跡のための記憶機構SEEKを開発した。既存方策の限界を示し、記憶拡張がシミュレーションと実世界で成功率を向上させることを示した。
- 長尺動画における改ざんセグメントの説明可能なフォレンジック解析動画フォレンジック2026/6/1
未編集の長尺動画に埋め込まれたAI生成セグメントを検出・位置特定し、その理由を説明する新しいタスクとベンチマーク、ベースライン手法を提案した論文。
- CoMo: インターネット動画から連続潜在運動を学習するスケーラブルなロボット学習VLA2025/5/1
インターネット動画から連続的な潜在運動表現を教師なしで学習し、未知動画へのゼロショット汎化と擬似行動ラベル生成を可能にする手法CoMoを提案。
- Tra-MoE: 複数ドメインからの軌道予測モデル学習による適応的ポリシー条件付けVLA2024/11/1
スパースMoEアーキテクチャで任意点軌道を予測し、適応的ポリシー条件付けでロボット制御を改善する手法を提案。
- SPA: 3D空間認識による効果的な身体性表現学習身体性表現学習2024/10/1
多視点画像への微分可能レンダリングでViTに3D空間理解を持たせ、8シミュレータ268タスクで既存手法を上回る身体性表現学習フレームワークを提案。
- ロボット運動制御のための時空間予測事前学習VLA2024/3/1
大規模動画を用い、マスクされた現在フレームの空間予測と未来フレームを条件とした時間予測を二重デコーダで同時に行うことで、運動情報を捉えるロボット運動制御向け視覚事前学習フレームワークSTPを提案した。
- Transferring Foundation Models for Generalizable Robotic Manipulation2023/6/1
- AlphaBlock: Embodied Finetuning for Vision-Language Reasoning in Robot Manipulation2023/5/1