Jilei Mao
収録論文 5本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA協調知覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VO-DP: 視覚のみのロボットマニピュレーションのための意味・幾何適応拡散ポリシーマニピュレーション2025/10/1
視覚基盤モデルを活用し、意味特徴と幾何特徴を融合する視覚のみの拡散ポリシーを提案。点群ベース手法に匹敵または凌駕する成功率を実世界タスクで達成。
- OmniD: 画像ベースBEV表現による汎化可能なロボットマニピュレーションポリシーマニピュレーション2025/8/1
複数視点の画像を鳥瞰図(BEV)表現に統合し、変形可能注意でタスク関連特徴を抽出することで、未知環境や少データでも汎化しやすいロボット操作ポリシーを実現した。
- EmbodiedVSR: 動的シーングラフ誘導による視覚空間タスクの連鎖推論VLA2025/3/1
動的シーングラフとChain-of-Thought推論を組み合わせ、微調整なしで身体性エージェントの空間推論を強化するフレームワークを提案し、新ベンチマークで有効性を示した。
- RoboMIND:ロボットマニピュレーションのためのマルチエンボディメント知能規範データセットマニピュレーション2024/12/1
4種類のロボットによる10.7万件の模倣学習用デモンストレーション軌道と失敗例、デジタルツイン環境を提供する大規模データセットを構築し、VLAモデルの性能を評価した。
- LiDARを用いた車車間・路車間協調のためのエンドツーエンド時系列知覚協調知覚2024/11/1
車両とインフラのLiDARデータを時系列アテンションで統合し、キャリブレーション誤差補正モジュールを導入することで、協調型の物体検出・追跡精度を大幅に向上させた研究。