Lap-Pui Chau
収録論文 8本 ・ フィジカルAI/ロボット学習
3D視覚的グラウンディングマニピュレーションVLA4D占有予測占有知覚
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SeqAlign3DVG: シーケンス整合ベンチマークとボクセル推論フレームワークによる3D視覚的グラウンディング3D視覚的グラウンディング2026/8/31
時間順序と観測整合性を備えた画像ベース3D視覚的グラウンディングの新しいベンチマークと、ボクセルメモリと段階的融合を用いた推論フレームワークを提案した。
- RoboFlow4D: リアルタイムフロー誘導ロボット操作のための軽量フローワールドモデルマニピュレーション2026/5/1
視覚観察とテキスト指示から3Dフローを直接予測し、動作生成を誘導する軽量なエンドツーエンドのフローワールドモデルを提案し、シミュレーションと実世界で操作成功率と計算効率を向上させた。
- EARL: 一人称視点インタラクション推論とピクセル接地のための解析誘導型強化学習フレームワークVLA2026/5/1
一人称視点映像から人間と環境のインタラクションを理解し、テキスト回答とピクセル単位のマスクを生成する強化学習フレームワークを提案した。
- OccProphet: カメラのみの4D占有予測の効率限界を押し広げるObserver-Forecaster-Refinerフレームワーク4D占有予測2025/2/1
カメラ画像のみから将来の3D占有状態を予測する4D占有予測において、Observer・Forecaster・Refinerの3軽量コンポーネントで計算コストを大幅に削減しつつ精度を向上させたフレームワークを提案。
- 物体中心ロボットマニピュレーションのための身体性学習に関するサーベイマニピュレーション2024/8/1
物体中心のロボットマニピュレーションにおける身体性学習の最新研究を、知覚学習・方策学習・タスク指向学習の3つに分類して整理し、データセットや評価指標、課題と今後の方向性をまとめたサーベイ論文。
- 自動運転における占有知覚のサーベイ:情報融合の観点から占有知覚2024/5/1
自動運転向けの3D占有知覚について、入力モダリティごとの手法や情報融合技術、学習法、データセット上の性能を体系的に整理したサーベイ。
- PEM: Perception Error Model for Virtual Testing of Autonomous Vehicles2023/2/1
- CoPEM: Cooperative Perception Error Models for Autonomous Driving2022/11/1