Ruifeng Li
収録論文 6本 ・ フィジカルAI/ロボット学習
マルチモーダル融合VLA/操作3D再構成VLA/データ生成VLASLAM/センサ融合
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MatchFusion: 時空間マルチモーダル自動運転のための明示的・暗黙的インスタンスマッチングマルチモーダル融合2026/9/22
LiDARとカメラの空間的融合および過去と現在の時間的融合において、幾何学的類似度とカテゴリ一致で初期対応を推定し、インスタンス埋め込みで曖昧な対応を精緻化する学習可能なマッチング・融合モジュールを提案。nuScenesで知覚精度の向上を実証。
- 凍結VLAポリシーのための達成基盤メモリによる閉ループエージェントVLA/操作2026/8/30
凍結された視覚-言語-行動(VLA)ポリシーに、物理的証拠で検証されたサブゴール進行ポインタを持つ軽量メモリを追加し、開ループ実行を閉ループ化するフレームワークを提案。
- OccamView: フレーム予算制約下のアクティブ3Dガウス再構成のためのオブジェクト条件付き視点選択3D再構成2026/8/17
限られたフレーム予算で3Dガウス再構成を行う際、物体の隠れ領域を考慮した視点選択手法を提案し、再構成の完全性を向上させた。
- Seed2Scale: 小規模・大規模モデルの協調とマルチモーダル評価による身体化AIの自己進化型データエンジンVLA/データ生成2026/3/1
少数のシードデモから始め、小型モデルでデータ収集し大型モデルで評価する自己進化型データエンジンを提案し、データ不足とモデル崩壊を克服して成功率を大幅に向上させた。
- RealMirror: 身体性AIのための包括的オープンソース視覚-言語-行動プラットフォームVLA2025/9/1
ヒューマノイドロボット向けのVLA研究を、実機なしでデータ収集・学習・推論まで行えるオープンソース基盤として構築し、ベンチマークとゼロショットSim2Real転移も実現した。
- 選択的カルマンフィルタ:SLAMの退化を克服するためのマルチセンサ情報融合の時期と方法SLAM/センサ融合2024/12/1
LiDAR SLAMの退化を検出し、退化時のみ視覚情報を選択的に融合することで、計算コストを抑えつつロバスト性と精度を向上させる手法を提案。