Yiyi Liao
収録論文 16本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 123D: 大規模マルチモーダル自動運転データの統合自動運転データ統合2026/5/1
自動運転の多様なデータセットを単一APIで統合するオープンソースフレームワークを提案し、8つの実データセットと合成データを統合して、クロスデータセットでの3D物体検出や強化学習などの応用を実証した。
- InstructVLA: 理解から操作へと導く視覚-言語-行動インストラクションチューニングVLA2025/7/1
大規模視覚言語モデルの推論能力を保ちつつ、身体性推論を活用して操作性能を高める新しいVLAモデルと学習法を提案し、汎化ベンチマークで大幅な改善を示した。
- UnIRe: 動的都市シーンの教師なしインスタンス分解シーン再構成2025/4/1
RGB画像とLiDAR点雲のみから、4Dスーパーポイントを用いて動的都市シーンを静的背景と個々の動的インスタンスに教師なしで分解し、3Dガウシアンスプラッティングで再構成する手法を提案。
- クロスアテンションを活用したエンドツーエンドのオープンボキャブラリ・パノプティック再構成3D再構成2025/1/1
3Dインスタンスをクエリ、3D埋め込み場をキーとするクロスアテンションでパノプティック再構成を定式化し、学習可能な3Dガウシアンをインスタンスクエリとして用いることで空間的近接性を保ちつつエンドツーエンド最適化を実現した手法を提案。
- HUGSIM:自動運転のためのリアルタイム・フォトリアル・閉ループシミュレータ自動運転シミュレーション2024/12/1
3Dガウシアンスプラッティングで2D画像を3D空間に持ち上げ、自動運転アルゴリズムを評価するためのリアルタイムでフォトリアルな閉ループシミュレータを構築した。
- E-3DGS: 露光イベントと動きイベントを活用したガウシアンスプラッティング3D再構成/イベントカメラ2024/10/1
露光調整デバイスを組み込み、イベントカメラで露光イベントと動きイベントを取得し、3Dガウシアンスプラッティングによる高品質・高速・バランス型の3D再構成を実現した研究。
- PanopticRecon: オープン語彙インスタンスセグメンテーションを活用したゼロショットパノプティック再構成3Dシーン理解2024/7/1
RGB-D画像から、オープン語彙インスタンスセグメンテーションを利用して未知環境でも3Dパノプティック再構成をゼロショットで行う手法を提案。部分ラベルの伝播と3DインスタンスグラフによるID統合で課題を解決した。
- ν-DBA: ニューラル陰的密バンドル調整による画像のみの走行シーン再構成SLAM/3D再構成2024/4/1
3Dニューラル陰的表面で地図を表現し、密オプティカルフローに導かれた幾何誤差で軌跡と地図を同時最適化する密バンドル調整フレームワークを提案し、走行シーンの軌跡推定と密再構成精度を向上させた。
- NGEL-SLAM: Neural Implicit Representation-based Global Consistent Low-Latency SLAM System2023/11/1
- NF-Atlas: Multi-Volume Neural Feature Fields for Large Scale LiDAR Mapping2023/4/1
- RING++: Roto-translation Invariant Gram for Global Localization on a Sparse Scan Map2022/10/1
- DPCN++: Differentiable Phase Correlation Network for Versatile Pose Registration2022/6/1
- A Visual Navigation Perspective for Category-Level Object Pose Estimation2022/3/1
- Learning Interpretable BEV Based VIO without Deep Neural Networks2021/9/1
- Parse Geometry from a Line: Monocular Depth Estimation with Partial Laser Observation2016/11/1
- Place classification with a graph regularized deep neural network model2015/6/1