Xin Kong
収録論文 10本 ・ フィジカルAI/ロボット学習
ニューラルレンダリングVLA3D表現
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MLPスプラッティング:オブジェクト中心のニューラルフィールドニューラルレンダリング2026/6/2
少数の表現力豊かな光場プリミティブを用いてシーンを分解し、フォトリアリスティックな新規視点合成を実現する手法を提案。各プリミティブは局所的なMLPで表現され、RGBのみの教師信号で学習され、オブジェクト単位の編集が可能。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- STARE-VLA:視覚言語行動モデルの微調整のための段階的ステージ認識強化学習VLA2025/12/1
長期的な行動軌跡を意味のある段階に分解し、段階ごとに密な強化学習信号を与えることで、VLAモデルの微調整を安定化・高精度化する手法を提案。
- ロボティクスにおける3Dガウシアンスプラッティング:サーベイ3D表現2024/10/1
ロボティクス分野での3Dガウシアンスプラッティング(3DGS)の応用と技術進歩を包括的に調査し、課題と将来展望をまとめたサーベイ論文。
- DA$^2$ Dataset: Toward Dexterity-Aware Dual-Arm Grasping2022/8/1
- SSC: Semantic Scan Context for Large-Scale Place Recognition2021/7/1
- SA-LOAM: Semantic-aided LiDAR SLAM with Loop Closure2021/6/1
- FlowMOT: 3D Multi-Object Tracking by Scene Flow Association2020/12/1
- Semantic Graph Based Place Recognition for 3D Point Clouds2020/8/1
- PASS3D: Precise and Accelerated Semantic Segmentation for 3D Point Cloud2019/9/1