Jin Xie
Nanjing University
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BridgeMatch: マッチング行列空間における条件付きトランスポートブリッジによる3次元変形レジストレーション3Dレジストレーション2026/9/10
粗い解像度で拡散モデルにより大域的なマッチング行列を推定し、それを高解像度に持ち上げた後、条件付きトランスポートブリッジ(Flow Matching ODEまたはSchrödingerブリッジSDE)で洗練することで、非剛体点群対応を高精度化する手法を提案。
- 頑健な6自由度把握姿勢推定のためのクロスビュー融合フレームワークマニピュレーション2026/6/1
本論文では、コーナービューでの6自由度把握姿勢推定の頑健性を高めるため、補助ビューを統合し、自己教師あり対比学習と円筒座標系での融合モジュールを用いたクロスビュー融合フレームワークを提案する。
- QuadVerse: 四足歩行シミュレーションのための視覚と物理の現実を統合するフレームワークsim2real2026/6/1
RGB動画から再構成した3Dシーンを基盤に、視覚・接触・アクチュエータの各ギャップを統合的に補正し、実機データなしで視覚ナビゲーションをゼロショット展開できる四足歩行シミュレーションフレームワークを提案した。
- 思考の蒸留と行動の予見:自動運転のための認知物理強化学習自動運転2026/5/20
自動運転のための認知物理強化学習フレームワークCoPhyを提案。VLM知識を蒸留して認知能力を保持しつつ、BEV世界モデルで将来予測を行い、安全と意図適合の二重報酬でポリシーを最適化する。
- 視覚的に現実的なシミュレーションを目指して:ロボット操作のシミュレーション評価のためのベンチマークシミュレーション評価2026/5/1
シミュレーションと実世界の視覚的ギャップを減らすため、照明とマテリアルが幾何学的推論と空間的接地に与える影響を分析し、高忠実度の3Dアセットと自動パイプラインを用いた視覚的に現実的なベンチマークVISERを提案した。
- 動的屋内環境における少数ショット増分3D物体検出3D物体検出2026/4/9
動的屋内環境での3D物体認識を効率的に行うため、視覚言語モデルを活用して未知カテゴリの知識を学習し、少数の新規サンプルで検出性能を向上させるFI3Detフレームワークを提案した。
- MonoSE(3)-Diffusion: 単眼カメラからのロボット姿勢推定のためのSE(3)拡散フレームワーク姿勢推定2025/10/1
単眼画像からのマーカーレスなロボット姿勢推定を条件付き拡散過程として定式化し、視認性制約付き拡散とタイムステップ対応逆過程で高精度かつ頑健な姿勢推定を実現した。
- GigaSLAM:階層的ガウススプラットによる大規模単眼SLAMSLAM2025/3/1
単眼RGB入力のみでキロメートル規模の屋外環境を扱える、階層的ボクセルマップと3Dガウススプラッティングを組み合わせた初のSLAMフレームワーク。
- UnDeepLIO: Unsupervised Deep Lidar-Inertial Odometry2021/9/1