Sihong Xie
収録論文 7本 ・ フィジカルAI/ロボット学習
3Dシーングラフ/エッジクラウド知覚/シーングラフナビゲーション空間推論3Dシーングラフ
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PORTER: 永続的な3Dシーングラフ記憶のためのエッジ・クラウド常駐化3Dシーングラフ/エッジクラウド2026/9/27
3Dシーングラフの軽量アンカーをエッジに残し重い物体ペイロードをクラウドとやり取りすることで、タスク切替をまたいだ再利用可能な情報を保持しつつロボットの限られたメモリを有効活用する手法を提案。
- ジャストインタイムシーングラフ成長:長時間ロボティクスにおける知覚飽和への対抗知覚/シーングラフ2026/7/1
この論文は、ロボットの長時間タスク実行中に生じる知覚の飽和問題を解決するため、タスクに応じて必要な部分だけを動的に活性化する3Dシーングラフ構築手法JITOMAを提案している。
- LH-AVLN: 長時間音声・視覚・言語ナビゲーションのベンチマークナビゲーション2026/7/1
複数目標と空間化された音響手がかりを組み合わせた長時間ナビゲーションのベンチマークを提案し、音声を活用した参照エージェントPAG-Navを開発して評価した。
- PSG-Nav: 確率的シーングラフナビゲーションによるマルチバース意思決定ナビゲーション2026/6/1
オープンボキャブラリナビゲーションの不確実性を扱うため、3D確率的シーングラフとマルチバース意思決定を導入し、複数の可能性を考慮した最適なナビゲーションを実現した。
- 空間複雑性の分解:LLMの空間推論のための階層的分解空間推論2026/5/27
LLMの空間推論能力を向上させるため、複雑なタスクを階層的に分解する手法と、MCTS誘導のグループ相対方策最適化(M-GRPO)を提案し、ナビゲーションや計画などの空間タスクで最先端の性能を達成した。
- RAG-3DSG: 再撮影ガイド付き検索拡張生成による3Dシーングラフの強化3Dシーングラフ2026/1/1
限られた視点と遮蔽による意味的不整合を、再撮影による不確実性推定と物体レベルのRAGで補正し、信頼性の高い3Dシーングラフを構築する手法を提案した。
- 外乱に頑健なUSVナビゲーションのための分布ロバスト強化学習ナビゲーション2025/12/1
異分散な観測ノイズに悩む無人水上艇の航法に対し、分布ロバスト最適化と暗黙的分位点ネットワークを統合したDRIQNを提案し、最悪ケース性能を改善した。