Xu Wang
収録論文 11本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 一つのMLLM、一回の呼び出し:空間認識ウェイポイントによる効率的なゼロショット視覚言語ナビゲーションナビゲーション2026/9/6
連続環境での視覚言語ナビゲーション(VLN-CE)において、各意思決定ステップで単一の大規模モデルを一度だけ呼び出す効率的なゼロショットナビゲーションフレームワークO2C-Navを提案。訓練不要のウェイポイント生成器と抽象表現を用いてRGB画像上に候補ウェイポイントを可視化し、MLLMが選択した目標をFMMプランナーで衝突回避経路に変換する。
- HUGIN: 自律物流仕分けのための視覚言語プランニングの強化VLA/プランニング2026/8/12
自律物流仕分けシステムにおける複数カメラ視点を統合した計画問題を新たに定義し、視覚言語モデルの性能を高める訓練フレームワークHUGINを提案。データ拡張と文脈ランキングにより精度を大幅に向上させた。
- 動きをプロンプトとして:動き誘導型クロスフレーム視覚プロンプティングによるマルチモーダル大規模言語モデルの動き推論の強化ビデオ推論2026/8/12
動き中心のビデオ推論を強化するため、軌跡を視覚入力に直接マークするフレームワークを提案し、既存のMLLMの性能を向上させた。
- ABot-Earth 0.5: 生成型3D地球モデル3D生成2026/6/8
衛星画像から広大な3D環境を生成する生成モデルを提案し、3Dガウススプラッティングを用いてリアルな都市景観を高速に合成する。
- PS-MOT: 点シードからインスタンス認識を育成するマルチオブジェクト追跡マルチオブジェクト追跡2026/6/1
バウンディングボックスではなく点のアノテーションだけでマルチオブジェクト追跡を実現する手法を提案。データ・モデル・損失の各レベルで点からインスタンスへの階層的パイプラインを構築し、既存の点教師付き追跡手法を上回る性能を達成した。
- NOVA: 自動運転における3Dマルチオブジェクト追跡のための次段階オープンボキャブラリ自己回帰3D追跡/自動運転2026/3/1
3Dマルチオブジェクト追跡を、大規模言語モデルの自己回帰能力を利用して、軌跡を時空間セマンティックシーケンスとして扱い、次段階のシーケンス補完として定式化する新しい手法を提案。未知の物体カテゴリへの一般化を向上させ、nuScenesなどのデータセットで優れた性能を達成。
- PointSLAM++: ロバストな高密度ニューラルガウス点群ベースSLAMSLAM2026/1/1
階層的に制約されたニューラルガウス表現と漸進的な姿勢最適化を用いて、深度ノイズに強く高精度なRGB-D SLAMを実現した研究。
- ソフト磁気アクチュエータのプログラム可能なダイナミクスによる真性乱数生成とリザバーコンピューティングソフトロボティクス2025/11/1
疲労なく数万回動作する磁性ソフトアクチュエータを開発し、その複雑なダイナミクスを利用して真性乱数生成やリザバーコンピューティングを実現した。
- 2D術前X線画像からのSRVF弾性位置合わせと変形グラフによる3D寛骨臼表面再構成医用画像再構成2025/3/1
複数方向の術前骨盤X線画像と半球モデルを、SRVF弾性形状位置合わせと変形グラフで融合し、寛骨臼の3D関節面を再構成する手法を提案した。
- 前進する自動運転:ソフトウェアとハードウェアシステムのレビュー自動運転2024/11/1
自動運転システムのセンサー・データセット・シミュレーション・ソフトウェア構成と、それを支えるハードウェアの性能・効率を包括的に調査したサーベイ。
- 非構造環境における自動運転:どこまで進んだのか自動運転2024/10/1
農地や鉱山などの非構造屋外環境での自動運転に関する250本以上の論文を調査し、地図作成・自己位置推定・環境認識・経路計画・End-to-End運転・データセット・課題を整理したサーベイ。