Yu Gao
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VDGS: 可視性駆動による大規模空中シーン再構成のための3Dガウシアンスプラッティング3D再構成/sim2real2026/9/19
カメラ分布を考慮した可視性統計を導入し、シーンの分割と勾配補償を行うことで、視点が偏った大規模空中シーンの3DGS再構成を効率化・高品質化した手法。
- CubifyGS: 生涯動的シーン維持のためのオブジェクト中心3Dガウススプラッティング3DGS/動的シーン/マッピング2026/6/1
ロボットの長期的なシーン更新において、動く物体を再利用可能なガウス資産として管理し、再構築ではなく資産の取得・剛体変換・明示的刈り込みで地図を更新する手法を提案。編集後の領域に限定した適応的最適化でゴーストや不整合を抑える。
- ロボット支援部分腎摘除術における腎縫合の細粒度アクションセグメンテーション手術ロボティクス2026/4/1
ロボット支援部分腎摘除術中の腎縫合動作をフレーム単位で認識する細粒度アクションセグメンテーションのベンチマークを構築し、4つの時間モデルを比較評価した。
- UniUncer: エンドツーエンド運転のための統合動的・静的不確かさ自動運転2026/3/1
エンドツーエンド運転プランナーにおいて、静的マップ要素と動的エージェントの両方の不確かさを統合的に推定・活用する軽量フレームワークを提案。
- SutureFormer: ピクセル空間における目標条件付きオフライン強化学習による手術軌道の学習手術ロボティクス/オフライン強化学習2026/3/1
内視鏡映像から針先の軌道を逐次意思決定問題として捉え、スプライン補間で疎な注釈を密な報酬に変換する目標条件付きオフライン強化学習フレームワークを提案した。
- HiST-VLA:階層的時空間視覚言語行動モデルによるエンドツーエンド自動運転VLA2026/2/1
3D空間認識と時系列推論を強化した階層的VLAモデルを提案し、動的トークン統合と階層的プランナーで軌道生成を高精度化、NAVSIM v2で最高性能を達成した。
- DiffVLA++:メトリック誘導アラインメントによる認知推論とエンドツーエンド運転の橋渡し自動運転VLA2025/10/1
VLAモデルの認知推論とE2Eモデルの物理的実現可能性を、メトリック誘導の軌道スコアラで統合した自動運転フレームワークを提案。
- FlowDrive: エンドツーエンド自動運転のためのエネルギーフローフィールド自動運転/プランニング2025/9/1
リスクポテンシャルと車線引力場という物理的に解釈可能なエネルギーフローフィールドをBEV空間に導入し、拡散プランナで軌道生成する自動運転フレームワーク。NAVSIM v2でEPDMS 86.3のSOTAを達成。
- DiffSemanticFusion: オンラインHDマップ拡散による自動運転向けセマンティックラスタBEV融合自動運転/予測・計画2025/8/1
ラスタ表現とグラフ表現の長所を組み合わせ、オンラインHDマップの拡散モジュールで安定性と表現力を高めるBEV融合フレームワークを提案し、軌道予測と計画タスクで性能を改善した。
- IRL-VLA:逆強化学習報酬ワールドモデルによる視覚言語行動ポリシーの訓練VLA2025/8/1
逆強化学習で軽量な報酬ワールドモデルを構築し、PPOによる閉ループ強化学習でVLAポリシーを訓練する手法を提案。NAVSIM v2ベンチマークで最先端性能を達成。
- DiffVLA: 視覚言語モデルが導く拡散プランニングによる自動運転自動運転/VLA2025/5/1
視覚言語モデルを活用したハイブリッドなスパース・デンス拡散ポリシーを提案し、効率的で多様な運転行動と軌道生成の改善を実現した自動運転手法。
- Sector Patch Embedding: An Embedding Module Conforming to The Distortion Pattern of Fisheye Image2023/3/1