Hongsong Wang
Southeast University
収録論文 5本 ・ フィジカルAI/ロボット学習
画像編集行動予測自動運転/VLA自動運転3D検出
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ドラッグ編集のための運動に基づく潜在再構成手法MoRe-Drag画像編集2026/9/29
ドラッグ操作による画像編集において、ピクセル空間のワーピングを運動の手がかりとして生成過程に注入し、領域ごとの潜在再構成と段階的適応条件付けで精度と自然さを両立させる手法を提案。
- ゼロショット骨格ベース行動予測行動予測2026/8/14
未観測の行動クラスを初期段階の骨格シーケンスのみから認識するゼロショット骨格ベース行動予測(ZS-SkAA)タスクを新たに定義し、相互情報量推定・最大化によるベースラインモデルとNTU RGB+Dデータセットを用いた評価プロトコルを提案した。
- AnchorVLA: 離散的な意思決定と連続的な軌道を橋渡しする視覚言語行動計画自動運転/VLA2026/7/1
自動運転の計画において、高レベルの意思決定を表すアンカートークンと、その残差空間での連続軌道生成を組み合わせたVLA計画フレームワークを提案した。
- PrismAD: 意味的Mixture-of-Plannersによる分離型計画法を用いたエンドツーエンド自動運転自動運転2026/7/1
自動運転の計画タスクを、相互作用・幾何・意図の3つの専門家に分離し、意味的ルーターで適応的に統合するフレームワークを提案した。
- HQ-OV3D: 拡散モデルに基づく高品質ボックスオープンワールド3D検出フレームワーク3D検出2025/8/1
拡散モデルを用いて高品質な擬似ラベルを生成・精錬し、オープンボキャブラリ3D検出の精度を向上させるフレームワークを提案。