Wanjun Jia
収録論文 6本 ・ フィジカルAI/ロボット学習
VLAマルチオブジェクト追跡マニピュレーションアフォーダンス接地アフォーダンス
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PanoFuse: パノラマ強化型視覚-言語-行動学習と分離型意味-幾何ルーティングVLA2026/9/21
全方向パノラマ知覚をVLAに統合し、意味情報と幾何情報を分離して経路選択するDSGRにより、遮蔽や未知環境下でのマニピュレーション成功率を向上させた。
- PS-MOT: 点シードからインスタンス認識を育成するマルチオブジェクト追跡マルチオブジェクト追跡2026/6/1
バウンディングボックスではなく点のアノテーションだけでマルチオブジェクト追跡を実現する手法を提案。データ・モデル・損失の各レベルで点からインスタンスへの階層的パイプラインを構築し、既存の点教師付き追跡手法を上回る性能を達成した。
- BLaDA: 3DGSフィールド内で言語を機能的巧みな動作に橋渡しするマニピュレーション2026/4/1
言語指示を3Dガウススプラッティング場に基づく機能的把持の制約として解釈し、ゼロショットで器用な操作を実現するフレームワークを提案した。
- PanoAffordanceNet:360度屋内環境における全体的アフォーダンス接地に向けてアフォーダンス接地2026/3/1
360度パノラマ画像から物体のアフォーダンス(行動可能性)をシーン全体で推定する新タスクを提案し、歪み補正と球面稠密化を組み込んだエンドツーエンドモデルと初のデータセットを構築した。
- TRACER: 変形物体操作のためのテクスチャ頑健なアフォーダンス連鎖推論マニピュレーション2026/1/1
外観やテクスチャの変化に頑健なアフォーダンス予測のため、階層的意味推論から機能領域の精緻化までを連鎖的に行うTRACERフレームワークを提案し、変形物体操作の精度を向上させた。
- 一人称視点の整理シーンにおける変形物体のワンショットアフォーダンスグラウンディングアフォーダンス2025/3/1
色や形が異なる未知の変形物体を少数サンプルから認識し、一人称視点の整理作業でアフォーダンスを推定する手法を提案。15種の変形物体データセットも構築した。