Zhaofeng Hu
収録論文 4本 ・ フィジカルAI/ロボット学習
3D追跡VLA/マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- TFTrack: テンプレート不要の効率的な3D点群追跡フレームワーク3D追跡2026/9/7
LiDARベースの3D単一物体追跡において、テンプレートや複雑な動きモデルが不要であることを示し、前フレームのバウンディングボックス中心とサイズのみで現在フレームを追跡する新しいフレームワークを提案した。
- AnySlot: ゼロショットのスロット配置のための目標条件付き視覚言語行動ポリシーVLA/マニピュレーション2026/4/1
言語指示による精密な物体配置を実現するため、言語を視覚的な目標マーカーに変換し、目標条件付きVLAポリシーで実行する階層的フレームワークを提案。また、スロット配置の評価用ベンチマークSlotBenchも導入。
- 建設作業におけるロボットスキル学習のサンプル効率:階層型強化学習と視覚言語行動VLAモデルのベンチマークVLA2025/12/1
建設ロボットのスキル学習において、VLAモデルと強化学習を比較し、VLAが汎化性能と少数ショット学習で優れ、実タスクへの適用が容易であることを示した。
- MVCTrack: マルチモーダル誘導仮想キューによる3D点群追跡の強化3D追跡2024/12/1
LiDAR点群の疎性を補うため、RGB画像から得た2D検出を仮想3Dキューに変換して点群を密にし、既存の3D追跡器の性能を向上させる手法を提案。