Jiahong Chen
収録論文 4本 ・ フィジカルAI/ロボット学習
VLA6D姿勢推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SpatioLM: 視覚言語モデルにおける汎用物理空間知能の実現VLA2026/8/3
視覚言語モデルに追加の3D入力や外部エンコーダを使わず、パラメータ効率的なモジュールと擬似深度・カメラ情報の教師信号で空間推論能力を強化し、汎用性能の低下を抑えつつ空間知能を向上させた。
- DKPMV: 多視点RGB画像からの高密度キーポイント融合によるテクスチャレス物体の6D姿勢推定6D姿勢推定2025/10/1
多視点RGB画像のみを入力とし、高密度キーポイントの幾何情報を段階的に最適化することで、テクスチャレス物体の6D姿勢推定を高精度に行う手法を提案した。
- NanoVLA:軽量汎用ロボットポリシーのための視覚言語理解を分離したルーティングVLA2025/10/1
視覚と言語の融合を後段に分離し、長短アクションチャンキングと動的ルーティングを組み合わせることで、エッジデバイス上で最大52倍高速かつ98%少ないパラメータで動作する軽量VLAモデルを提案した。
- Ensemble diverse hypotheses and knowledge distillation for unsupervised cross-subject adaptation2022/4/1