Xiaoke Jiang
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA身体化AI/位置特定3Dデータ拡張
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ガイド・思考・行動:視覚言語行動モデルにおける対話型身体化推論VLA2026/5/1
ユーザーが視覚的な手がかりでロボットのポリシーを誘導できる対話型VLAフレームワークを提案し、空間的推論と行動生成を統合してOOD環境での堅牢性を向上させた。
- SpatialPoint: 身体化された位置特定のための空間認識ポイント予測身体化AI/位置特定2026/3/1
視覚と言語指示に基づいて実行可能な3Dポイントを予測する身体化位置特定問題を定式化し、深度情報を視覚言語モデルに統合するSpatialPointを提案。RGB-Dデータセットを構築し、実ロボットでの把握・配置タスクで有効性を検証した。
- 3DRot: RGBベース3D拡張のための失われた基本操作の再発見3Dデータ拡張2025/8/1
シーン深度を使わずにカメラ光学中心周りの回転・鏡映でRGB画像とカメラ内部パラメータ・3Dアノテーションを同期更新し、幾何整合性を保つプラグアンドプレイなデータ拡張を提案。単眼3D検出や深度推定で精度向上を実証。