Haixin Shi
収録論文 6本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA3D再構成
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 橋渡し動作としての翻訳:人間からロボットへの操作スキル転移マニピュレーション2026/6/1
人間の動作データから双腕ロボットへの操作スキル転移を改善するため、頭部カメラ座標系での相対手首並進を橋渡し動作表現として用いる手法を提案し、ノイズの多い6DoF人間動作よりも効果的であることを示した。
- World Guidance: 行動生成のための条件空間における世界モデリングVLA2026/2/1
未来の観測をコンパクトな条件に圧縮して行動推論に注入し、VLAモデルが未来の行動と条件を同時に予測することで、精密な行動生成と高い汎化性能を実現するフレームワークを提案した。
- GR-RL:長期的器用マニピュレーションのための器用で精密なロボット学習マニピュレーション2025/12/1
人間のデモンストレーションをフィルタリング・拡張・強化学習で強化し、VLAポリシーを長期的で精密な器用マニピュレーションに特化させるフレームワークを提案。靴紐を穴に通して結ぶタスクを83.3%の成功率で自律的に達成。
- GR-Dexter 技術報告書VLA2025/12/1
両手デクスタラスハンドロボットで言語条件付き長期操作を実現するVLAフレームワークを提案し、ハードウェア・データ収集・学習手法を統合した。
- GR-3 汎用ロボットポリシー構築に向けた大規模VLAモデルVLA2025/7/1
ウェブ規模の視覚言語データとVR収集の人間軌道データ、ロボット軌道データを組み合わせて訓練した大規模VLAモデルGR-3を開発し、両腕移動ロボットByteMiniと統合して新規物体・環境・長期タスクへの汎化性能を示した。
- 仮想カメラによる自由移動物体の再構成と姿勢推定3D再構成2024/5/1
単眼RGB動画から、事前知識なしに自由に動く物体の形状と姿勢を、仮想カメラ系を用いて大域的に最適化する手法を提案。