Jianxiong Gao
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA/世界モデルLiDAR生成マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- τ0-WM: ロボット操作のための統合ビデオ・アクション世界モデルVLA/世界モデル2026/6/1
ロボット操作のための、ポリシー学習・ビデオ予測・行動評価を単一の未来予測フレームワークに統合した世界モデルを提案。実ロボットデータ約27,300時間で訓練し、推論時に候補行動のサンプリングと評価・修正を行うことで、長期的で細かい操作タスクで高い性能を示した。
- Veila: 単眼RGB画像からのパノラマLiDAR生成LiDAR生成2025/8/1
単眼RGB画像を条件として、拡散モデルによりパノラマLiDAR点群を生成するフレームワークを提案。信頼度に基づく条件付けと幾何学的整合性により、RGBとLiDARのモダリティギャップを克服する。
- LAC-Net: 遮蔽下での高精度ロボット把持のための線形融合注意誘導畳み込みネットワークマニピュレーション2024/8/1
RGBと深度を線形融合する注意誘導型ネットワークで物体の遮蔽部分を補完し、雑然とした環境でのロボット把持精度を向上させた研究。