Jinyu Zhang
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA共有制御マニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- τ0-VLA: 世界モデル誘導のテスト時計算を備えた階層型ロボット基盤モデルVLA2026/8/17
長期的なロボット操作タスクを、高レベル方策がサブタスク生成時にテスト時計算を追加で行える階層型VLAモデルを提案し、実データで性能向上を実証した。
- FineVLA: 操縦可能な視覚言語行動ポリシーのための細粒度命令整合VLA2026/5/1
ロボットタスクの実行方法に関する細かい指示(腕、方向、接触領域など)をVLAモデルに学習させるためのデータセットとベンチマーク、およびポリシーを構築した。
- ST4VLA: 視覚言語行動モデルのための空間誘導訓練VLA2026/2/1
VLMに空間的な事前知識を組み込む二段階訓練でロボットの行動生成を改善し、SimplerEnvで新たなSOTAを達成した研究。
- 自己回帰離散事前学習による身体性VLM推論とロボット行動の統合VLA2025/12/1
身体性推論を評価するベンチマークERIQと、連続制御を離散化するFACTトークナイザを提案し、推論と行動を統合したGenieReasonerで実世界マニピュレーション性能を向上させた。
- 計画レベルの意図予測を備えた移動ロボットの共有制御フレームワーク共有制御2025/11/1
人間の将来の動きを「意図領域」として予測し、経路再計画と組み合わせて移動ロボットを支援する共有制御手法を提案。シミュレーションのみで学習し、実機実験で作業負担の軽減と安全性向上を確認した。
- InternVLA-M1: 空間誘導型視覚-言語-行動フレームワークによる汎用ロボットポリシーVLA2025/10/1
空間グラウンディングを手がかりに「どこで行動するか」と「どう行動するか」を二段階で学習し、汎用ロボット制御を実現するVLAフレームワークを提案。
- LAC-Net: 遮蔽下での高精度ロボット把持のための線形融合注意誘導畳み込みネットワークマニピュレーション2024/8/1
RGBと深度を線形融合する注意誘導型ネットワークで物体の遮蔽部分を補完し、雑然とした環境でのロボット把持精度を向上させた研究。