Guangyao Zhai
収録論文 11本 ・ フィジカルAI/ロボット学習
sim2realVLAマニピュレーションシーングラフ/常識推論
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ビールを取ってきて:スムーズなピックアンドプレースのための合成から実への階層型ポリシーsim2real2026/9/16
液体入り容器をこぼさずに運ぶため、流体シミュレーションで検証した合成データと、言語・視覚からSE(3)目標を生成する高レベルモジュール+潜在拡散コントローラの階層型ポリシーを組み合わせた合成→実機フレームワークを提案。
- STARE-VLA:視覚言語行動モデルの微調整のための段階的ステージ認識強化学習VLA2025/12/1
長期的な行動軌跡を意味のある段階に分解し、段階ごとに密な強化学習信号を与えることで、VLAモデルの微調整を安定化・高精度化する手法を提案。
- KGN-Pro: 確率的2D-3D対応学習によるキーポイントベースの把持予測マニピュレーション2025/7/1
RGB-D画像から把持キーポイントを予測し、確率的PnP層で3D最適化をエンドツーエンドに組み込むことで、6自由度把持推定の精度と成功率を向上させた研究。
- SG-Tailor: シーングラフ操作のための物体間常識関係推論シーングラフ/常識推論2025/3/1
シーングラフのノード追加やエッジ変更時に生じる矛盾を解消し、常識的な関係を自己回帰的に予測するモデルを提案。シーン生成やロボット操作に組み込み可能。
- SG-Bot: Object Rearrangement via Coarse-to-Fine Robotic Imagination on Scene Graphs2023/9/1
- IPCC-TP: Utilizing Incremental Pearson Correlation Coefficient for Joint Multi-Agent Trajectory Prediction2023/3/1
- MonoGraspNet: 6-DoF Grasping with a Single RGB Image2022/9/1
- DA$^2$ Dataset: Toward Dexterity-Aware Dual-Arm Grasping2022/8/1
- FlowMOT: 3D Multi-Object Tracking by Scene Flow Association2020/12/1
- Semantic Graph Based Place Recognition for 3D Point Clouds2020/8/1
- PASS3D: Precise and Accelerated Semantic Segmentation for 3D Point Cloud2019/9/1