Gi-Cheon Kang
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ドメイン不変潜在先読みによるVLAモデルの偽相関の解消VLA2026/9/29
視覚言語行動モデルが視覚分布シフトで脆くなる原因である偽相関を、ドメイン変換軌道から学んだドメイン不変の未来潜在表現で方策を監督することで軽減するDILLを提案し、LIBERO-Plusで平均成功率69.1%を達成した。
- CLIP-RT: 自然言語監督から言語条件付きロボット方策を学習VLA2024/11/1
非専門家が自然言語でロボットのデモを収集できる枠組みと、そのデータから言語条件付き視覚運動方策を学習するVLAモデルCLIP-RTを提案し、OpenVLAより7倍小さいパラメータで成功率を24%上回った。
- ソクラテス式プランナー:自己質問応答によるゼロショット身体性指示追従プランニングVLA2024/4/1
大規模言語モデルに自己質問応答させてサブゴール列を生成し、視覚フィードバックで再計画するゼロショットの身体性指示追従プランナーを提案。ALFREDベンチマークで最先端を上回り、実機ロボットでも検証した。
- PGA: Personalizing Grasping Agents with Single Human-Robot Interaction2023/10/1
- PROGrasp: Pragmatic Human-Robot Communication for Object Grasping2023/9/1
- GVCCI: Lifelong Learning of Visual Grounding for Language-Guided Robotic Manipulation2023/7/1