Chuyan Xiong
収録論文 3本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BitVLA: ロボットマニピュレーションのための1ビット視覚言語行動モデルVLA2025/6/1
全てのパラメータを3値{-1,0,1}に量子化した1ビットVLAモデルを提案し、メモリを11倍削減しつつ全精度ベースラインと同等のマニピュレーション性能を実現した。
- SR3D: 単視点3D再構成で透明・鏡面物体の把持を実現マニピュレーション2025/5/1
単視点のRGB-D画像から外部の視覚モデルで物体メッシュを再構成し、視点・キーポイントマッチングで元のシーンに位置合わせすることで、透明・鏡面物体の把持を可能にする学習不要のフレームワークを提案。
- AIC MLLM:ロボットマニピュレーションのための自律対話型修正マルチモーダル大規模言語モデルマニピュレーション2024/6/1
関節物体操作における低レベル接触姿勢の失敗を、視覚マスクとテキスト指示を用いてMLLMが自律的に認識・修正する手法を提案。