Kai Cheng
Purdue University
収録論文 5本 ・ フィジカルAI/ロボット学習
動作計画VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- M³P-R1: 大規模言語モデルによるマルチモーダル動作計画のための強化学習とMIPコード生成動作計画2026/9/16
大規模言語モデルを強化学習で微調整し、マルチモーダル動作計画問題を混合整数計画(MIP)のコードとして生成・求解する手法を提案。
- マルチモーダル言語モデルの身体性能力をスキル単位で評価・診断するベンチマークBEARVLA2025/10/1
身体性タスクを14の原子スキルに分解してMLLMを細粒度評価するベンチマークBEARを提案し、知覚と時空間モデリングがボトルネックであることを示すとともに、視覚・空間推論ツールを組み込んだBEAR-Agentで性能を改善した。
- EfficientEQA:オープン語彙な身体性質問応答への効率的アプローチVLA2024/10/1
ロボットが効率的に探索しながら自由形式で質問に答えるためのフレームワークを提案し、意味重視の探索と適応的停止、RAGによる回答生成で精度向上と探索ステップ削減を実現した。
- Learning Environment-Aware Affordance for 3D Articulated Object Manipulation under Occlusions2023/9/1
- Analysis of lane-change conflict between cars and trucks at merging section using UAV video data2022/1/1