Chenxin Li
収録論文 4本 ・ フィジカルAI/ロボット学習
マニピュレーションGUIエージェントVLAVLM
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ChunkTrust: 行動専門家の証拠に基づくロボット政策の実行ホライズン適応マニピュレーション2026/9/30
ロボット基盤政策が予測する行動チャンクの実行長を、固定値ではなく行動専門家の証拠から推論する潜在変数として扱い、訓練不要のセレクタと軽量アダプタで適応的に決定する手法を提案。
- HyMobileAgent: データと環境の共スケーリングによる高効率GUIエージェントGUIエージェント2026/7/16
モバイルGUIエージェントの性能を、モデル規模だけでなくデータと環境の両方をスケールさせる枠組みで向上させた。合成データ生成、知識パイプライン、大規模アクションデータ、リセット可能な訓練環境、計画・反省機構を統合している。
- 二つの橋、一つの道:身体化軌跡結合データによるVLMから汎用VLAへの変換VLA2026/6/1
視覚言語モデル(VLM)をロボット制御ポリシー(VLA)に変換する際のギャップを、ロボットの軌跡に基づく中間データ(ETCデータ)と3段階の訓練手法で段階的に橋渡しし、汎用性を高める手法を提案した論文。
- CLIPの特定パラメータのみを微調整するClipFitVLM2024/9/1
CLIPのバイアス項と正規化層だけを微調整することで、追加パラメータなしにゼロショット性能を平均7.27%向上させる手法を提案した。