Xiaojiang Peng
収録論文 6本 ・ フィジカルAI/ロボット学習
VLA画像編集VLA/データ拡張VLA/ロボット操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- ATI-VLA: 行動中心の予測型視覚-言語-行動モデルVLA2026/10/1
予測観測と行動の表現を共有コードブックで揃え、予測潜在を行動生成に適応的に注入することで、操作タスクの性能と収束速度を向上させたVLAモデル。
- 何を編集できるのか?オープンエンドな戦略発見と感情編集可能性のランドスケープ画像編集2026/7/27
感情画像編集を「どう編集するか」ではなく「何を編集できるか」と捉え直し、画像固有の編集可能領域を発見するマルチエージェントフレームワークEmoScopeを提案。大規模な人間評価で既存手法を上回る性能を示した。
- VLAモデルのための行動合成訓練による行動範囲の拡大VLA/データ拡張2026/7/1
既存のデモデータから新しい物理的に有効なデモを自動合成し、VLAモデルの過学習を防いで行動の汎化を向上させるオフライン拡張手法を提案した。
- AC-VLA: 構成学習によるロバストな分布外行動実行VLA/ロボット操作2026/7/1
VLAモデルの分布外汎化を改善するため、LLMによるタスク分解と非対称マスキングを組み合わせた構成学習フレームワークAC-VLAを提案した。
- 推論時適応アクションチャンキングによる視覚言語行動モデルの性能向上VLA2026/4/1
VLAモデルにおいて、アクションのチャンクサイズを予測のエントロピーに基づいて適応的に決定する戦略を提案し、シミュレーションと実世界の操作タスクで性能を向上させた。
- Affordance Transfer Learning for Human-Object Interaction Detection2021/4/1