Jiawei Chen
収録論文 6本 ・ フィジカルAI/ロボット学習
画像編集システム/分散推論操作学習VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DecFlowEdit: ガイダンス分離による自己局所化フローベース画像編集画像編集2026/9/28
フローベース画像編集において、局所化と編集性のためのガイダンススケールを分離することで、背景を保ちながら編集精度を向上させる学習不要・逆変換不要の手法を提案。
- ステートフルな世界、ステートレスな弾力性:対話型ワールドモデルのための厳密状態サービスシステム/分散推論2026/7/11
対話型ワールドモデルの実行状態(巨大なアテンションキャッシュ)を、ビット単位で同一のまま別GPUへ高速移行する手法WorldMoveを提案し、18.8msでの移行と48回全ての移行がビット同一であることを実証した。
- 条件付けが重要:拡散画像編集における反転と注意の安定化画像編集2026/6/12
テキスト条件付けの精度が拡散モデルの反転安定性と編集品質に与える影響を理論・実験で示し、条件付けの改良とトークン単位の注意制御を備えたSimEditを提案した。
- LaST-HD: スケーラブルな人間データからロボット操作の物理的推論を学習する操作学習2026/6/1
人間の手のデモンストレーションとロボットのデモンストレーションを共有の潜在推論空間で整列させ、物理ダイナミクスを内部化することで、ロボット操作の学習を改善する新しい手法を提案した論文。
- SPAN-Nav: 多様な視覚言語ナビゲーションのための汎用空間認識VLA2026/3/1
RGB動画から占有予測で空間事前知識を学習し、単一トークンで空間手がかりを行動推論に注入する視覚言語ナビゲーション基盤モデルを提案。
- MM-Nav: マルチビューVLAモデルによるマルチエキスパート学習を用いた堅牢な視覚ナビゲーションVLA2025/10/1
360度視野のマルチビューVLAモデルを強化学習エキスパートのデータから教師あり学習し、到達・すり抜け・回避の能力を統合して実世界でも汎化する視覚ナビゲーションを実現した。