Xianzhe Fan
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAVLA/操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- StreamPI: 視覚・言語・行動モデルのためのストリーミング型マルチモーダル時間モデリングVLA2026/8/26
単一フレームのVLAモデルに追加パラメータなしで時間的推論能力を付与するフレームワークを提案し、実ロボットタスクで有効性を実証した。
- DreamAvoid: 臨界期テストタイムドリーミングによるVLAポリシーの失敗回避VLA/操作2026/5/1
VLAモデルが微細な操作中に失敗する問題に対し、実行が臨界期に入ったかを検出し、複数の候補行動を評価して最適な行動を選択する「テストタイムドリーミング」フレームワークを提案した。
- FASTER: リアルタイムフローVLAの再考VLA2026/3/1
フロー型VLAの反応遅延を分析し、Horizon-Aware Scheduleで直近動作のデノイズを1ステップに短縮してリアルタイム応答性を大幅に改善した手法を提案。
- Any3D-VLA:多様な点群によるVLAのロバスト性向上VLA2026/2/1
シミュレータ・センサ・モデル推定の点群を統合して学習し、2D表現と融合することで、VLAモデルの性能とドメインギャップ耐性を高める手法を提案。
- SoMi-ToM:身体的社会的相互作用における多視点Theory of Mindの評価VLA2025/6/1
マルチエージェントの身体的社会的相互作用を題材に、一人称視点と三人称視点の両方からTheory of Mindを評価するベンチマークSoMi-ToMを提案し、LVLMの性能を人間と比較評価した。