Jin Xu
ZTE Corporation
収録論文 7本 ・ フィジカルAI/ロボット学習
所属歴(論文より): ZTE Corporation(〜2026) / Georgia Institute of Technology(〜2026)
VLA音響知覚リハビリテーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Dream4ACT: 複数身体に対応した動画・行動モデリングのための共有視覚行動インターフェースVLA2026/9/30
関節構成を4つの仮想カメラ映像として描画する「action views」で身体差を吸収し、単一の動画拡散モデルで順動力学・逆動力学・観測行動生成を統合した世界モデルを提案。
- OmniEcho: 身体性エージェントのための空間音響理解音響知覚2026/9/20
実世界の空間音響・視覚シーンを集めたベンチマークOmniEchoBenchを構築し、一人称アンビソニックス音響を扱う全モーダルモデルOmniEchoを提案。音響による知覚・ナビゲーションで最先端性能を達成した。
- EmbodiedMind: 効率的な身体性知能のための適応的データキュレーションとプレフィックス木強化学習VLA2026/9/17
身体性基盤モデルの学習において、低情報サンプルの除去、タスク間のバランス調整、長期的計画におけるクレジット割り当て問題を解決するため、RSFT、IR-GRPO、Trie-GRPOを組み合わせた効率的な訓練パラダイムを提案。
- NebulaVLA: ロボット操作のためのガイドアクションを備えた二周波数視覚言語行動モデルVLA2026/8/17
高レベルの意味推論と低レベルのアクション制御を分離した非同期二周波数アーキテクチャを提案し、異種ロボット間のギャップを埋める統一表現と滑らかな動作を実現するガイドアクションアルゴリズムを導入した。
- THRIVE: 仮想環境における治療用ヒューマノイドロボットリハビリテーション2026/8/14
家庭で使えるリハビリプラットフォームで、VRゲーム、カメラによる動作追跡、ロボットセラピストを組み合わせ、上肢運動障害のある子供の治療を支援する。
- Pelican-Unify 1.0: 理解・推論・想像・行動を統合した身体化基盤モデルVLA2026/5/1
単一のVLMと統一未来生成器を用いて、理解・推論・想像・行動を一つのモデルで統合的に学習・実行する身体化基盤モデルを提案し、各能力のベンチマークで高い性能を達成した。
- A Bayesian Framework for Nash Equilibrium Inference in Human-Robot Parallel Play2020/6/1