Jiahao Zhang
XPENG ROBOTICS
収録論文 7本 ・ フィジカルAI/ロボット学習
マニピュレーションヒューマノイド/サービスロボットロボットポリシー評価評価基盤LLMセキュリティVLA/長期操作
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AssemblyWorld:汎用エージェントによる3D組立の再考マニピュレーション2026/9/30
汎用エージェントが微調整なしに視覚情報から3D組立を行えるかを評価する環境とベンチマークを構築し、8システムの性能差を明らかにした。
- HODAgent:物理世界での人間との対話のためのオンデマンド・応答型ヒューマノイドヒューマノイド/サービスロボット2026/8/18
サービス現場のヒューマノイドロボット向けに、状況に応じた意図理解、応答実行、タスク修正、結果検証を統合したSystem-2エージェントを提案し、シミュレーションと実機で有効性を実証した。
- XPolicyLab: ロボットポリシー評価と展開のための統一標準・オープンエコシステムロボットポリシー評価2026/8/1
ロボットポリシーの評価と展開を統一する標準規格とオープンエコシステムを提案し、N個のポリシーとM個の環境の接続コストをO(NM)からO(N+M)に削減した。
- DeepInsight: 物理AIスタック全体を統合する評価インフラストラクチャ評価基盤2026/6/16
物理AIスタック全体を単一のランタイムで評価できる統合インフラを提案し、異なるスケールやモダリティのタスクを共通の抽象化で扱えるようにした。
- 「プロ」LLMサブスクリプションは実は「無料」かもしれない:LLM推論サービスにおけるフィンガープリント偽装リスクの暴露LLMセキュリティ2026/6/15
LLM APIの利用者が提供モデルの品質を検証するフィンガープリント手法が、悪意あるプロバイダによるモデル重みの操作で回避される「フィンガープリント偽装」という新たな脅威を提案・実証した論文。
- TempoFit: 長期的視覚言語行動操作のためのプラグアンドプレイ層別時間KVメモリVLA/長期操作2026/3/1
事前学習済みの視覚言語行動(VLA)ポリシーに、追加学習なしで時間的記憶を注入するTempoFitを提案。層ごとのKVキャッシュと再帰バイアスにより、長期的な操作タスクの成功率を向上させる。
- GoferBot: A Visual Guided Human-Robot Collaborative Assembly System2023/4/1