Yuchen Huang
Beijing Institute of Technology
収録論文 5本 ・ フィジカルAI/ロボット学習
所属歴(論文より): Beijing Institute of Technology(〜2026) / University of Science and Technology Beijing(〜2026) / ZTE Corporation(〜2026)
VLAサービスロボット/世界モデル計画データエンジン/操作学習VLA/モデル圧縮
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- BICPO-VLA: 行動識別による継続選好最適化を用いた滑らかな非同期視覚言語行動制御VLA2026/8/14
ロボットの動作生成中に生じる要求から引き継ぎまでのギャップを、行動意図の識別、Haar部分空間による動作チャンク分解、参照相対Flow-DPOによる適応の3段階で解消する手法を提案した。
- PBD-AG: 不確実性を考慮した検査を備えた持続的ベースライン-デルタ能動グラフによる長時間稼働サービスロボットのための世界モデルサービスロボット/世界モデル2026/8/1
長時間稼働するサービスロボット向けに、安定した構造物と変化する物体イベントを分離した持続的な世界モデルを構築するフレームワークを提案。ロボットが自律的に環境を探索し、物体の状態を確率的に管理し、検査視点を選択することで、長期的な認識の信頼性を向上させる。
- PACE: 時間効率的な具現化計画のための適応予算配分計画2026/8/1
推論と実行をインターリーブし、実行時間に合わせて推論トークン予算を動的に調整することで、具現化計画の推論遅延を大幅に削減するフレームワークを提案した。
- AXIS:拡張可能なロボット操作のためのコミュニティ駆動型データエンジンデータエンジン/操作学習2026/7/1
ブラウザベースの遠隔操作で大規模なデモ収集を可能にし、タスクの自動生成・検証とデータ品質向上を組み合わせた、拡張可能なロボット操作学習用データエンジンとベンチマークを提案。
- 2Dか3Dか:VLAモデルにおける顕著性を支配するのはどちらか?--モダリティ顕著性を考慮した三段階トークンプルーニングフレームワークVLA/モデル圧縮2026/4/1
マルチビジュアルモーダルVLAモデル向けに、2D/3Dモダリティの顕著性差を分析し、三段階のトークンプルーニング手法を提案。最大2.55倍の推論高速化を実現。