Xiang Shi
収録論文 3本 ・ フィジカルAI/ロボット学習
VLA群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SaiVLA-0: 大脳・橋・小脳の三部門構成による計算量を意識した視覚-言語-行動モデルVLA2026/3/1
脳の大脳・橋・小脳の役割分担に着想を得て、凍結した視覚言語基盤と適応層、高速な並列カテゴリカル制御を組み合わせたVLAアーキテクチャを提案し、特徴キャッシュにより学習時間短縮と成功率向上を示した。
- ROI駆動フォビエーション注意による視覚-言語-行動システムの統一エゴセントリック表現VLA2026/3/1
エンドエフェクタの姿勢を前方運動学で外部カメラに投影し、手中心の関心領域(ROI)を切り出すことで、手首カメラなしに高解像度の局所情報と全体文脈を両立するデータ表現を提案した。
- 超大規模マルチロボットタスク計画のためのスケーラブルな階層型強化学習群制御2024/12/1
ロボット移動型フルフィルメントシステムにおける超大規模マルチロボットタスク計画に対し、階層型時間注意ネットワークと多段階カリキュラム、反事実ロールアウトベースラインを組み合わせた階層型強化学習プランナを構築した。