Tianshi Wang
収録論文 6本 ・ フィジカルAI/ロボット学習
敵対的攻撃VLA/安全制御VLA/量子化VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- UniTexture: 視覚言語行動モデルに対するクロスタスク普遍敵対的テクスチャ敵対的攻撃2026/8/13
単一のテクスチャ付き3Dオブジェクトを用いて、複数のタスクにわたってVLAモデルの行動予測を敵対的に逸脱させる普遍的な攻撃手法を提案した。
- ActFovea: 時空間的な視覚-行動整合性によるVLAポリシーの実行時保護VLA/安全制御2026/7/1
VLAポリシーを再学習せずに実行時の外乱を検出・緩和するプラグアンドプレイの保護フレームワークを提案。視覚と行動の整合性を監視し、回復不能な場合は安全に失敗させる。
- ドリフト対応ポストトレーニング量子化による効率的な視覚言語行動モデルVLA/量子化2026/4/1
視覚言語行動モデル(VLA)の量子化時に生じる時間的誤差蓄積による動作ドリフトを解決するため、ドリフト対応PTQ(DA-PTQ)を提案。クロススペース表現補償と動作駆動混合精度割り当てにより、低ビットでも高精度な制御を実現。
- AC^2-VLA: 行動文脈を考慮した適応的計算による効率的なロボットマニピュレーションVLA2026/1/1
VLAモデルの推論における時間・空間・深さ方向の冗長性に着目し、行動文脈に基づいて計算を適応的に再利用・削減するフレームワークを提案。密なモデルと同等の成功率を保ちつつ最大1.79倍の高速化とFLOPs29.4%削減を実現した。
- ActDistill: 効率的な視覚-言語-行動モデルのための汎用的な行動誘導自己蒸留VLA2025/11/1
既存のVLAモデルの行動予測能力を軽量な生徒モデルに転移させる蒸留フレームワークを提案し、計算量を50%以上削減しつつ同等以上の性能を実現した。
- BLM₁:デジタルと物理を横断する汎用大規模モデルVLA2025/10/1
デジタル空間と物理空間、異なるタスクやロボット身体をまたいで動作する統合型マルチモーダル基盤モデルBLM₁を提案し、2段階学習で身体性知識と制御を両立させた。