Kaiyan Zhao
収録論文 4本 ・ フィジカルAI/ロボット学習
強化学習群制御VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- E²DT:経験認識サンプリングによる効率的かつ効果的なロボット操作のためのディシジョン・トランスフォーマー強化学習2026/5/1
ロボット操作の強化学習において、ディシジョン・トランスフォーマーの性能を向上させるため、経験の質と多様性を考慮したサンプリング手法を提案した論文。
- C2T: キャプション構造とLLM整合型常識報酬学習による交通・車両協調群制御2026/4/1
交通信号制御と自動運転車の協調において、人手設計の報酬に代わり、大規模言語モデルから常識知識を抽出して内在報酬を学習し、MARLポリシーを導くフレームワークC2Tを提案した。
- 注意が裏切るとき:視覚トークン再構成によるロボットポリシーのバックドア攻撃消去VLA2026/2/1
VLAモデルのバックドアが深層注意を乗っ取る仕組みを解明し、テスト時に異常トークンを検出・マスクしてトリガー除去画像を再構成することで、再学習なしに攻撃を無効化する防御手法Beraを提案した。
- RGMP: 汎化可能なヒューマノイドロボット操作のための再帰的幾何事前マルチモーダルポリシーマニピュレーション2025/11/1
視覚言語モデルに幾何学的な事前知識を組み込み、ガウス過程でロボットと対象物の関係を再帰的に符号化することで、少ないデータで未知環境にも汎化するヒューマノイド操作を実現した。