Dapeng Zhang
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA強化学習/操作自動運転/VLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- MedVLA: 閉ループ精密医療ロボット操作のための階層型視覚-言語-行動フレームワークVLA2026/9/22
高レベルなマルチモーダル推論と低レベルの関数制約付き実行を組み合わせた階層型VLAフレームワークを提案し、柔軟電極挿入タスクで95%の成功率を達成した。
- HALO-WA: ハイブリッド注意機構と潜在変数ガイドによるオンライン強化学習を用いた世界行動モデル強化学習/操作2026/7/1
世界行動モデルによる精密操作の失敗を、潜在特徴と行動事前分布を利用した軽量なアクタークリティック適応器とハイブリッド注意機構でオンライン修正する手法を提案し、実機4タスクで成功率を大幅に向上させた。
- CoC-VLA: 因果連鎖型視覚言語行動モデルによる説明可能な自動運転のための敵対的ドメイン転移自動運転/VLA2025/11/1
シミュレーションで得た長尾ケース対応能力を実世界へ転移するため、因果連鎖推論を行う視覚言語モデルを教師・生徒・識別器で構成した敵対的転移フレームワークを提案した論文。
- Reasoning-VLA:自動運転向けの高速で汎用的な視覚-言語-行動推論モデルVLA2025/11/1
学習可能な行動クエリと推論強化された視覚言語特徴を並列に用いて連続行動軌道を生成するVLAフレームワークを提案し、8つの自動運転データセットを統合して学習・強化学習微調整を行い、最先端の性能と汎化性、高速推論を実現した。
- VLA-R1:視覚-言語-行動モデルにおける推論能力の強化VLA2025/10/1
検証可能な報酬による強化学習とGRPOを組み合わせ、アフォーダンスや軌道に沿った思考連鎖を学習させることで、VLAモデルの推論と実行精度を高めた研究。
- 純粋な視覚言語行動(VLA)モデル:包括的サーベイVLA2025/9/1
視覚言語行動(VLA)モデルの研究を体系的に整理し、自己回帰・拡散・強化学習などのパラダイム分類やデータセット・ベンチマークを概観したサーベイ論文。
- AutoDrive-R²: 自動運転VLAモデルの推論と自己反省能力を強化VLA2025/9/1
自動運転向けVLAモデルに思考連鎖と強化学習を導入し、推論と自己反省を促すことで軌道計画の精度と解釈性を向上させた研究。