Qingmin Liao
収録論文 7本 ・ フィジカルAI/ロボット学習
強化学習/UAV触覚推定VLAジェスチャー生成強化学習UAVナビゲーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- AgilePE: 自己対戦強化学習による自律UAV追跡・回避強化学習/UAV2026/8/14
自己対戦強化学習を用いて、UAVの追跡・回避行動をエンドツーエンドで学習し、シミュレーションから実機へのゼロショット転送を実現したシステムを提案する。
- EgoTactile: 一人称視点ビデオから日常物体の把持圧力を学習する触覚推定2026/6/8
一人称視点ビデオと全手の圧力データを組み合わせたベンチマークを構築し、拡散モデルを用いて視覚情報から把持圧力を推定する手法を提案した。
- StreamingVLA: アクションフローマッチングと適応的早期観察によるストリーミング型視覚言語行動モデルVLA2026/3/1
VLAモデルの推論遅延を、アクション生成と実行、観察を非同期に並列化するストリーミング方式で削減し、実行の流暢性を向上させた。
- SmoothSync: 量子化音声からのビート同期ジェスチャー生成のためのデュアルストリーム拡散トランスフォーマージェスチャー生成2026/1/1
量子化音声トークンとデュアルストリーム拡散トランスフォーマーを用いて、音声に同期した滑らかな全身ジェスチャーを生成する手法を提案。ジッター抑制損失と確率的音声量子化により、揺れや足滑りを抑えつつ多様なサンプリングを実現した。
- RLはVLAの汎化に何をもたらすか?実証研究VLA2025/5/26
VLAモデルの汎化性能を評価するベンチマークを構築し、RL微調整(特にPPO)がSFTより意味理解と実行頑健性を大幅に向上させることを示した実証研究。
- 非最適データからの連続制御学習:自己回帰ソフトQネットワーク強化学習2025/2/1
連続制御の強化学習において、Q値を粗から細への自己回帰的にモデル化し、非専門家のデモやオンラインデータなどの非最適データからでも効率的に学習できるARSQを提案した。
- 自己位置推定誤差がUAV飛行に与える影響の定量化UAVナビゲーション2024/3/1
UAVの最大安全飛行速度と自己位置推定誤差などのパラメータの関係をモデル化し、シミュレーションで検証した研究。