Derek Ming Siang Tan
収録論文 5本 ・ フィジカルAI/ロボット学習
VLA群制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RL^2-VLA: テスト時スケーリングによる適応的RL潜在構成ステアリングと視覚言語行動モデルVLA2026/7/1
視覚言語行動モデルの性能低下を改善するため、オフラインRLで学習した軽量ポリシーをVLAの潜在表現に基づいて構成し、失敗が予測される時のみ介入する適応的推論時ステアリング手法を提案した。
- 拡散モデルによるマルチエージェント情報経路計画のためのエージェント意図群制御2025/12/1
拡散モデルを用いて非自己回帰的に長期軌道を生成し、強化学習で微調整することで、マルチエージェント情報経路計画を効率化する分散型フレームワークAIDを提案した。
- Search-TTA: 実環境での視覚探索のためのマルチモーダルテスト時適応フレームワークVLA2025/5/1
衛星画像とCLIPを活用した視覚探索において、探索中に不確実性重み付き勾配更新で予測を動的に修正するテスト時適応フレームワークを提案し、大規模生態データセットAVS-Benchで最大30%の性能向上を達成した。
- IR2: 断続的接続下でのロボット探査チームのための暗黙的ランデブー群制御2024/9/1
深層強化学習と注意機構を用いて、通信が疎で断続的な環境で複数ロボットが単独探査と情報共有のトレードオフを長期的に判断し、効率的に探査する手法を提案。
- 帯域制限下での分散マルチロボット探査のための特権強化学習と通信学習群制御2024/7/1
深層強化学習と特権学習を組み合わせ、ロボットが地図情報を固定長メッセージに圧縮して通信量を最大2桁削減しつつ、探査効率の低下を2.4%に抑える分散マルチロボット探査手法を提案した。