Aryaman Gupta
収録論文 7本 ・ フィジカルAI/ロボット学習
VLA世界モデルロボット失敗分析sim2real
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 推論が行動を助けるとき:視覚-言語-行動ポリシーにおける思考連鎖の監視と誘導VLA2026/9/30
VLAポリシーの思考連鎖を途中で監視・誘導するTRUSTを提案し、運転タスクでは衝突率を削減したが、操作タスクでは行動改善に限界があることを示した。
- Cosmos 3: 物理AIのための全モーダル世界モデルVLA2026/6/1
言語、画像、動画、音声、行動を統一的に扱う全モーダル世界モデルを提案し、理解・生成タスクでSOTAを達成した。
- 物理AIのための動画基盤モデルによる世界シミュレーション世界モデル2025/11/1
テキスト・画像・動画から世界を生成する動画基盤モデルCosmos-Predict2.5と、Sim2Real/Real2Real変換を行うCosmos-Transfer2.5を発表し、ロボティクス向けの合成データ生成やシミュレーションを可能にした。
- 実運用ログからの失敗分類体系の教師なし発見ロボット失敗分析2025/6/1
ロボットの失敗ログを視覚言語モデルで構造化し、その意味空間でクラスタリングすることで、操作・ナビゲーション・自動運転における再発する失敗モードを教師なしで抽出する手法を提案した。
- 到達可能性解析による視覚ベース制御器の安全性とロバスト性の向上sim2real2024/10/1
視覚ベース制御器の故障モードをニューラル到達可能チューブで探索し、オンライン監視とオフライン再訓練でシステム安全性を高める手法を提案。航空機の地上走行タスクで検証した。
- VTOL-UAVの洋上着陸におけるSim-to-Real方策転移のための深層強化学習sim2real2024/6/1
VTOL型ドローンの洋上ドッキングを接近フェーズと着陸フェーズに分割し、着陸フェーズを深層強化学習で学習、波浪モデルで汎化性を高めて実機転移を目指した研究。
- Detecting and Mitigating System-Level Anomalies of Vision-Based Controllers2023/9/1