Dohyun Kim
収録論文 8本 ・ フィジカルAI/ロボット学習
VLA生成モデル/アライメント空間グラウンディング耐故障制御/強化学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- PUBG Ally:音声対話型の具現化AIチームメイトVLA2026/9/24
PUBG: BATTLEGROUNDSでプレイヤーと音声でやり取りしながら自律的に行動するAIチームメイトを構築し、約3.9万セッションの実プレイデータで訓練・評価した研究。
- サンプルベース変分推論の償却による少数ステップ生成モデルのアライメント生成モデル/アライメント2026/5/26
生成器と参照分布へのサンプルアクセスのみで少数ステップ生成モデルを整列させる一般的な枠組みFAVを提案し、ロボット操作のポリシー整列と画像生成器の整列で有効性を示した。
- C2F-Space:視覚言語モデルを用いた粗から細への空間指示のグラウンディング空間グラウンディング2025/11/1
視覚言語モデルで空間指示を粗く推定し、スーパーピクセル化で領域を精緻化する粗から細への空間グラウンディング手法を提案し、ロボットのピックアンドプレースに応用した。
- オンラインTransformer適応を組み込んだ強化学習によるクアッドロータの耐故障制御耐故障制御/強化学習2025/5/1
Transformerでリアルタイムに潜在表現を推定し、未知の機体モデルにも再学習なしで適応できる強化学習ベースの耐故障制御フレームワークを提案し、アクチュエータ故障下で95%の成功率を達成した。
- 大規模言語モデルと知能ロボットの統合に関するサーベイVLA2024/4/1
GPT-3.5以降の大規模言語モデルをロボットのコミュニケーション・知覚・計画・制御に統合する研究を整理し、プロンプト設計の実践的ガイドラインを示したサーベイ。
- LINGO-Space: 言語条件付き空間の漸進的グラウンディングVLA2024/2/1
言語指示が指す空間を確率的に推定し、追加の指示に応じて逐次更新する手法を提案し、卓上操作や四足歩行ロボットのナビゲーションで有効性を示した。
- SGGNet$^2$: Speech-Scene Graph Grounding Network for Speech-guided Navigation2023/7/1
- Self-Driving like a Human driver instead of a Robocar: Personalized comfortable driving experience for autonomous vehicles2020/1/1