Jaehong Kim
収録論文 11本 ・ フィジカルAI/ロボット学習
強化学習/拡散ポリシーマニピュレーションVLAドメイン適応
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- QPILOTS: フローポリシーのための効率的なテスト時Qステアリング強化学習/拡散ポリシー2026/6/11
フローマッチングや拡散ポリシーを強化学習で最適化する際、推論時にノイズ除去プロセスをQ値の勾配で操縦する手法QPILOTSを提案し、オフラインからオンラインへのRLベンチマークで高い成功率を達成した。
- 敵対的協調型異種エージェント強化学習による巧みな両手キャッチ技能の学習マニピュレーション2025/2/1
投げるエージェントと両手で受けるエージェントを敵対的に競わせる異種エージェント強化学習で、多様な物体を両手で巧みにキャッチする技能を獲得させた研究。
- 空間認識インストラクションチューニング:視覚障害者を支援する盲導犬ロボットのためのデータセットとベンチマークVLA2025/2/1
視覚障害者支援の盲導犬ロボット向けに、3D空間の経路と周囲環境を理解させるSAITデータセットとSA-Benchを構築し、空間認識を強化したVLMが歩行案内で既存手法を上回ることを示した。
- 二重過程VLA:VLMを活用した効率的なロボットマニピュレーションVLA2024/10/1
二重過程理論に着想を得て、大規模VLMで高レベル推論を低頻度で行い、小型モデルでリアルタイム制御を担う階層的VLAフレームワークを提案し、推論速度とタスク成功率を向上させた。
- テーブルサービスにおける高速ドメイン適応のためのモデル比較ドメイン適応2024/3/1
レストランのテーブルサービス自動化に向け、食事中のテーブル状況を認識するベースモデルを構築し、少量の店舗データでサービス認識分類器を再学習する手法を検証・比較した。
- Design and Evaluation of an Uncertainty-Aware Shared-Autonomy System with Hierarchical Conservative Skill Inference2023/12/1
- Nonverbal Social Behavior Generation for Social Robots Using End-to-End Learning2022/11/1
- AIR-Act2Act: Human-human interaction dataset for teaching non-verbal social behaviors to robots2020/9/1
- ETRI-Activity3D: A Large-Scale RGB-D Dataset for Robots to Recognize Daily Activities of the Elderly2020/3/1
- Cut-and-Paste Dataset Generation for Balancing Domain Gaps in Object Instance Detection2019/9/1
- Robots Learn Social Skills: End-to-End Learning of Co-Speech Gesture Generation for Humanoid Robots2018/10/1