Kimin Lee
収録論文 23本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboWorld: 汎用ロボットポリシー評価のための高速で信頼性の高いニューラルシミュレータシミュレーション/評価2026/7/1
ビデオワールドモデルを用いてロボットポリシーを評価する自動パイプラインを提案し、新しいStep Forcing手法で長期的なロールアウトの信頼性を高め、実世界評価と高い相関を達成した。
- 言語と自己中心視点の人間信号に基づく階層的ポリシーによる自然なヒューマンロボットインタラクションHRI2026/6/1
スマートグラスから得られる人間の視線やジェスチャーなどの非言語信号と言語指示を組み合わせてロボットを制御する階層的ポリシーを提案し、ユーザーの意図伝達の負担を軽減した。
- 単調な進捗を超えて:ロボット模倣のためのリトライ監視価値学習模倣学習2026/6/1
不完全なデモからリトライイベントを疎な監視として用い、誤りに敏感な価値関数を学習し、下流の行動クローニングの重み付けに活用するフレームワークを提案。実ロボット操作タスクで効果を実証。
- SPACE: クロスロボットデータからの学習による汎用ポリシーの実現ロボット学習2026/6/1
異なるロボット間で共通の動作表現としてカルテシアン状態差分を用い、ロボットの動特性の違いを適応させるフレームワークSPACEを提案し、汎用ポリシーの学習と展開を改善した。
- HABIT: ロボット操作のための人間認識行動とインタラクション訓練データセットデータセット/インタラクション2026/6/1
人間が存在する環境でのロボット操作のための大規模デモデータセットHABITを構築し、人間との協調・共有・指示の3役割でタスクを整理。人間存在データで訓練することで、人間認識行動が獲得できることを示した。
- WarmPrior: 時間的先験情報によるフローマッチングポリシーの直線化ロボット制御/生成モデル2026/5/1
ロボット操作タスクにおいて、ガウス分布の代わりに最近の行動履歴から構築した時間的先験分布を生成ポリシーのソース分布として用いることで、成功率が向上することを示した論文。
- クロスビュー関係から学ぶ多視点空間推論VLA2026/3/30
多視点の空間推論能力を高めるための大規模データセットXVRを構築し、視覚言語モデルを微調整して、対応付け・検証・位置特定のタスクで性能を向上させ、ロボット操作にも効果があることを示した。
- 量より質:データ中心ロボット学習のための影響関数によるデモンストレーションキュレーションデータキュレーション2026/3/1
デモンストレーション学習において、検証データへの損失削減への貢献度を影響関数で推定し、高品質なデータを選別する手法QoQを提案。シミュレーションと実環境で既存手法より高い性能を達成。
- DEAS: 行動系列を用いた分離価値学習によるスケーラブルなオフライン強化学習オフライン強化学習2025/10/1
行動系列を価値学習に活用し、価値の過大評価を分離学習で抑えることで、長期的タスクのオフライン強化学習や大規模VLAモデルの性能を向上させる手法を提案。
- 探索を温めよう:大規模言語モデルによる幾何学的タスク・動作計画の誘導タスク・動作計画2025/6/1
大規模言語モデルの常識を活用し、MCTSをウォームスタートすることで幾何学的タスク・動作計画を効率化する手法を提案。
- セグメント化されたデモンストレーションからのサブタスク認識型視覚報酬学習報酬学習2025/2/1
アクションなしの動画デモをサブタスクに分割し、その区間を正解報酬として密な報酬関数を学習するREDSを提案。複雑な操作タスクでベースラインを大きく上回り、未知タスクや異なるロボットへの汎化も示した。
- 動画からの潜在行動事前学習VLA2024/10/1
ロボットの行動ラベルなしでインターネット規模の動画からVLAモデルを事前学習する手法を提案し、実世界のマニピュレーションタスクで既存手法を上回る性能を示した。
- Promptable Behaviors: Personalizing Multi-Objective Rewards from Human Preferences2023/12/1
- Guide Your Agent with Adaptive Multimodal Rewards2023/9/1
- Preference Transformer: Modeling Human Preferences using Transformers for RL2023/3/1
- Multi-View Masked World Models for Visual Robotic Manipulation2023/2/1
- Controllability-Aware Unsupervised Skill Discovery2023/2/1
- Instruction-Following Agents with Multimodal Transformer2022/10/1
- Masked World Models for Visual Control2022/6/1
- Towards More Generalizable One-shot Visual Imitation Learning2021/10/1
- URLB: Unsupervised Reinforcement Learning Benchmark2021/10/1
- Skill Preferences: Learning to Extract and Execute Robotic Skills from Human Feedback2021/8/1
- Offline-to-Online Reinforcement Learning via Balanced Replay and Pessimistic Q-Ensemble2021/7/1