Young Min Kim
Seoul National University
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- シーンリターゲティング:類推的転移による物体配置の学習シーン生成2026/9/29
異なる間取り間で意味的に一貫した物体配置をクラスタ単位で転移する手法を提案し、3D-FRONTで従来手法を上回る性能と実世界からシミュレーションへの転移などの応用を示した。
- 全手把持のためのリアルタイム力制御フレームワークマニピュレーション2026/9/24
触覚センサなしで手全体の接触を幾何学的に推定し、摩擦制約やアクチュエータ限界を考慮して接触力をリアルタイムに再計算することで、外乱下でも把持を維持・再把持できる制御系を実現した。
- POIL: 安定力学系を用いた点ベースのワンショット模倣学習模倣学習2026/9/24
物体の機能部位上の3D点群を共有表現として使い、1回の実演から軌道を転移しつつ、閉ループ制御で外乱や把持姿勢の変化に頑健に実行するワンショット模倣学習手法を提案。
- EgoForce: 拡散フォーシングによる頑健なオンライン自己中心視点動作再構築動作再構築2026/5/13
自己中心視点の映像から全身動作をオンラインで再構築する手法を提案。拡散フォーシングに基づく時間的非対称ノイズスケジュールで、ストリーミング入力に応じて逐次的にノイズを除去し、頑健かつリアルタイムな動作推定を実現。
- AnyCamVLA: 視点ロバストな視覚言語行動モデルのためのゼロショットカメラ適応VLA2026/3/1
カメラ視点の変化に弱いVLAモデルに対し、追加データや微調整なしで、テスト時の観測を訓練時のカメラ設定に合わせて仮想的に変換するゼロショット適応フレームワークを提案した。
- RoEL: イベントカメラによる堅牢な3Dライン再構成イベントカメラ/3D再構成2026/2/1
イベントカメラのデータからライン構造を安定的に抽出し、幾何学的コスト関数で3Dラインマップとカメラ姿勢を精緻化する手法を提案。多様なデータセットでマッピングと姿勢推定の性能を大幅に向上させ、マルチモーダルにも適用可能。
- Point2Act: マルチモーダルLLMの効率的な3D蒸留によるゼロショット文脈認識把持マニピュレーション2025/8/1
マルチモーダル大規模言語モデルを軽量な2D点レベル誘導に蒸留し、多視点集約で3D関連性場を構築することで、未見環境でも文脈に応じた把持位置を20秒以内に推定する手法を提案。
- 疎で柔軟なキージョイント制御によるモーション合成モーション生成2025/3/1
疎で柔軟なキージョイント信号から拡散モデルを用いて全身モーションを合成するフレームワークを提案し、多様なデータセットで有効性を示した。
- ハイブリッド潜在表現による汎用物理ベースキャラクタ制御物理ベースキャラクタ制御2025/3/1
連続潜在表現と離散潜在表現を組み合わせたハイブリッドな運動事前分布を構築し、物理シミュレーション上のキャラクタが多様な制御タスクを滑らかにこなせるようにした研究。
- MoDA: Map style transfer for self-supervised Domain Adaptation of embodied agents2022/11/1
- SGoLAM: Simultaneous Goal Localization and Mapping for Multi-Object Goal Navigation2021/10/1
- Self-Supervised Domain Adaptation for Visual Navigation with Global Map Consistency2021/10/1
- GATSBI: Generative Agent-centric Spatio-temporal Object Interaction2021/4/1