Gim Hee Lee
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- どこに加わるべきか?言語誘導型目標予測によるロボットのグループ参加ソーシャルナビゲーション2026/9/23
自然言語で指定されたグループにロボットが参加するため、言語条件付きモデルでグループを特定し、人間の隊形事前分布を用いて社会的に適切な参加位置を予測する手法を提案した。
- Image2Sim: 生成的ニューラルシミュレータによる身体化ナビゲーションのスケーリングナビゲーション2026/7/1
実画像列から高品質なインタラクティブ環境を生成するニューラルシミュレータを提案し、大規模なナビゲーション訓練データを合成して実世界性能を向上させた。
- 把持可能性フィールドの学習による把持指向の非把持操作非把持操作2026/6/1
物体を特定の姿勢に整えるのではなく、把持成功率を最大化する姿勢へと導く非把持操作手法を提案。学習した把持可能性フィールドを報酬と終了条件に用いることで、シミュレーションと実機で物体を把持可能な状態へ安定して遷移させる。
- TriRelVLA: 汎化可能な身体化操作のための三者関係構造VLA2026/5/1
視覚言語行動モデルの汎化性を高めるため、物体・手・タスクの三者関係を明示的に表現し、関係性に基づいて行動生成を行うフレームワークを提案した。
- TeamHOI: 任意のチーム規模で協調的な人間-物体インタラクションを学習する統一ポリシー群制御2026/3/1
複数の人型エージェントが協力して物体を運ぶタスクを、チーム人数や物体形状に依存せず単一の分散ポリシーで実現するフレームワークを提案した。
- 障害物からエチケットへ:VLMに基づく経路選択によるロボットのソーシャルナビゲーションソーシャルナビゲーション2026/2/1
幾何学的な経路計画に微調整した視覚言語モデルによる社会的文脈の推論を組み合わせ、人間の活動や社会規範に配慮した経路をリアルタイムで選ぶロボットナビゲーション手法を提案した。
- D3D-VLP: 動的3D視覚言語計画モデルによる身体性グラウンディングとナビゲーションVLA2025/12/1
単一の3D視覚言語モデルとChain-of-Thoughtで計画・グラウンディング・ナビゲーション・質問応答を統合し、断片的な教師信号から相互補強的に学習する手法を提案。複数ベンチマークで最先端を達成。
- Active3D: 階層的不確かさ定量化による能動的高忠実度3D再構成3D再構成2025/11/1
不確かさを階層的に推定しながら次に見るべき視点を計画し、高精度な3D再構成を能動的に行うフレームワークを提案した。
- RiemanLine: 因子グラフ最適化のための3次元直線のリーマン多様体表現SLAM2025/8/1
平行線群の構造を活かし、3次元直線をリーマン多様体上で最小パラメータ化する手法を提案し、因子グラフ最適化に統合して姿勢推定と直線再構成の精度を向上させた。
- Dynam3D: 動的階層型3Dトークンによる視覚言語ナビゲーションのためのVLM強化VLA2025/5/1
RGB-D画像からCLIP特徴を3D空間に投影し、動的で階層的な3D表現を構築することで、視覚言語ナビゲーションにおける3D理解と長期記憶を向上させるモデルを提案した。
- FlexEvent: 動作周波数が変化する環境での柔軟なイベントフレーム物体検出イベントカメラ/物体検出2024/12/1
イベントカメラとRGBフレームを適応的に融合し、周波数に応じた微調整を行うことで、20Hzから180Hzまで様々な周波数で高精度な物体検出を可能にするフレームワークを提案。
- g3D-LF: 具現化タスクのための汎化可能な3D言語特徴フィールドVLA2024/11/1
大規模3D言語データセットで事前学習した3D表現モデルで、RGB-D画像から新規視点表現やBEVマップを生成し、多粒度言語でターゲットをクエリできる。未見環境への汎化とリアルタイム更新を実現し、VLNや物体ナビゲーション、状況付きQAで有効性を示した。
- Deblur e-NeRF: 高速・低照度環境下での動きぼやけイベントからのNeRF再構成NeRF/イベントカメラ2024/9/1
イベントカメラの動きぼやけを物理的に正確なピクセル帯域モデルでモデル化し、高速・低照度下でもぼやけの少ないNeRFを再構成する手法を提案。
- LiLoc: 適応的サブマップ統合と自己中心因子グラフを用いた生涯ローカリゼーションローカリゼーション2024/9/1
中央セッションと補助セッション間のマルチモーダル因子を活用し、適応的サブマップ統合と自己中心因子グラフで高精度かつタイムリーな生涯ローカリゼーションを実現するフレームワークを提案。
- Optimizing the Placement of Roadside LiDARs for Autonomous Driving2023/10/1
- Robust e-NeRF: NeRF from Sparse & Noisy Events under Non-Uniform Motion2023/9/1
- A General Framework for Lifelong Localization and Mapping in Changing Environment2021/11/1
- Relative Pose Estimation of Calibrated Cameras with Known $\mathrm{SE}(3)$ Invariants2020/7/1
- Robust Point Cloud Based Reconstruction of Large-Scale Outdoor Scenes2019/5/1
- Object Detection and Motion Planning for Automated Welding of Tubular Joints2018/9/1
- Project AutoVision: Localization and 3D Scene Perception for an Autonomous Vehicle with a Multi-Camera System2018/9/1