Jisoo Kim
収録論文 7本 ・ フィジカルAI/ロボット学習
拡散モデル/手と物体のインタラクション把持/データ収集器用操作群制御データセット/把持VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- JointHOI: 接触マップの同時生成による手と物体のインタラクション生成の強化拡散モデル/手と物体のインタラクション2026/7/2
テキストから手と物体のインタラクションを生成する際、接触マップを同時生成する単一ステージの拡散モデルを提案し、物理的整合性を向上させた。
- AutoDex: 器用な把持データ収集のための自動化実世界システム把持/データ収集2026/6/1
実世界で器用な把持の試行を自動的に収集するシステムを提案し、人手を介さずに候補把持の検証とデータベース構築を行い、テレオペレーションと比較して約4.8倍のスループット向上を実証した。
- ZeroDex: マルチビュー3D基盤VLM推論によるゼロショット長期的器用操作器用操作2026/6/1
キャリブレーション済みのマルチビューRGB画像から言語指示を3Dタスクプランに変換するゼロショットフレームワークを提案。VLMによる2Dキーポイントを多視点融合で3D化し、ピックアンドプレースやツール使用を含む長期的操作を未学習の物体・シーンで実行可能にする。
- OmniRobotHome: リアルタイム人機協調のためのマルチカメラ家庭プラットフォーム群制御2026/4/1
家庭内ロボットの認識性能が対人インタラクションの質を左右するという主張を検証するため、48台の同期カメラと3台のマニピュレータを備えた実環境テストベッドを構築し、認識性能を劣化させた際のインタラクション品質の低下を定量的に示した。
- HRDexDB: クロスエンボディメント巧みな把持のためのペア型ヒューマン・ロボットデータセットデータセット/把持2026/4/1
人間と多様なロボットハンドによる高忠実度の巧みな把持シーケンスをペアで収録したデータセットを構築し、クロスエンボディメント操作のベンチマークを提供した。
- Pri4R: 特権的4D表現で視覚言語行動モデルに世界の動力学を学習させるVLA2026/3/1
訓練時のみ特権的な4D情報を使い、3D点追跡を予測する軽量ヘッドをVLAに追加して世界の動力学を暗黙的に学習させ、推論時は元のアーキテクチャのまま高性能な操作を実現した研究。
- 人間の手のスキルをロボットマニピュレーションへ転移する学習マニピュレーション2025/1/1
人間の手の動作デモからロボットの巧みな操作を学習する手法を提案し、人間とロボットの身体差を埋めるため擬似教師データを用いた関節運動マニフォールドを学習した。