Han Qi
収録論文 8本 ・ フィジカルAI/ロボット学習
マニピュレーション評価手法ロボットポリシー学習VLA姿勢推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboMP-DINOv2: フィルタではなくプロンプトでロバストなロボットマニピュレーションマニピュレーション2026/9/22
マスクを視覚フィルタではなく空間プロンプトとして扱うDINOv2ベースの全シーン視覚エンコーダを提案し、外観変化や clutter 下での操作成功率を向上させた。
- X4Val: 分散低減型ポリシー評価のためのニューラルサロゲート学習評価手法2026/6/1
実世界データが乏しい中で、シミュレーションや過去のログなどの多様な補助データを活用し、実世界の性能指標を高信頼に推定するための分散低減フレームワークX4Valを提案した。
- BEACON: ベストエフォート適応による生成ロボットポリシーのクロスドメイン共学習ロボットポリシー学習2026/5/1
豊富なソースドメインのデモと限られたターゲットドメインのデモを用いて、生成ロボットポリシーを効果的に訓練するための理論駆動型フレームワークを提案した。
- MoTVLA: 高速・低速推論を統合した視覚-言語-行動モデルVLA2025/10/1
事前学習済みVLMとドメイン専門家トランスフォーマーを組み合わせ、高速・低速の推論を統合してロボットの行動方策を学習するVLAモデルを提案。
- フォーカスによる構成:シーングラフに基づくアトミックスキルマニピュレーション2025/9/1
タスクに関連する物体と関係に注目するシーングラフ表現を用いて、拡散ベース模倣学習によるスキルを学習し、VLMプランナーと組み合わせることで、長期的な操作タスクの構成的一般化とロバスト性を向上させた。
- 予測的世界モデルによる生成ロボットポリシーの推論時強化マニピュレーション2025/2/1
学習済み拡散ポリシーを再学習せずに、行動条件付き世界モデルで推論時にオンライン計画を行い、操作タスクの性能を向上させる手法GPCを提案。
- 制御指向の視覚潜在表現クラスタリングVLA2024/10/1
模倣学習における視覚表現空間が制御に有用なクラスタ構造を持つことを示し、それを正則化に用いることで性能を向上させた研究。
- CLOSURE: 姿勢不確かさ集合の高速定量化姿勢推定2024/3/1
学習したノイズを含む計測から6D姿勢推定の不確かさを定量化するため、姿勢不確かさ集合(PURSE)の最小包含測地線球を高速に内側近似するアルゴリズムCLOSUREを提案。