Qin Jin
Renmin University of China
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- Ego2Robot: 自己中心視点の人間データからのスケーラブルなロボットデータ合成VLA2026/8/1
自己中心視点の人間の操作動画を、行動リターゲティングとロボットアームの視覚合成、品質キュレーションを経てロボット訓練データに変換するスケーラブルなパイプラインを提案し、大規模データセットでVLAモデルの汎化性能を向上させた。
- HRIBench:相互作用中心の人間ロボット協調のベンチマークHRI/ベンチマーク2026/7/1
人間とロボットの協調作業を評価するための新しいベンチマークを提案し、役割や時間的依存関係を明示したシナリオに基づいて、指示者・協力者・割り込み者の3つの役割を定義し、既存のVLAモデルが協調タスクで苦戦することを示した。
- GASE: ガウススプラッティングに基づく身体化シミュレーション環境再構築の自動化システムシミュレーション環境構築2026/6/16
パノラマカメラアレイを用いて環境を高速スキャンし、高品質な前景抽出とインペインティングを経て、物理シミュレータにそのまま使える高忠実度シーンを自動構築するシステムを提案した。実ロボット実験で、実データのみで訓練したポリシーとの性能差が10%未満であることを示した。
- EasyMimic:人間の動画からロボット模倣学習を低コストで実現するフレームワーク模倣学習2026/2/1
家庭用低コストロボットが、RGBカメラで撮影した人間の動画から3D手軌跡を抽出し、把持制御空間にマッピングして模倣学習する手法を提案。少量のロボットデータとの共同学習で新タスクに迅速適応し、高コストなデータ収集を削減する。
- 視覚-言語-行動モデルのスケーリング再考:アラインメント・混合・正則化VLA2026/2/1
VLAモデルのスケーリングを体系的に検証し、エンドエフェクタ相対の行動表現が異なる身体間の転移に重要である一方、異種ロボットデータの単純な混合は負の転移を招くことを示した研究。
- VLAモデルの信頼性指標としての輸送不一致VLA2025/12/1
フローマッチング型VLAモデルにおいて、観測特徴と行動表現間の輸送コストを信頼性指標として利用し、推論時に行動を反復修正する軽量プラグインDiGを提案した論文。
- Being-H0: 大規模人間動画からの視覚-言語-行動事前学習VLA2025/7/1
大規模な人間の動画を活用し、巧みな操作を可能にする視覚-言語-行動モデルを事前学習する手法を提案。物理指示チューニングにより、実世界のロボット操作への転移性能を向上させた。
- QuadrupedGPT:オープンエンド環境で活躍する万能四足ロボットエージェント歩行2024/6/1
大規模マルチモーダルモデルを活用し、人間の指示を理解して歩行とナビゲーションを統合しながら長期目標を分解・実行する四足ロボットエージェントを提案した。
- SPAFormer: Transformerによる逐次的な3Dパーツ組み立てマニピュレーション2024/3/1
3Dパーツ組み立てタスクにおける組み合わせ爆発を、組み立て順序の弱い制約とTransformerによる並列・自己回帰生成で解決するSPAFormerを提案し、21カテゴリの新ベンチマークPartNet-Assemblyで長期的組み立てへの優れた汎化性能を示した。