Jianing Qian
University of Pennsylvania
収録論文 11本 ・ フィジカルAI/ロボット学習
VLA模倣学習マニピュレーション物体中心表現
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- IMLE-VLA:Vision-Language-Actionポリシーのための高速単一ステップ行動生成VLA2026/9/10
拡散・フローマッチング型の反復サンプリング行動ヘッドをcIMLEによる単一ステップ生成器に置き換え、推論を最大3.67倍高速化しつつLIBEROで98.0%の成功率を達成したVLAポリシー。
- シーングラフによるロボット模倣学習の空間・時間的文脈拡張模倣学習2026/6/1
模倣学習にシーングラフを動的メモリとして用い、部分観測環境での長期的推論と汎化性能を向上させる手法を提案した。
- NovaPlan: 閉ループ動画言語計画によるゼロショット長期的マニピュレーションマニピュレーション2026/2/1
VLMと動画生成を組み合わせ、生成動画から物体キーポイントと人間の手の姿勢を抽出してロボット動作に変換する階層的フレームワークを提案。訓練や実演なしで長期的な組立作業やエラー回復を実現した。
- Maestro:視覚言語モデルでロボティクスモジュールを統合するゼロショット汎用ロボットVLA2025/11/1
VLMコーディングエージェントが知覚・計画・制御モジュールを動的に組み合わせてプログラム的政策を生成し、ゼロショットで汎用ロボットを実現する手法を提案。
- 視覚運動制御のためのタスク指向階層的物体分解マニピュレーション2024/11/1
物体や部品ごとに表現を階層的に分解し、タスクに応じて組み合わせることで、模倣学習の効率と汎化性能を高める手法HODORを提案した。
- 汎用事前学習済みViTを物体中心シーンエンコーダとしてマニピュレーション方策に転用マニピュレーション2024/5/1
汎用の事前学習済みVision Transformerのアテンションから物体らしい領域を切り出し、追加学習なしで物体中心の埋め込み表現を生成するSOFTを提案し、マニピュレーション方策の性能を大幅に向上させた。
- 「何」と「どこ」の基盤モデルを組み合わせた物体中心表現によるロボティクス物体中心表現2024/4/1
セグメンテーションで物体の位置を特定し、事前学習済みモデルでその物体の特徴を記述することで、追加学習なしにロボット制御向けの物体中心表現を構築するフレームワークPOCRを提案。
- Fighting Fire with Fire: Avoiding DNN Shortcuts through Priming2022/6/1
- Keyframe-Focused Visual Imitation Learning2021/6/1
- Cloth Region Segmentation for Robust Grasp Selection2020/8/1
- A surgical system for automatic registration, stiffness mapping and dynamic image overlay2017/11/1