Chen Zhao
Renmin University of China
収録論文 14本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboHarn-Evo: 階層的物理知識を進化させ自己改善するロボットマニピュレーションマニピュレーション2026/9/29
物理的な試行錯誤からタスク知識と行動知識を階層的に蓄積・修正し、基盤モデルを更新せずにロボット操作の成功率を高めるフレームワークを提案。
- 相互作用中心モデリングによる2本指グリッパ操作の統一的クロスドメイン表現の実現マニピュレーション2026/9/25
2本指グリッパの共通構造をパラメータ化した抽象化で捉え、VLMとSAMで相互作用 triplet を推定し、Flow-Matching Transformerで7自由度動作を生成することで、異なるロボット間や視点間でのゼロショットsim-to-real転移を可能にした模倣学習手法。
- RoboRecover: 実行逸脱下におけるロボット方策の回復力ベンチマークベンチマーク2026/9/24
実行中の逸脱状態から元のタスクを回復する能力を評価するベンチマークを提案し、初期状態の性能が回復性能を決めないことを示した。
- JEPA-WAM: 共同埋め込み世界モデリングによる視覚-言語-行動ポリシーの学習VLA/世界モデル2026/8/1
事前学習済みV-JEPA空間に基づく潜在世界モデルを構築し、遷移予測と行動生成を共有予測器で結合することで、効率的かつ高精度なロボット制御を実現した。
- JoyNexus: VLAモデルのためのサービス指向マルチテナント後訓練VLA2026/7/17
VLAモデルの後訓練を効率化するため、マルチテナント対応の統合サービスを提案。訓練・推論・環境サービスを分離し、APIで提供することで、リソース利用の効率化とコスト削減を実現。
- 密な身体化チェーン・オブ・ソート監視による視覚言語行動モデルの訓練VLA2026/6/1
ロボット間の転移を改善するため、視覚言語モデルに密な身体化チェーン・オブ・ソート(ECoT)監視を導入し、推論時にはECoT生成をスキップできるデュアルストリームアーキテクチャのVLAモデルZR-0を提案した。
- アクション草案と検証:視覚言語行動モデルのための自己検証フレームワークVLA2026/3/1
拡散アクション専門家が複数のアクション候補を生成し、VLMが一回のフォワードパスでスコアリングして最適なものを選択する自己検証フレームワークを提案。シミュレーションと実世界で成功率を向上させた。
- OpenGaussian: 3Dガウシアンを用いた点レベルのオープンボキャブラリ理解3D理解2024/6/1
3Dガウシアンスプラッティングを基盤に、3D点レベルでのオープンボキャブラリ理解を実現する手法を提案。インスタンス特徴の3D一貫性学習と2段階コードブック、3D-2D特徴連携により、従来の2Dピクセルレベルの手法を超える性能を示した。
- Gaussian-LIC: LiDAR・慣性・カメラ融合によるリアルタイム写実的SLAMSLAM2024/4/1
LiDAR・IMU・カメラを密に融合し、Gaussian Splattingを用いてリアルタイムに写実的な3Dマップを生成するSLAM手法を提案。LiDAR未観測領域は画像の三角測量点で補完し、天空や露出変化もモデル化する。
- DVMNet++: 未知物体に対する相対姿勢推定の再考姿勢推定2024/3/1
未知物体の相対姿勢を、正解バウンディングボックスや回転仮説に頼らず、画像特徴と言語理解による検出とボクセルマッチングで単一パスで推定する手法を提案。
- 3D-Aware Hypothesis & Verification for Generalizable Relative Object Pose Estimation2023/10/1
- LocPoseNet: Robust Location Prior for Unseen Object Pose Estimation2022/11/1
- Fusing Local Similarities for Retrieval-based 3D Orientation Estimation of Unseen Objects2022/3/1
- Progressive Correspondence Pruning by Consensus Learning2021/1/1