Ziyuan Liu
Huawei Heisenberg Research Center
収録論文 21本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VidAct: 物体中心の3D認識で野生動画からマニピュレーションを学習マニピュレーション2026/9/29
単眼の実世界動画から物体メッシュと運動を再構成し、残差軌道転移と物体中心の3D点群予測を組み合わせて、ゼロショットで実機展開可能なマニピュレーションポリシーを学習するフレームワーク。
- 3Dノイズの再考:最適化不要の形態学的摂動による3D認識ビデオ事前学習3D表現/ビデオ事前学習2026/9/3
3Dガウススプラッティングの各ガウスをピクセルとみなし、スケール・回転・枝刈りの摂動を加える最適化不要の正則化手法を提案し、疎な視点での3D表現のアーティファクトを軽減する。
- ゾーングラフパラダイムによる複雑な屋内シーン生成の空間意味論の統合シーン生成2026/5/1
複雑な非凸形状の屋内空間を生成するため、ゾーングラフという新しい表現と強化学習を組み合わせたフレームワークZoneMaestroを提案し、データセットとベンチマークも構築した。
- VideoWeaver: 身体化エージェントのためのマルチモーダル・マルチビュー動画間変換ビデオ生成2026/3/26
複数カメラの視点を共有4D潜在空間で整合させ、拡散モデルを用いて視点一貫性のある動画変換を実現する初のマルチビューV2Vフレームワークを提案した。
- ReMem-VLA: 二重レベル再帰クエリによる記憶を備えた視覚言語行動モデルVLA2026/3/1
視覚言語行動モデルに、フレーム単位とチャンク単位の再帰クエリを導入し、短期・長期記憶を実現。過去の観測予測を補助タスクとして追加し、記憶依存タスクで既存モデルを大幅に上回る性能を達成した。
- RecipeMasterLLM:大規模言語モデル時代にRoboEarthを再考するVLA2025/12/1
ユーザーの指示からRoboEarth標準知識グラフに沿ったOWL行動オントロジーを生成する高レベルプランナーを提案し、ファインチューニングしたLLMとRAGで環境知識を活用して行動記述を自動生成する。
- DRAW2ACT:深度エンコード軌道からロボット実演動画を生成動画生成2025/12/1
入力軌道から深度・意味・形状・動きの表現を抽出し、RGBと深度の動画を同時生成する拡散モデルを提案。生成動画から関節角度を回帰する方策も導入し、操作成功率を向上させた。
- 汎化可能な両腕マニピュレーションのベンチマーク:CVPR 2025 MEISワークショップにおけるRoboTwin両腕協調チャレンジマニピュレーション2025/6/1
RoboTwinシミュレーションと実機ロボットを用いた両腕マニピュレーションの国際コンペを開催し、17タスクで64チームが競い、汎化可能な協調方策の知見をまとめた。
- ハンドヘルド・ロボット搭載LiDARマッピングのための生涯3Dマッピングフレームワーク3Dマッピング2025/1/1
ハンドヘルドとロボット搭載の両方に対応し、動的点除去・マルチセッション位置合わせ・地図変化検出・地図バージョン管理を統合した生涯3Dマッピングフレームワークを提案。
- グラフ注意ネットワークを用いた意味グラフによるLiDARループ閉じ込み検出SLAM2025/1/1
LiDAR点群の意味グラフをグラフ注意ネットワークで符号化し、場所認識と意味的レジストレーションにより6自由度相対姿勢制約を推定するループ閉じ込み検出法を提案。
- ロボットエアホッケー選手権の回顧:実世界ロボティクスに向けた堅牢・信頼・安全な学習技術のベンチマークsim2real2024/11/1
NeurIPS 2023で開催されたロボットエアホッケー選手権を振り返り、sim-to-realギャップや安全性など実世界展開の課題をベンチマークし、学習と事前知識の組み合わせが有効であることを示した。
- Global Localization: Utilizing Relative Spatio-Temporal Geometric Constraints from Adjacent and Distant Cameras2023/12/1
- Implicit Learning of Scene Geometry from Poses for Global Localization2023/12/1
- Unseen Object 6D Pose Estimation: A Benchmark and Baselines2022/6/1
- Road Mapping and Localization using Sparse Semantic Visual Features2021/8/1
- OCRTOC: A Cloud-Based Competition and Benchmark for Robotic Grasping and Manipulation2021/4/1
- A Generalizable Knowledge Framework for Semantic Indoor Mapping Based on Markov Logic Networks and Data Driven MCMC2020/2/1
- Online Semantic Exploration of Indoor Maps2020/2/1
- Table-Top Scene Analysis Using Knowledge-Supervised MCMC2020/2/1
- Extracting Semantic Indoor Maps from Occupancy Grids2020/2/1
- Particle Filter Based Monocular Human Tracking with a 3D Cardbox Model and a Novel Deterministic Resampling Strategy2020/2/1