Haozhuo Zhang
収録論文 4本 ・ フィジカルAI/ロボット学習
世界モデル/自律航法VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- DF$^3$: デコーダ不要の特徴予測による自律航法の世界モデリング世界モデル/自律航法2026/8/3
ビデオから未来の状態を予測する世界モデルにおいて、デコーダを使わずに潜在空間内で特徴を予測し、直接タスク出力を得る新しいフレームワークを提案した。
- PoseDiff: ロボット姿勢推定と動画から行動への制御を橋渡しする統合拡散モデルVLA2025/9/1
単一のRGB画像からロボットの3Dキーポイントや関節角度を推定し、さらに動画のキーフレームから長期行動列を生成する拡散モデルを提案。姿勢推定と逆動力学を一つの枠組みで統合した。
- LHM-Humanoid: 雑然とした環境での連続物体運搬のための長期的ヒューマンモーション制御マニピュレーション2025/8/1
物理シミュレーション上のヒューマノイドが、リセットなしで繰り返し物体を運ぶ長期的動作を実現するため、サイクル間の遷移を「回復可能性」として学習する手法を提案。
- FLIP: フロー中心の生成的計画による汎用マニピュレーション世界モデルマニピュレーション2024/12/1
画像フローを汎用行動表現として使い、フロー生成・動画生成・視覚言語価値モデルを組み合わせて長期的な操作計画を立案する世界モデルを提案した。