Jiaxi Zhang
収録論文 5本 ・ フィジカルAI/ロボット学習
ナビゲーションヒューマノイド/映像生成/ゼロショット3Dビジュアルグラウンディング運動プリオ/人型制御ヒューマノイド制御
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 視覚と言語によるナビゲーションの限界は何か?ナビゲーション2026/5/1
シミュレーションから実世界への展開で性能が低下するVLNエージェントの問題を解決するため、ステレオ視覚と目標位置の事前知識を用いたStereoNavを提案し、少ないパラメータとデータで最先端の性能を達成した。
- ロボット中心の映像合成による形態整合的な人型ロボットインタラクションヒューマノイド/映像生成/ゼロショット2026/3/1
人型ロボットの対話スキルを、ポリシー学習や人間の動作リターゲティングに頼らず、映像生成モデルでロボット自身の動作を合成し、そこから関節軌道を抽出して実行するゼロショット手法を提案した。
- UniGround: トレーニング不要のシーン解析によるユニバーサル3Dビジュアルグラウンディング3Dビジュアルグラウンディング2026/3/1
3Dシーン内の物体を自然言語記述で特定する3Dビジュアルグラウンディングにおいて、既存の候補生成と視覚情報のボトルネックを解決するゼロショットフレームワークUniGroundを提案した。
- 球面潜在運動プリオによる物理ベース人型ロボット制御運動プリオ/人型制御2026/3/1
物理ベースの人型ロボット制御のための新しい運動プリオ学習法を提案。追跡コントローラを球面潜在空間に蒸留し、情報損失なく安定したランダムサンプリングを実現する。
- 人間型ロボット制御の能力を拡張する反復閉ループ動作合成ヒューマノイド制御2026/2/1
物理ベースの人間型ロボット制御において、動作データを自動生成し反復的に難易度を高める閉ループフレームワークを提案。AMASSの約1/10のデータ量で失敗率を45%削減した。