Hai Zhang
収録論文 6本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA強化学習/汎化位置認識
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- χ₀: 分布の不一致を抑え込むリソース効率の良いロバストマニピュレーションマニピュレーション2026/2/1
人間のデモ分布・方策の帰納バイアス・実行時分布のずれを、重み空間マージやステージ適応型アドバンテージ推定、訓練-展開アライメントで解消し、限られた計算資源で双腕ロボットによる衣類の長期的操作を高信頼に実現した。
- スパース動画生成による実世界の視界外ビジョン言語ナビゲーションVLA2026/2/1
動画生成モデルを視界外ナビゲーションに初導入し、20秒先の未来をスパースに生成することでサブ秒推論を実現した手法SparseVideoNavを提案。
- 視点汎化可能なロボットマニピュレーションのための幾何学的3D視覚表現学習マニピュレーション2026/1/1
単視点の3D事前学習とマルチステップ蒸留により、多様なカメラ視点に汎化するマニピュレーション方策を学習するフレームワークを提案。
- KineDex: 触覚情報を取り入れた視覚運動ポリシーを運動感覚教示で学習する巧みな操作マニピュレーション2025/5/1
人間の手の動きを直接ロボットハンドに転送する運動感覚教示で触覚付きの実演データを収集し、触覚を統合した視覚運動ポリシーと力制御により接触の多い巧みな操作を実現した。
- 重要なものに集中:視覚ベース強化学習の汎化のための分離モデル強化学習/汎化2024/10/1
画像再構成を活用しつつ、タスク関連・無関連の表現を分離する2分岐モデルと一貫性損失で、未知環境への汎化性能を高める手法SMGを提案。
- CCTNet: 可動物体の遮蔽に対応するLiDAR位置認識のための円形畳み込みTransformerネットワーク位置認識2024/5/1
LiDARの位置認識において、円形畳み込みとTransformerを組み合わせて受容野を広げ、可動物体による遮蔽に頑健な軽量ネットワークを提案した。