Chao Zhang
Tsinghua University
収録論文 13本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- H-VLA:キーアクション推論と運動計画を統合行動空間で行う階層型視覚-言語-行動モデルVLA2026/9/19
高レベルのキーアクション推論と低レベルの運動生成を分離し、統一されたカメラ中心行動空間でロボット操作を学習する階層型VLAフレームワークを提案。
- Zetta ζ: 自己進化する物理知能のための効率的な閉ループ具現化ハーネス具現化エージェント/自己進化2026/8/17
ロボットの実行中にコードベースの批評家と回復スキルをオンラインで進化させる閉ループハーネスを提案し、LIBERO-ProとRoboCasaで高い成功率と高速化を達成した。
- Co-VLA: 双腕ビジョン・ランゲージ・アクションシステムのための協調認識型構造化アクションモデリング双腕操作/VLA2026/6/1
双腕ロボット操作において、明示的な協調構造をVLAモデルに導入し、共有・残差潜在変数と制御器により信頼性と解釈可能性を向上させるフレームワークを提案した。
- Mem-World: 持続的なロボット操作のためのメモリ拡張型行動条件付きワールドモデルワールドモデル2026/6/1
手首カメラの動きや遮蔽により過去の情報が失われる問題を解決するため、4Dサーフェルインデックスメモリを導入し、幾何学的に履歴フレームを検索・活用する行動条件付きワールドモデルを提案した。
- UniTac: クロスセンサ触覚理解と生成のための統一マルチモーダルモデル触覚2026/6/1
触覚の理解と生成を統合する初の統一マルチモーダルモデルUniTacを提案し、物体特性の記述とセンサ識別のタスク、および再構成と整列の二段階学習により、複数センサにわたる現実的な触覚信号の生成を実現した。
- GNSS劣化環境下での経路制約に基づくMEMS/GNSS統合航法のロバスト融合推定位置推定2026/6/1
GNSS信号が遮断される環境で、高精細地図の経路と履歴軌跡を照合して擬似位置観測を生成し、拡張カルマンフィルタに組み込むことで、無人地上車両の累積位置ドリフトを抑制する手法を提案した。
- DAM-VLA: 動的行動モデルに基づくロボット操作のための視覚言語行動フレームワークVLA/マニピュレーション2026/3/1
VLMの推論と拡散ベースの行動モデルを統合し、タスクに応じて腕の移動とグリッパー操作を動的に切り替えるVLAフレームワークを提案。シミュレーションと実環境で高い成功率を達成した。
- 健康行動変容のための説得的ソーシャルロボット設計:行動変容戦略と評価手法の系統的レビューHRI2026/1/1
健康行動変容を促すソーシャルロボットのHRI研究39件を分析し、用いられた行動変容戦略を4カテゴリに整理するとともに、評価手法の特徴を明らかにして今後の研究方向を提案した。
- Open TeleDex:模倣学習ベースの巧みな操作のためのハードウェア非依存テレオペレーションシステムテレオペレーション2025/10/1
多様なロボットアーム・多指ハンド・入力デバイスに対応する統合テレオペレーションフレームワークを開発し、高精度なデモデータ収集を可能にした。
- 聴き・見・話し・行動する統合モデルELLSAVLA2025/10/1
視覚・テキスト・音声・行動を単一アーキテクチャで同時に知覚・生成する全二重エンドツーエンドモデルを提案し、対話と行動の割り込みや発話しながらの行動などを実現した。
- ロボットによる座りがちな行動の社会的制御:関係焦点戦略と目標焦点戦略の影響比較HRI/説得2025/2/1
社会的ロボットが健康行動変容を促す際の2種類の説得戦略(関係焦点型と目標焦点型)を比較し、関係焦点型がより長く活動を維持させることを実験で示した。
- LanGWM: Language Grounded World Model2023/11/1
- Alexa, play with robot: Introducing the First Alexa Prize SimBot Challenge on Embodied AI2023/8/1