Wentao Zhu
収録論文 8本 ・ フィジカルAI/ロボット学習
具現化エージェントVLAソーシャルAI自己認識/人型ロボットヒューマンロボットインタラクション姿勢推定
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 具現化エージェントのハーネスに向けて具現化エージェント2026/8/1
コーディングエージェントの成功を支える「ハーネス」の考え方を物理世界の具現化エージェントに拡張し、シーングラフと評価機構を備えたシステムTheaを提案した。
- ロボット行動表現のための意味的アンカリングVLA2026/7/1
VLAモデルの微調整で失われる意味構造を保つため、行動表現を意味多様体に固定するプラグアンドプレイ手法を提案し、実世界で最大+18.7%の成功率向上を達成した。
- 共鳴する心:心の理論を備えた閉ループソーシャルアバターソーシャルAI2026/6/4
認知推論とマルチモーダル生成を統合した閉ループデュアルエージェントフレームワークを提案し、心の理論による社会的推論と感情制御可能な動画生成を組み合わせて、リアルな対話と表情・反応を実現する。
- 自己と他者の区別を可能にする人型ロボットの固有感覚-視覚対応自己認識/人型ロボット2026/6/1
人型ロボットが、自己と他者を区別する能力を、ラベルや運動学モデルなしで固有感覚と視覚の対応から学習できることを示した論文。
- GazeVLA: ロボット操作のための人間の意図を学習するVLA2026/4/1
人間の視線を意図の代理として学習し、ロボット操作に転移するフレームワークを提案。大規模な人間データで事前学習し、少量のロボットデータで微調整することで、長期的・細かいタスクで高性能を達成。
- 人間の意図を考慮した適応的支援ロボットポリシーの学習ヒューマンロボットインタラクション2024/12/1
ロボットが人間の暗黙の選好を対話を通じて推論し、行動予測と効用関数推定により個別化された支援を実現するフレームワークを提案した。
- 未知の関節状態下でのリアルタイム全身ロボット姿勢推定姿勢推定2024/2/1
ロボットの関節角度などの内部状態が未知でも、RGB画像からカメラ・ロボット間の回転や関節パラメータ、キーポイント、ルート深度を単一のフィードフォワード推論でリアルタイムに推定するフレームワークを提案した。
- Test-Time Training for Deformable Multi-Scale Image Registration2021/3/1