Hongxin Zhang
University of Massachusetts Amherst
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- 自己適応型VLA:ロボット実運用のための堅牢な展開手法VLA2026/9/24
ハードウェアのずれに自己適応するVLAモデルを提案し、展開時のキャリブレーションなしで精度が要求される双腕・巧緻マニピュレーションタスクの性能を80%以上回復させた。
- GS-Agent: 生成シミュレーションによる4D物理世界の構築生成モデル2026/7/1
自然言語の記述から、物理的に妥当で動的な4D世界を自動生成するマルチエージェントフレームワークを提案した論文。
- センチネル:具現化された協調的空間推論と計画群制御2026/5/25
都市規模の屋外環境で複数の分散エージェントが自然言語で通信し、安全な待ち合わせ場所を協調して決定し、動的な哨戒を避けながら移動するためのフレームワークを提案した。
- RoboWits: ロボットの創造的問題解決における予期せぬ課題ベンチマーク2026/5/1
ロボットの認知推論と創造的ツール使用を評価するためのバイマニピュレータベンチマークを提案し、自動タスク生成パイプラインを用いて多様なタスクを作成。既存のVLAが変異タスクで性能が低下することを示した。
- バーチャルコミュニティ:人間・ロボット・社会のためのオープンワールド社会シミュレーション2025/8/1
人間とロボットが共存する社会をシミュレートするオープンソースのマルチエージェント物理シミュレータを構築し、コミュニティ計画とロボット協調の2つの課題を提案した。
- TesserAct: 4D身体化世界モデルの学習世界モデル2025/4/1
RGB-DN動画を生成するビデオモデルを微調整し、身体化エージェントの行動に応じた4Dシーン予測を可能にする世界モデルを提案。
- 3D-Mem: 身体性エージェントのための3Dシーンメモリ身体性AI2024/11/1
探索領域を多視点画像の「メモリスナップショット」として記憶し、未探索領域の「フロンティアスナップショット」も活用することで、身体性エージェントの探索と推論を向上させる3Dシーンメモリを提案した。
- 制約付き人間-AI協調:包摂的な身体性社会知能チャレンジ人間-AI協調2024/11/1
身体的制約を持つ人間を支援する身体性エージェントの社会知覚と協調計画を評価するベンチマークCHAICを提案し、LLMと行動モデリングを活用した手法を導入した。
- Building Cooperative Embodied Agents Modularly with Large Language Models2023/7/1