Dongzhan Zhou
収録論文 12本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- VPTwin: 実機-シミュレーション-実機のビデオ予測によるロボットマニピュレーション計画マニピュレーション2026/9/27
実演からデジタルツインを再構築し、Isaac Simの複数ロールアウトを参照して実世界の未来映像を予測するReal-Sim-Real枠組みを提案し、物理的に妥当な予測でマニピュレーション計画を改善した。
- ProtoAct: ウェットラボのプロトコルを具現化ロボット動作へ変換するVLA2026/8/3
生物学のウェットラボ手順書を、状態を考慮したロボット実行可能な行動系列に変換するフレームワークを提案。手順の欠落や不整合を検出・修正し、JSON形式の関数系列にマッピングする。
- LabRobFail: 化学自動運転ラボにおけるロボット故障解析のベンチマークロボット故障解析2026/7/1
化学実験室の自動化ロボットの信頼性向上のため、制御・物理・意味レベルで故障を注入した2万以上の軌跡データと、故障検出・分類・回復指示などの評価指標を備えたベンチマークを構築し、専用VLMが高精度で故障を診断・回復できることを示した。
- BioVLN: 生物医学実験室における視覚言語ナビゲーションのためのシミュレーションプラットフォームナビゲーション2026/7/1
生物医学実験室のロボットが機器の操作可能な側面から安全に接近することを考慮した、視覚言語ナビゲーションのためのシミュレーションプラットフォームを提案した。
- LabVLA: 科学実験室における視覚言語行動モデルの基盤構築VLA2026/6/11
科学実験室向けのVLAモデルを開発し、シミュレーションデータ生成と2段階学習で実験プロトコルの実行を可能にした。
- Trans2Occ: 透明物体のボクセル占有推定と把持 - シミュレーションから実世界へマニピュレーション2026/6/1
単一RGB画像から透明物体のボクセル占有を直接予測し、シミュレーションで大規模学習したモデルを実ロボットに微調整なしで適用して把持を実現する枠組みを提案した。
- Pipette: ウェットラボロボットのための具現化シミュレーションプラットフォーム、ベンチマーク、およびデータ効率的な拡張フレームワークシミュレーション/データ拡張2026/6/1
ウェットラボ(生物医学実験)ロボットの学習を効率化するため、カスタマイズ可能なシミュレータ、編集可能なアセット、限られたデモから訓練データを増強するパイプラインを備えたプラットフォーム「Pipette」を提案した。
- BioProVLA-Agent: 生物学的実験室操作のための手頃でプロトコル駆動・視覚強化・閉ループ推論可能なVLA搭載具身マルチエージェントシステムVLA/マルチエージェント/実験室自動化2026/5/1
生物実験室の自動化を目的に、プロトコルを入力として、LLMによるサブタスク分解、VLMによる状態検証、VLAによる実行を閉ループで行う低コストなマルチエージェントシステムを提案した。透明な実験器具や反射などの視覚的擾乱に強いオンライン拡張手法も導入している。
- CoEnv: 構成環境による身体化マルチエージェント協調の推進マルチエージェント協調2026/4/1
実世界とシミュレーションを統合した構成環境を導入し、複数ロボットが協調して複雑な操作タスクを安全に実行するフレームワークCoEnvを提案した。
- エゴから世界へ:強化学習による身体化システムにおける協調的空間推論空間推論2026/3/1
複数のエージェントが異なる視点から環境を認識する問題を扱い、視覚言語モデルが視点を融合して空間推論を行うためのベンチマークE2Wと、強化学習を用いたフレームワークCoRLを提案した。
- AnyTouch 2: 動的触覚知覚のための汎用光学触覚表現学習触覚2026/2/1
大規模階層型触覚データセットToucHDを構築し、物体理解と力覚を伴う微細な動的知覚を統合する汎用触覚表現学習フレームワークAnyTouch 2を提案した。
- LabUtopia:科学実験エージェントのための高忠実度シミュレーションと階層的ベンチマークsim2real2025/5/1
実験室での科学作業を自動化する身体性エージェントの研究を進めるため、物理・化学反応を扱える高忠実度シミュレータ、多様な実験シーンの自動生成器、5段階の難易度を持つ階層的ベンチマークを統合したスイートを提案。