Zhen Zhao
収録論文 15本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- SOAR: ロボット移動フルフィルメントシステムにおける注文割り当てとロボットスケジューリングのリアルタイム統合最適化群制御2026/5/1
注文割り当てとロボットスケジューリングを統合的に扱う深層強化学習フレームワークSOARを提案し、実時間性と大域最適性の両立を図った。
- RoboAug: 領域対比データ拡張による単一アノテーションから数百シーンへのロボットマニピュレーションマニピュレーション2026/2/1
1枚の画像のバウンディングボックス注釈だけで生成モデルと領域対比損失を用いてデータ拡張を行い、ロボットマニピュレーションの汎化性能を向上させる手法を提案。
- RoboGene: 多様性駆動型エージェントフレームワークによる実世界タスク生成でVLA事前学習を強化VLA2026/2/1
多様で物理的に実現可能な操作タスクを自動生成するエージェントフレームワークを提案し、VLAモデルの事前学習データ収集を効率化して汎化性能を向上させた。
- RoboMIND 2.0:汎用身体知能のためのマルチモーダル両腕移動マニピュレーションデータセットマニピュレーション2025/12/1
6種類のロボットで集めた31万件超の両腕操作・移動マニピュレーション軌道(触覚・シミュレーション含む)を公開し、階層型VLM+VLAシステムMIND-2を提案した論文。
- XR-1: 統合視覚運動表現の学習による汎用視覚-言語-行動モデルVLA2025/11/1
視覚ダイナミクスとロボット運動を統合した離散潜在表現UVMCを二枝VQ-VAEで学習し、異種ロボットデータを横断する汎用VLAモデルXR-1を三段階学習で構築した研究。
- TeleopLab:遠隔実験室向けのアクセシブルで直感的なロボットマニピュレータ遠隔操作遠隔操作2025/9/1
スマートフォンからロボットアームと実験器具を操作できる遠隔実験システムを開発し、ユーザー研究で作業時間の短縮と高いユーザビリティを確認した。
- ArtVIP:ロボット学習のための視覚的リアリズム、モジュラー相互作用、物理的忠実性を備えた関節デジタルアセットsim2real2025/6/1
ロボット学習向けに、視覚的リアリズムと物理的忠実性を高めた関節物体のデジタルツインを多数収録したオープンソースデータセットArtVIPを構築し、模倣学習と強化学習で有効性を検証した。
- FreqPolicy: 周波数一貫性による効率的なフローベース視覚運動ポリシーVLA2025/6/1
フローベースの視覚運動ポリシーに周波数領域の一貫性制約を導入し、時間的連続性を保ちながら1ステップでの高品質な行動生成を可能にした手法。
- SwitchVLA: 実行状態を考慮したタスク切り替えが可能な視覚-言語-行動モデルVLA2025/6/1
実行中に指示が変わっても柔軟に対応できるVLAフレームワークを提案し、外部プランナーや専用データなしで滑らかなタスク切り替えを実現した。
- RoboMIND:ロボットマニピュレーションのためのマルチエンボディメント知能規範データセットマニピュレーション2024/12/1
4種類のロボットによる10.7万件の模倣学習用デモンストレーション軌道と失敗例、デジタルツイン環境を提供する大規模データセットを構築し、VLAモデルの性能を評価した。
- 大規模言語モデルに基づくインテリジェント工場向けマルチエージェント製造システムマルチエージェント製造2024/5/1
大規模言語モデルの推論能力を活用し、事前学習なしで動的に工場情報を分析して加工機械を選定するマルチエージェント製造システムを提案した。
- Learning from Imperfect Demonstrations with Self-Supervision for Robotic Manipulation2024/1/1
- SM$^3$: Self-Supervised Multi-task Modeling with Multi-view 2D Images for Articulated Objects2024/1/1
- DriveGPT4: Interpretable End-to-end Autonomous Driving via Large Language Model2023/10/1
- DTF-Net: Category-Level Pose Estimation and Shape Reconstruction via Deformable Template Field2023/8/1