Aoran Mei
収録論文 3本 ・ フィジカルAI/ロボット学習
マニピュレーションVLA
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- U-DiTポリシー:ロボットマニピュレーションのためのU字型拡散トランスフォーマーマニピュレーション2025/9/1
U-Netの多スケール特徴融合とTransformerの大域的文脈モデリングを組み合わせたU字型拡散トランスフォーマーを提案し、シミュレーションと実機のマニピュレーションタスクで既存手法を上回る性能と汎化性を示した。
- ReplanVLM:視覚言語モデルによるロボットタスクの再計画VLA2024/7/1
視覚言語モデル(VLM)を用いたロボットタスク計画において、実行エラーを内部・外部の誤り訂正機構と再計画戦略で修正するフレームワークを提案し、実機とシミュレーションで成功率と頑健性を向上させた。
- GameVLM:視覚言語モデルとゼロサムゲームによるロボットタスク計画の意思決定フレームワークVLA2024/5/1
GPT-4Vなどの視覚言語モデルを複数エージェントで活用し、ゼロサムゲーム理論で計画の不一致を解消することで、ロボットのタスク計画の意思決定を強化するフレームワークを提案した。実機実験で平均83.3%の成功率を達成。