Zehan Ma
収録論文 9本 ・ フィジカルAI/ロボット学習
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- RoboVista:多様なロボット応用のための視覚言語モデル評価VLM評価2026/7/1
ロボットの多様な応用における視覚言語モデル(VLM)の能力を評価するためのモジュール型フレームワークとベンチマークを提案し、実ロボット実験でその有効性を示した。
- MonoDuo: 1本のロボットアームで両腕ポリシーを学習するマニピュレーション2026/5/1
単腕ロボットのデモと人間の協調動作から、両腕ロボットの操作ポリシーを学習するフレームワークを提案。合成デモにより未見の両腕ロボット構成へのゼロショット転移を実現した。
- OXE-AugE: 異なるロボット形態間のポリシー学習を拡張するための大規模ロボットデータ拡張VLA2025/12/1
Open X-Embodimentデータセットに9種類のロボット形態を追加し、440万軌道以上に拡張するパイプラインを構築。多様なアームとグリッパーでの学習が未知のロボットへの汎化性能を高めることを示した。
- Omni-Scan: 双腕ロボットとガウススプラット統合による視覚的に正確なデジタルツイン物体モデルの生成3Dスキャン/デジタルツイン2025/8/1
双腕ロボットが物体を持ち替えながら回転させ、固定カメラで撮影した画像から3Dガウススプラットを生成し、グリッパーや背景を除去して360度のデジタルツインモデルを構築する手法を提案。部品欠陥検査に応用し、平均83%の精度で欠陥を検出できることを示した。
- Robo2VLM:大規模実世界ロボット操作データセットからの視覚的質問応答VLA2025/5/1
ロボットの実軌道データから操作フェーズを切り出し、空間・目標・相互作用推論のVQAデータセットを自動生成するフレームワークを提案し、VLMの評価・改善に有効性を示した。
- Blox-Net: VLM監督・物理シミュレーション・リセット付きロボットによるロボット組立のための生成的設計ロボット組立/生成的設計2024/9/1
自然言語プロンプトと部品画像から、VLMと物理シミュレーションを組み合わせてロボットが組み立て可能なアセンブリを自動生成するシステムを提案し、キリンなどの形状を高精度で再現しつつ実機で安定して組み立てられることを示した。
- 変形可能なガスケット組立の自動化マニピュレーション2024/8/1
変形するガスケットを狭い溝に位置合わせして押し込む組立作業に対し、模倣学習方策と3つの手続き的アルゴリズムを比較し、100回の実機試行で評価した。
- DROID: 大規模実環境ロボットマニピュレーションデータセットマニピュレーション2024/3/1
北米・アジア・欧州の50名が12ヶ月かけて564シーン・84タスクで収集した76k軌道・350時間のロボット操作データセットを構築し、学習ポリシーの性能と汎化性能が向上することを示した。
- Open X-Embodiment: Robotic Learning Datasets and RT-X Models2023/10/1