Enyu Zhao
収録論文 5本 ・ フィジカルAI/ロボット学習
VLAマニピュレーション
※arXiv著者名で収集。同姓同名の別人の論文が含まれる場合があります。
論文
- HRIBench:人とロボットのインタラクションにおけるリアルタイム人間知覚のための視覚言語モデルベンチマークVLA2025/6/1
HRI向けの視覚言語モデルを評価するため、非言語的手がかりや指示理解など5領域・計1000問のVQAベンチマークを構築し、11モデルの性能と遅延を評価した。
- MOTIFハンド:熱・慣性・力センサを備えたマルチモーダル観測ロボットハンドマニピュレーション2025/6/1
LEAPハンドを拡張し、触覚・深度・熱カメラ・IMU・視覚センサを統合した低コストな多指ロボットハンドを開発。熱情報を用いた安全把持や、外観が同じで質量が異なる物体の識別を実現した。
- ManipBench:視覚言語モデルの低レベルロボット操作能力を評価するベンチマークVLA2025/5/1
視覚言語モデルが物体間の相互作用や変形物体の操作をどれだけ理解できるかを評価する新しいベンチマークManipBenchを提案し、33モデルをテストした。
- GPT-Fabric:事前学習済み基盤モデルを活用した布の平滑化と折り畳みマニピュレーション2024/6/1
GPTに布を掴んで引っ張る位置を直接出力させ、訓練なしで布の平滑化・折り畳みを実現する手法を提案し、シミュレーションと実機で有効性を示した。
- The Design and Realization of Multi-agent Obstacle Avoidance based on Reinforcement Learning2022/10/1