模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解)的能力如何?
Đang mở
- Ngôn ngữ chính
- Python
- Star
- 31
- Fork
- 0
- Chỉ số merge pull request
- Không có pull request nào được merge trong 30 ngày
Mô tả
想吧这个模型用于 midscene 的视觉自动化测试流程里,强相关的能力为 模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解),ui-ux 模型在方面的能力如何?
Hướng dẫn đóng góp
Đánh giá
Issue này chưa được đánh giá.