模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解)的能力如何?
未关闭
- 主要语言
- Python
- 星标
- 31
- 派生
- 0
- PR 合并指标
- 30 天内没有已合并 PR
描述
想吧这个模型用于 midscene 的视觉自动化测试流程里,强相关的能力为 模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解),ui-ux 模型在方面的能力如何?
贡献指南
评估
这个 Issue 还没有评估数据。