afx-team / afx-team/UI-UX

模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解)的能力如何?

未关闭
#2 1 条评论 0 个 reaction 已指派 0 人 在 GitHub 查看
主要语言
Python
星标
31
派生
0
PR 合并指标
30 天内没有已合并 PR

描述

想吧这个模型用于 midscene 的视觉自动化测试流程里,强相关的能力为 模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解),ui-ux 模型在方面的能力如何?

贡献指南

打开贡献指南

评估

这个 Issue 还没有评估数据。

把新 issue 发到你的邮箱

精选适合新手参与的 GitHub issue 摘要。