模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解)的能力如何?
未關閉
- 主要語言
- Python
- 星號
- 31
- 分支
- 0
- PR 合併指標
- 30 天內沒有已合併 PR
描述
想吧这个模型用于 midscene 的视觉自动化测试流程里,强相关的能力为 模型的元素定位(Locate)Visual Grounding、VQA(数据提取、断言与页面理解),ui-ux 模型在方面的能力如何?
貢獻指南
評估
這個 Issue 還沒有評估資料。