bigscience-workshop / bigscience-workshop/multilingual-modeling

Inconsistent Evaluation Results

Open
#17 0 comments 0 reactions 0 assignees View on GitHub
Dominant language
Python
Stars
75
Forks
17
PR merge metrics
No merged PRs in 30d

Description

I am getting different results by running training/eval together and separately.
Rerunning evaluation after training (by removing `--do_train`) gives me a better result than running training+eval together.

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.