InternLM / InternLM/InternLM-Math

Model evaluation on minif2f fails?

Aperta
#22 18 commenti 0 reazioni 0 assegnatari Vedi su GitHub
Lingua principale
Python
Stelle
550
Fork
39
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

When I evaluate InternLM2-Math-Plus-7b in minif2f through this code, it fails. The model only generates one line "Here is the predicted next tactic:" without any tactics. If I let the model continue generating until I get a tactic each time, I only get a pass rate 38.1% instead of 43.4%.

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Valutazione

Questa issue non è ancora stata valutata.

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.