bigscience-workshop / bigscience-workshop/bigscience
Sharing the 1.3B-Pile@300B model
- Vorherrschende Sprache
- Shell
- Sterne
- 1k
- Forks
- 102
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
The 1.3B-Pile@300B model is quite strong:
https://docs.google.com/spreadsheets/d/1CI8Q9RCblLRzUOPJ6ViqBmo284-8ojluQ-CmaEuhuv0/edit#gid=1295801165
lambada 0.6088 piqa 0.7160 hellaswag 0.5209 --> these are all better than gpt-neo 1.3B.
Could you share the model? Thank you.
Beitragsleitfaden
Rechercherichtung
Es werden keine Repository-Dateien, Tests oder Einstiegspunkte genannt; das Issue enthält lediglich einen Google-Sheets-Link mit Benchmark-Ergebnissen und fordert dazu auf, das Modell zu teilen. Beginne damit, die verlinkten Ergebnisse zu prüfen und den vorgesehenen Verteilungsweg zu bestimmen. „Erledigt“ ist nicht definiert, da kein Bereitstellungsmechanismus und keine Abnahmekriterien angegeben sind.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Bereich
- machine-learning
- Issue-Typ
- Feature
- Schwierigkeit
- 5/5
- Geschätzter Aufwand
- Über eine Woche
- Aktivitätsstatus
- Veraltet
- Klarheit
- Muss geklärt werden
- Anfängerfreundlichkeit
- 25/100