bigscience-workshop / bigscience-workshop/bigscience
Sharing the 1.3B-Pile@300B model
- Lenguaje dominante
- Shell
- Estrellas
- 1k
- Forks
- 102
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
The 1.3B-Pile@300B model is quite strong:
https://docs.google.com/spreadsheets/d/1CI8Q9RCblLRzUOPJ6ViqBmo284-8ojluQ-CmaEuhuv0/edit#gid=1295801165
lambada 0.6088 piqa 0.7160 hellaswag 0.5209 --> these are all better than gpt-neo 1.3B.
Could you share the model? Thank you.
Guía de contribución
Línea de trabajo
No se nombran archivos del repositorio, pruebas ni puntos de entrada; el issue solo proporciona un enlace de Google Sheets con resultados de benchmark y solicita que se comparta el modelo. Empieza revisando los resultados enlazados y determinando la vía de distribución prevista. «Terminado» no está definido porque no se especifican ningún mecanismo de entrega ni comprobaciones de aceptación.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Área
- machine-learning
- Tipo de issue
- Nueva funcionalidad
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Estado de actividad
- Estancado
- Claridad
- Necesita aclaración
- Aptitud para principiantes
- 25/100