huggingface / huggingface/setfit
Sentence Pairs generation: is possible to parallelize it?
Open
question
- Dominant language
- Jupyter Notebook
- Stars
- 2.8k
- Forks
- 267
- Avg merge
- 36m
- Merged PRs (30d)
- 5
Description
My dataset has 20k samples, 200 labels, and 32 iterations, so that means around 128 million samples, right?
there's some way to parallelize the pairs sentences creation?
or at least to save these pairs to create one time and reuse multiple times (i.e. to train with different epochs)
Thanks
Contributor guide
No contributing guide indexed for this repository
Assessment
This issue has not been assessed yet.