Propriétaire
bigscience-workshop
21 dépôts indexés · Voir sur GitHub
-
petals
🌸 Run LLMs at home, BitTorrent-style. Fine-tuning and inference up to 10x faster than offloading
Python · 10565 étoiles
-
promptsource
Toolkit for creating, sharing and using natural language prompts.
Python · 3034 étoiles
-
Megatron-DeepSpeed
Ongoing research training transformer language models at scale, including: BERT & GPT-2
Python · 1448 étoiles
-
bigscience
Central place for the engineering/scaling WG: documentation, SLURM scripts and logs, compute environment and data.
Shell · 1019 étoiles
-
xmtf
Crosslingual Generalization through Multitask Finetuning
Jupyter Notebook · 534 étoiles
-
biomedical
Tools for curating biomedical training data for large-scale language modeling
Python · 505 étoiles
-
t-zero
Reproduce results and replicate training fo T0 (Multitask Prompted Training Enables Zero-Shot Task Generalization)
Python · 463 étoiles
-
data-preparation
Code used for sourcing and cleaning the BigScience ROOTS corpus
Jupyter Notebook · 318 étoiles
-
lam
Libraries, Archives and Museums (LAM)
91 étoiles
-
data_tooling
Tools for managing datasets for governance and training.
HTML · 91 étoiles
-
multilingual-modeling
BLOOM+1: Adapting BLOOM model to support a new unseen language
Python · 75 étoiles
-
evaluation
Code and Data for Evaluation WG
Python · 42 étoiles
-
data_sourcing
This directory gathers the tools developed by the Data Sourcing Working Group
Python · 31 étoiles
-
metadata
Experiments on including metadata such as URLs, timestamps, website descriptions and HTML tags during pretraining.
Python · 29 étoiles
-
carbon-footprint
A repository for `codecarbon` logs.
Jupyter Notebook · 13 étoiles
-
Python · 11 étoiles
-
pii_processing
PII Processing code to detect and remediate PII in BigScience datasets. Reference implementation for the PII Hackathon
Python · 9 étoiles
-
ShadesofBias
Evaluation for Shades of Bias in Text
HTML · 9 étoiles
-
catalogue_data
Scripts to prepare catalogue data
Jupyter Notebook · 8 étoiles
-
5 étoiles
- 1 autre dépôt se trouve sur Voir sur GitHub
-
bigscience-workshop/interpretability-ideas#1 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#2 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#3 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#4 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#5 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#6 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#7 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#8 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#9 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/interpretability-ideas#10 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
good first issue
bigscience-workshop/training_dynamics#1 · 4 commentaires · 0 réactions · 1 personne assignée ·
-
bigscience-workshop/training_dynamics#2 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
good first issue
bigscience-workshop/training_dynamics#3 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
good first issue
bigscience-workshop/training_dynamics#4 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
good first issue
bigscience-workshop/training_dynamics#6 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/training_dynamics#7 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/training_dynamics#8 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/training_dynamics#9 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/training_dynamics#10 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
Set up infrastructure to isolate specific layers or groups of layers in the network for probing Ouverte
bigscience-workshop/training_dynamics#11 · 0 commentaires · 0 réactions · 1 personne assignée ·
-
Design initial probes Ouverte
bigscience-workshop/training_dynamics#12 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
Wiki-based dataset cleaning Ouverte
bigscience-workshop/catalogue_data#5 · 7 commentaires · 0 réactions · 0 personnes assignées ·
-
Repeated lines across examples Ouverte
bigscience-workshop/catalogue_data#6 · 3 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/catalogue_data#8 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
Catching crawling noise + ads Ouverte
bigscience-workshop/catalogue_data#9 · 6 commentaires · 0 réactions · 0 personnes assignées ·
-
S2ORC vs Arxiv vs PMC Ouverte
bigscience-workshop/catalogue_data#11 · 6 commentaires · 1 réaction · 0 personnes assignées ·
-
Add WMT to Full Benchmark OuverteMT
bigscience-workshop/evaluation#4 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
Add DiaBLa to Full Benchmark OuverteMT
bigscience-workshop/evaluation#5 · 5 commentaires · 0 réactions · 1 personne assignée ·
-
NLU
bigscience-workshop/evaluation#6 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
Add TyDiQA to Full Benchmark Ouvertemultilingual NLU
bigscience-workshop/evaluation#7 · 3 commentaires · 0 réactions · 0 personnes assignées ·
-
multilingual NLG
bigscience-workshop/evaluation#10 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
Add GEM MLSum to Full Benchmark Ouvertehelp wanted In-Progress NLG
bigscience-workshop/evaluation#11 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
NLG
bigscience-workshop/evaluation#13 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
In-Progress NLG
bigscience-workshop/evaluation#14 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
NLG
bigscience-workshop/evaluation#15 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
Add GEM ToTTo to Full Benchmark OuverteIn-Progress NLG
bigscience-workshop/evaluation#16 · 3 commentaires · 0 réactions · 1 personne assignée ·
-
Add GEM WebNLG to Full Benchmark OuverteIn-Progress NLG
bigscience-workshop/evaluation#17 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
Add GEM E2E to Full Benchmark OuverteNLG
bigscience-workshop/evaluation#18 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
Add CRD3 to Full Benchmark OuverteNLG
bigscience-workshop/evaluation#19 · 2 commentaires · 0 réactions · 1 personne assignée ·
-
multilingual NER
bigscience-workshop/evaluation#20 · 5 commentaires · 0 réactions · 0 personnes assignées ·
-
Add WikiANN to Full Benchmark Ouvertemultilingual NER
bigscience-workshop/evaluation#21 · 7 commentaires · 0 réactions · 0 personnes assignées ·
-
Add BLiMP to Full Benchmark OuverteIn-Progress linguistic_structure
bigscience-workshop/evaluation#22 · 5 commentaires · 0 réactions · 1 personne assignée ·
-
Add QA-SRL to Full Benchmark Ouvertelinguistic_structure
bigscience-workshop/evaluation#23 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
enhancement help wanted
bigscience-workshop/data_sourcing#5 · 1 commentaire · 0 réactions · 1 personne assignée ·
-
linguistic_structure multilingual
bigscience-workshop/evaluation#24 · 1 commentaire · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/data_sourcing#6 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
In-Progress linguistic_structure multilingual
bigscience-workshop/evaluation#25 · 2 commentaires · 0 réactions · 0 personnes assignées ·
-
bigscience-workshop/data_sourcing#7 · 0 commentaires · 1 réaction · 0 personnes assignées ·
-
Add LAMA to Full Benchmark OuverteIn-Progress linguistic_structure
bigscience-workshop/evaluation#26 · 6 commentaires · 0 réactions · 1 personne assignée ·
-
bigscience-workshop/data_sourcing#10 · 0 commentaires · 0 réactions · 0 personnes assignées ·
Affichage des 100 plus récents
Cette page ne liste que les entrées les plus récentes. Le filtre avancé contient l'inventaire complet, affiné par langage, difficulté et durée.