Propietario
bigscience-workshop
21 repositorios indexados · Ver en GitHub
-
petals
🌸 Run LLMs at home, BitTorrent-style. Fine-tuning and inference up to 10x faster than offloading
Python · 10565 estrellas
-
promptsource
Toolkit for creating, sharing and using natural language prompts.
Python · 3034 estrellas
-
Megatron-DeepSpeed
Ongoing research training transformer language models at scale, including: BERT & GPT-2
Python · 1448 estrellas
-
bigscience
Central place for the engineering/scaling WG: documentation, SLURM scripts and logs, compute environment and data.
Shell · 1019 estrellas
-
xmtf
Crosslingual Generalization through Multitask Finetuning
Jupyter Notebook · 534 estrellas
-
biomedical
Tools for curating biomedical training data for large-scale language modeling
Python · 505 estrellas
-
t-zero
Reproduce results and replicate training fo T0 (Multitask Prompted Training Enables Zero-Shot Task Generalization)
Python · 463 estrellas
-
data-preparation
Code used for sourcing and cleaning the BigScience ROOTS corpus
Jupyter Notebook · 318 estrellas
-
lam
Libraries, Archives and Museums (LAM)
91 estrellas
-
data_tooling
Tools for managing datasets for governance and training.
HTML · 91 estrellas
-
multilingual-modeling
BLOOM+1: Adapting BLOOM model to support a new unseen language
Python · 75 estrellas
-
evaluation
Code and Data for Evaluation WG
Python · 42 estrellas
-
data_sourcing
This directory gathers the tools developed by the Data Sourcing Working Group
Python · 31 estrellas
-
metadata
Experiments on including metadata such as URLs, timestamps, website descriptions and HTML tags during pretraining.
Python · 29 estrellas
-
carbon-footprint
A repository for `codecarbon` logs.
Jupyter Notebook · 13 estrellas
-
Python · 11 estrellas
-
pii_processing
PII Processing code to detect and remediate PII in BigScience datasets. Reference implementation for the PII Hackathon
Python · 9 estrellas
-
ShadesofBias
Evaluation for Shades of Bias in Text
HTML · 9 estrellas
-
catalogue_data
Scripts to prepare catalogue data
Jupyter Notebook · 8 estrellas
-
5 estrellas
- 1 repositorio más está en Ver en GitHub
-
bigscience-workshop/interpretability-ideas#1 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#2 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#3 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#4 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#5 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#6 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#7 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#8 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#9 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/interpretability-ideas#10 · 0 comentarios · 0 reacciones · 0 asignados ·
-
good first issue
bigscience-workshop/training_dynamics#1 · 4 comentarios · 0 reacciones · 1 asignado ·
-
bigscience-workshop/training_dynamics#2 · 1 comentario · 0 reacciones · 0 asignados ·
-
good first issue
bigscience-workshop/training_dynamics#3 · 1 comentario · 0 reacciones · 1 asignado ·
-
good first issue
bigscience-workshop/training_dynamics#4 · 1 comentario · 0 reacciones · 1 asignado ·
-
good first issue
bigscience-workshop/training_dynamics#6 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/training_dynamics#7 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/training_dynamics#8 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/training_dynamics#9 · 0 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/training_dynamics#10 · 0 comentarios · 0 reacciones · 1 asignado ·
-
Set up infrastructure to isolate specific layers or groups of layers in the network for probing Abierto
bigscience-workshop/training_dynamics#11 · 0 comentarios · 0 reacciones · 1 asignado ·
-
Design initial probes Abierto
bigscience-workshop/training_dynamics#12 · 0 comentarios · 0 reacciones · 0 asignados ·
-
Wiki-based dataset cleaning Abierto
bigscience-workshop/catalogue_data#5 · 7 comentarios · 0 reacciones · 0 asignados ·
-
Repeated lines across examples Abierto
bigscience-workshop/catalogue_data#6 · 3 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/catalogue_data#8 · 2 comentarios · 0 reacciones · 0 asignados ·
-
Catching crawling noise + ads Abierto
bigscience-workshop/catalogue_data#9 · 6 comentarios · 0 reacciones · 0 asignados ·
-
S2ORC vs Arxiv vs PMC Abierto
bigscience-workshop/catalogue_data#11 · 6 comentarios · 1 reacción · 0 asignados ·
-
Add WMT to Full Benchmark AbiertoMT
bigscience-workshop/evaluation#4 · 2 comentarios · 0 reacciones · 0 asignados ·
-
Add DiaBLa to Full Benchmark AbiertoMT
bigscience-workshop/evaluation#5 · 5 comentarios · 0 reacciones · 1 asignado ·
-
NLU
bigscience-workshop/evaluation#6 · 2 comentarios · 0 reacciones · 1 asignado ·
-
Add TyDiQA to Full Benchmark Abiertomultilingual NLU
bigscience-workshop/evaluation#7 · 3 comentarios · 0 reacciones · 0 asignados ·
-
multilingual NLG
bigscience-workshop/evaluation#10 · 1 comentario · 0 reacciones · 0 asignados ·
-
Add GEM MLSum to Full Benchmark Abiertohelp wanted In-Progress NLG
bigscience-workshop/evaluation#11 · 2 comentarios · 0 reacciones · 1 asignado ·
-
NLG
bigscience-workshop/evaluation#13 · 1 comentario · 0 reacciones · 0 asignados ·
-
In-Progress NLG
bigscience-workshop/evaluation#14 · 1 comentario · 0 reacciones · 0 asignados ·
-
NLG
bigscience-workshop/evaluation#15 · 0 comentarios · 0 reacciones · 0 asignados ·
-
Add GEM ToTTo to Full Benchmark AbiertoIn-Progress NLG
bigscience-workshop/evaluation#16 · 3 comentarios · 0 reacciones · 1 asignado ·
-
Add GEM WebNLG to Full Benchmark AbiertoIn-Progress NLG
bigscience-workshop/evaluation#17 · 2 comentarios · 0 reacciones · 0 asignados ·
-
Add GEM E2E to Full Benchmark AbiertoNLG
bigscience-workshop/evaluation#18 · 2 comentarios · 0 reacciones · 0 asignados ·
-
Add CRD3 to Full Benchmark AbiertoNLG
bigscience-workshop/evaluation#19 · 2 comentarios · 0 reacciones · 1 asignado ·
-
multilingual NER
bigscience-workshop/evaluation#20 · 5 comentarios · 0 reacciones · 0 asignados ·
-
Add WikiANN to Full Benchmark Abiertomultilingual NER
bigscience-workshop/evaluation#21 · 7 comentarios · 0 reacciones · 0 asignados ·
-
Add BLiMP to Full Benchmark AbiertoIn-Progress linguistic_structure
bigscience-workshop/evaluation#22 · 5 comentarios · 0 reacciones · 1 asignado ·
-
Add QA-SRL to Full Benchmark Abiertolinguistic_structure
bigscience-workshop/evaluation#23 · 2 comentarios · 0 reacciones · 0 asignados ·
-
enhancement help wanted
bigscience-workshop/data_sourcing#5 · 1 comentario · 0 reacciones · 1 asignado ·
-
linguistic_structure multilingual
bigscience-workshop/evaluation#24 · 1 comentario · 0 reacciones · 0 asignados ·
-
bigscience-workshop/data_sourcing#6 · 0 comentarios · 0 reacciones · 0 asignados ·
-
In-Progress linguistic_structure multilingual
bigscience-workshop/evaluation#25 · 2 comentarios · 0 reacciones · 0 asignados ·
-
bigscience-workshop/data_sourcing#7 · 0 comentarios · 1 reacción · 0 asignados ·
-
Add LAMA to Full Benchmark AbiertoIn-Progress linguistic_structure
bigscience-workshop/evaluation#26 · 6 comentarios · 0 reacciones · 1 asignado ·
-
bigscience-workshop/data_sourcing#10 · 0 comentarios · 0 reacciones · 0 asignados ·
Mostrando los 100 más recientes
Esta página solo lista lo indexado más recientemente. El filtro avanzado tiene el inventario completo, acotado por lenguaje, dificultad y duración.