allenai/WildBench
Vedi su GitHubBenchmarking LLMs with Challenging Tasks from Real Users
- Stelle
- 256
- Fork
- 56
- Issue aperte per principianti
- 0
- Issue indicizzate
- 4
- Lingua principale
- Python
- Licenza
- Apache-2.0
- Ultimo push su GitHub
- 1/8/2024
- Ultima indicizzazione
- 13/9/2026
- Guida per i contributori
- Nessuna guida per i contributori
- Codice di condotta
- Nessun codice di condotta
- Label per principianti
- Nessuna label per principianti indicizzata
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
-
allenai/WildBench#19 · 0 commenti · 0 reazioni · 0 assegnatari ·
-
allenai/WildBench#20 · 0 commenti · 0 reazioni · 0 assegnatari ·
-
Human preference result Aperta
allenai/WildBench#21 · 0 commenti · 0 reazioni · 0 assegnatari ·
-
[ADD_MODEL] Apertaadd_model
allenai/WildBench#24 · 1 commento · 0 reazioni · 0 assegnatari ·