allenai/WildBench
Voir sur GitHubBenchmarking LLMs with Challenging Tasks from Real Users
- Étoiles
- 256
- Forks
- 56
- Issues débutants ouvertes
- 0
- Issues indexées
- 4
- Langage dominant
- Python
- Licence
- Apache-2.0
- Dernier push GitHub
- 1/8/2024
- Dernière indexation
- 13/9/2026
- Guide de contribution
- Aucun guide de contribution
- Code de conduite
- Aucun code de conduite
- Labels débutants
- Aucun label débutant indexé
- Métriques de merge des PR
- Aucune PR mergée en 30 j
-
allenai/WildBench#19 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
allenai/WildBench#20 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
Human preference result Ouverte
allenai/WildBench#21 · 0 commentaires · 0 réactions · 0 personnes assignées ·
-
[ADD_MODEL] Ouverteadd_model
allenai/WildBench#24 · 1 commentaire · 0 réactions · 0 personnes assignées ·