allenai/WildBench
Auf GitHub ansehenBenchmarking LLMs with Challenging Tasks from Real Users
- Sterne
- 256
- Forks
- 56
- Offene Anfänger-Issues
- 0
- Indexierte Issues
- 4
- Vorherrschende Sprache
- Python
- Lizenz
- Apache-2.0
- Letzter GitHub-Push
- 01.8.2024
- Zuletzt indexiert
- 13.9.2026
- Beitragsleitfaden
- Kein Beitragsleitfaden
- Verhaltenskodex
- Kein Verhaltenskodex
- Anfänger-Labels
- Keine Anfänger-Labels indexiert
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
-
allenai/WildBench#19 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
allenai/WildBench#20 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
Human preference result Offen
allenai/WildBench#21 · 0 Kommentare · 0 Reaktionen · 0 zugewiesene Personen ·
-
[ADD_MODEL] Offenadd_model
allenai/WildBench#24 · 1 Kommentar · 0 Reaktionen · 0 zugewiesene Personen ·