huggingface / huggingface/lighteval
[EVAL] Adding PHARE
Open
good first issue
help wanted
new-task
- Dominant language
- Python
- Stars
- 2.5k
- Forks
- 555
- Avg merge
- 1d 6h
- Merged PRs (30d)
- 1
Description
## Evaluation short description
Bias/hallucination eval
## Evaluation metadata
Provide all available
- Paper url: https://www.giskard.ai/knowledge/good-answers-are-not-necessarily-factual-answers-an-analysis-of-hallucination-in-leading-llms
- Dataset url: https://huggingface.co/datasets/giskardai/phare
Contributor guide
No contributing guide indexed for this repository
Assessment
This issue has not been assessed yet.