Cloud-Code-AI / Cloud-Code-AI/BrowserEval

[Eval Results] llama-3.2-1b-instruct on smalleval/mmlu-nano:mmlu_high_school_physics.jsonl - 17.9% Accuracy

Open
#3 0 comments 0 reactions 0 assignees View on GitHub
Dominant language
TypeScript
Stars
2
Forks
3
PR merge metrics
No merged PRs in 30d

Description

## Evaluation Results

### Metadata
- **Dataset**: smalleval/mmlu-nano:mmlu_high_school_physics.jsonl
- **Model**: llama-3.2-1b-instruct
- **Evaluation Type**: evaluation

### Performance Metrics
- **Accuracy**: 17.9%
- **Total Questions**: 151
- **Average Latency**: 0.00ms
- **Tokens/Second**: 0.00
- **Memory Usage**: 883.29MB

### System Information
- **Browser**: chrome 131
- **OS**: MacIntel
- **CPU**: 10 cores
- **RAM**: 8GB
- **GPU**: Not Available
- **Timestamp**: 2025-01-21 05:36:25

[Evaluation Results Jan 21 2025 (2).json](https://github.com/user-attachments/files/18485253/Evaluation.Results.Jan.21.2025.2.json)

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.