code-refactor / code-refactor/minicode
RL training
Offen
enhancement
exploratory
- Vorherrschende Sprache
- Python
- Sterne
- 9
- Forks
- 0
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
Longer term, we need to run RL experiments on minimization. This will require two things: 1. a good base policy 2. good RL code. We have to wait a bit for both.
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Bewertung
Dieses Issue wurde noch nicht bewertet.