code-refactor / code-refactor/minicode
RL training
オープン
enhancement
exploratory
- 主要言語
- Python
- スター
- 9
- フォーク
- 0
- PR マージ指標
- 30日以内にマージされた PR はありません
説明
Longer term, we need to run RL experiments on minimization. This will require two things: 1. a good base policy 2. good RL code. We have to wait a bit for both.
コントリビューションガイド
このリポジトリのコントリビューションガイドは索引されていません
評価
この issue はまだ評価されていません。