agentscope-ai / agentscope-ai/Trinity-RFT
Reward function中的Reward Model应该在哪里初始化?
Aberta
good first issue
- Linguagem predominante
- Python
- Estrelas
- 701
- Forks
- 79
- Merge médio
- 8h 7min
- PRs com merge (30d)
- 1
Descrição
Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错
Guia de contribuição
Avaliação
Esta issue ainda não foi avaliada.