agentscope-ai / agentscope-ai/Trinity-RFT
Reward function中的Reward Model应该在哪里初始化?
Abierto
good first issue
- Lenguaje dominante
- Python
- Estrellas
- 701
- Forks
- 79
- Merge medio
- 8 h 7 min
- PR fusionados (30 d)
- 1
Descripción
Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错
Guía de contribución
Evaluación
Este issue todavía no se ha evaluado.