agentscope-ai / agentscope-ai/Trinity-RFT

Reward function中的Reward Model应该在哪里初始化?

Aberta
#312 2 comentários 0 reações 0 responsáveis Ver no GitHub
good first issue
Linguagem predominante
Python
Estrelas
701
Forks
79
Merge médio
8h 7min
PRs com merge (30d)
1

Descrição

Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错

Guia de contribuição

Abrir o guia de contribuição

Avaliação

Esta issue ainda não foi avaliada.

Receba novas issues na sua caixa de entrada

Um resumo curto de issues do GitHub para quem está começando.