agentscope-ai / agentscope-ai/Trinity-RFT

Reward function中的Reward Model应该在哪里初始化?

Aperta
#312 2 commenti 0 reazioni 0 assegnatari Vedi su GitHub
good first issue
Lingua principale
Python
Stelle
701
Fork
79
Merge medio
8h 7m
PR unite (30g)
1

Descrizione

Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错

Guida per i contributori

Apri la guida per i contributori

Valutazione

Questa issue non è ancora stata valutata.

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.