agentscope-ai / agentscope-ai/Trinity-RFT
Reward function中的Reward Model应该在哪里初始化?
Offen
good first issue
- Vorherrschende Sprache
- Python
- Sterne
- 701
- Forks
- 79
- Ø Merge
- 8 Std. 7 Min.
- Gemergte PRs (30 T.)
- 1
Beschreibung
Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错
Beitragsleitfaden
Bewertung
Dieses Issue wurde noch nicht bewertet.