agentscope-ai / agentscope-ai/Trinity-RFT
Reward function中的Reward Model应该在哪里初始化?
未关闭
good first issue
- 主要语言
- Python
- 星标
- 701
- 派生
- 79
- 平均合并
- 8 小时 7 分钟
- 30 天内合并 PR
- 1
描述
Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错
贡献指南
评估
这个 Issue 还没有评估数据。