agentscope-ai / agentscope-ai/Trinity-RFT

Reward function中的Reward Model应该在哪里初始化?

未關閉
#312 2 則留言 0 個 reaction 已指派 0 人 在 GitHub 檢視
good first issue
主要語言
Python
星號
701
分支
79
平均合併
8 小時 7 分鐘
30 天內合併 PR
1

描述

Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错

貢獻指南

開啟貢獻指南

評估

這個 Issue 還沒有評估資料。

把新 issue 寄到你的電子郵件信箱

精選適合新手參與的 GitHub issue 摘要。