agentscope-ai / agentscope-ai/Trinity-RFT
Reward function中的Reward Model应该在哪里初始化?
未關閉
good first issue
- 主要語言
- Python
- 星號
- 701
- 分支
- 79
- 平均合併
- 8 小時 7 分鐘
- 30 天內合併 PR
- 1
描述
Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错
貢獻指南
評估
這個 Issue 還沒有評估資料。