agentscope-ai / agentscope-ai/Trinity-RFT
Reward function中的Reward Model应该在哪里初始化?
オープン
good first issue
- 主要言語
- Python
- スター
- 701
- フォーク
- 79
- 平均マージ
- 8時間 7分
- マージ済み PR(30日)
- 1
説明
Reward function中的Reward Model在哪里初始化是最好的呢;我目前是在workflow类下初始化的,但是它只能加载到cpu,然后推理打分时会非常非常慢,以至于超时报错
コントリビューションガイド
評価
この issue はまだ評価されていません。