AI4Finance-Foundation / AI4Finance-Foundation/ElegantRL

AgentPPO中的explore_one_env

オープン
#56 コメント 1 件 リアクション 0 件 担当者 0 名 GitHub で見る
help_wanted
主要言語
Python
スター
4.4k
フォーク
978
PR マージ指標
30日以内にマージされた PR はありません

説明

请教下AgentPPO中的explore_one_env中的splice list 的作用是什么

` def explore_one_env(self, env, target_step):
traj_temp = list()

state = self.states[0]
last_done = 0
for i in range(target_step):
action, noise = [ary[0] for ary in self.select_actions((state,))]
next_state, reward, done, _ = env.step(np.tanh(action))
traj_temp.append((state, reward, done, action, noise))
if done:
state = env.reset()
last_done = i
else:
state = next_state
self.states[0] = state

'''splice list'''
traj_list = self.traj_list[0] + traj_temp[:last_done + 1]
self.traj_list[0] = traj_temp[last_done:]
return traj_list`

コントリビューションガイド

このリポジトリのコントリビューションガイドは索引されていません

評価

この issue はまだ評価されていません。

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。