- refactored learning function

- remove state_last, use state instead
- added episode history
This commit is contained in:
2024-06-11 09:00:41 +02:00
parent 73f59f25fc
commit 53e4d91ff8
4 changed files with 47 additions and 28 deletions
+2 -3
View File
@@ -10,7 +10,6 @@ class APlayer(object):
self.other_mark = 'X'
self.state = None
self.state_last = None
def set_debug(self, with_debug):
pass
@@ -22,10 +21,10 @@ class APlayer(object):
state.reshape(state.size)[move] = self.mark
return state
def reward(self, value):
def new_game(self):
pass
def new_game(self):
def end_game(self, reward):
pass
def has_won(self, state: np.array):