Reinforcement-Learning Policy Evaluator

Evaluate a fixed finite-state policy by iterating its reward vector and policy-induced transition matrix.

Description

Evaluate a fixed finite-state policy by iterating its reward vector and policy-induced transition matrix.

References

  1. Markov decision process - Wikipedia
Don't forget to set a bookmark for tool.io!
Privacy | Imprint | Cookies