Reinforcement-Learning Policy Evaluator
Evaluate a fixed finite-state policy by iterating its reward vector and policy-induced transition matrix.
Description
Evaluate a fixed finite-state policy by iterating its reward vector and policy-induced transition matrix.