Also known as: State action Value Function
A state-action value function estimates the expected return from taking a specific action in a specific state and then following a policy. In reinforcement learning, it is commonly known as a Q-function.
Synonym for Q-function.