Also known as: Q function
Q-функция — это функция обучения с подкреплением, оценивающая ожидаемую отдачу от выбора определенного действия в определенном состоянии с последующим следованием политике. Она также известна как функция ценности состояния-действия.
In reinforcement learning, the function that predicts the expected return from taking an action in a state and then following a given policy. Q-function is also known as state-action value function.