Also known as: Tabular Q learning
Табличное Q-learning — метод обучения с подкреплением, который хранит Q-values в таблице для каждой пары состояние-действие. Он подходит для сред с дискретными и управляемыми по размеру пространствами состояний и действий.
In reinforcement learning, implementing Q-learning by using a table to store the Q-functions for every combination of state and action.