Симуляція Навчання з Підкріпленням

Симуляція Q-Learning алгоритму для навчання агента знаходити шлях до цілі