Q-Learning Пошук Шляху – Ступінь Дослідження
Симуляція Q-Learning алгоритму для навчання агента знаходити шлях до цілі
Запустити
Скинути
Ступінь дослідження (epsilon):
0.2