Автоматизация Doom с глубоким Q-обучением: реализация в Tensorflow
Изучим, как можно использовать Q-обучение для агента в классическом шутере от первого лица Doom, а также разберемся, что такое схема "состояние-действие-награда-действие-состояние" и как она работает.