26 июля 2015 · Комментарий

Без заголовка

>Мы обсуждали, что если добавить аппаратуры и результаты RNN по генерации текста поставить под контроль reinforcement learning, то можно получить агента-спорщика (и функция вознаграждения/подкрепления тут -- выигрыш в споре путём логических аргументов и вскрытия логических ошибок соперника). А почему бы и нет?! Ну-ка ну-ка, и кто же, по вашему, будет определять каждый раз победителя двух агентов-спорщиков? Неужто опять без человека не обойтись? ;)

К записи · К обсуждению