Без заголовка
>Мы обсуждали, что если добавить аппаратуры и результаты RNN по генерации текста поставить под контроль reinforcement learning, то можно получить агента-спорщика (и функция вознаграждения/подкрепления тут -- выигрыш в споре путём логических аргументов и вскрытия логических ошибок соперника). А почему бы и нет?!
Ну-ка ну-ка, и кто же, по вашему, будет определять каждый раз победителя двух агентов-спорщиков? Неужто опять без человека не обойтись? ;)