ailev.ru

20 марта 2016 · Комментарий

Без заголовка

Никогда не нужно забывать, что взлёт глубокого обучения стал возможен именно из-за повышения вычислительной мощности -- алгоритмы-то были уже известны Не совсем так. Бэкпроп и SGD были известны, да. А вот эффективные методы инициализации многослойных нейросеток - нет. А у нейросеток не все оптимумы одинаково полезны, т.е. абы как инициализированная нейросетка может и дотренится при большой выч мощи, но толку с этого может и не быть. Т.е. еще нужно заинициализроваться около хорошего локального минимума. Т.е. я так понял, что проблема была не в том, что не удавалось затренить сетку с более чем двумя скрытыми слоями, а что толку с этого не было. При этом SVM работали лучше вроде как. Ну и потом Хинтон, Бенджио с сотоварищами придумали как инициализировать многослойные сетки, так чтобы результат был лучше чем у сеток с одним-двумя скрытыми слоями. Т.е. выч мощь конечно не помешала и наверное даже весьма и весьма, но все же ключевая проблема была в методах инициализации глубоких нейросеток.

К записи · К обсуждению