> у меня получается по факту лучше, чем придумывать самому
Просто берем АльфаГо, и сопрягаем по-другому нейросетки и монте-карло. Делаем так, чтобы монте-карло вихреобразно-фрактально эволюционировал в нейросетках, которые по-хитрому связаны.
(А еще количество нейронов надо радикально увеличить)
P.S. Еще нужна распределенная система, нормализирующая амплитуду погодных изменений. Гасящая слишком сильный шторм (эпилепсию) или добавляющая случайный шум в штиль. Такой системой может быть банальная усталость нейрона/синапса, которая появляется при работе и проходит через некоторое время.
В такой системе будут происходить автоколебания. (Да-да, для формальных сеток слово "синпас" не очень подходит). Слабые синапсы, случайно задетые шумом шторма имеют шанс усилиться в случае получения подкрепления, а сильные ослабнуть при отсутствии подркрепления. Небольшое фоновое подкрепление должно быть просто за "количечество работы", т.е. за "нейроно-часы", чтобы просто стимулировать активность. Другое важное подкрепление - это "количество улыбок", которое вполне измеримо. Другими словами "общественная оценка". В-третьих, платная электронная еда.
P.P.S.
Инициализируем систему как биологического ребенка - делаем все синапсы сильными. Далее смотрим как система работает, как работает мультиагентная версия. Запускаем генетику, чтобы оптимизировать систему, подшлифовать.