Обсуждение

В архиве: 30 комментариев.

Читать и комментировать в ЖЖ ↗

Имя не сохранено · 15 марта 2016

Комментарий

Ну, судя по тому что AlphaGo был вроде-бы присвоен девятый дан, уже никак не вторичное (был? я уже никаким новостям не верю). Другой вопрос в том что это не исключает систематической ошибки. Насколько я понял из пересказов описаний пересказов, AlphaGo не справилась с перебором и сделала неверный ход, оказавшись перед этим в трудной ситуации.

Имя не сохранено · 15 марта 2016

Комментарий

Не получилось у Севоля найти уязвимое место робота. Тимо Белль когда с КУКА играл в пинг-понг, сообразил жульничать - давал мячи. требующие движения...

Анатолий Левенчук · 15 марта 2016

Комментарий

В этом и фишка, что там переборов нет. Это не шахматы, перебирать невозможно. Даны тут уже неважны, я думаю, что нужно делать квалификационную шкалу над данами (типа как даны на кю). Тоже интересно, человечество со сверхчеловеческими разрядами ещё не встречалось )))

Ответ на комментарий

Анатолий Левенчук · 15 марта 2016

Комментарий

Там кроме рекламы в пинг-понге не было ничего: http://spectrum.ieee.org/the-human-os/biomedical/diagnostics/latest-from-sxsw-why-the-tricorder-xprize-is-behind-schedule Ну, и про ловкость в механике всё понятно, железные люди будут ловкими из-за моторчиков. А вот ловкость в мозгах -- это совсем, совсем другой коленкор. Вот это признать почему-то тяжело, даже зная о существовании калькуляторов "Феликс".

Ответ на комментарий

Имя не сохранено · 15 марта 2016

Комментарий

кстати да, в реал-тайм стратегиях микро очень многое решает, все катапульты, из-под которых можно вывести отряд в разные стороны, становятся бесполезны.

Ответ на комментарий

Анатолий Левенчук · 15 марта 2016

Комментарий

Ну, там попахать нужно -- ведь давать картинку программе будут прямо в пикселях, а мышку двигать моторчиками по столу, как в случае IBM Watson и Jeopardy! сделали "нажиматель кнопки" ))) Но играми Atari они ведь уже лихо расправляются, невзирая на пиксели, расправятся и со StarCraft.

Ответ на комментарий

vvagr · 15 марта 2016

Комментарий

А точно ли игрок будет попиксельно получать информацию в СтарКрафт? В Го, интересно, с камеры шёл поток? Или всё же доска была с контактиками?

Ответ на комментарий

Анатолий Левенчук · 15 марта 2016

Комментарий

Везде особо оговариваются условия, приближающие к человеческим. Если канал приёма-передачи неважен, то и ладно. Если важен, то дают в оригинале. В старкрафте микроменеджмент через API это слишком большое преимущество было бы, об этом и ссылка. Кроме того это означало бы использование мода, а не нативной версии. Кроме того, в игры на Atari вполне себе играют как раз с распознаванием попиксельным, так что проблем не было бы. Ну. и в старкрафте важно движение самой карты, затемнения и всякое такое, что уравнивает игроков -- что вряд ли правильно берётся через API (API ведь для создателей модов, а не игроков).

Ответ на комментарий

Имя не сохранено · 16 марта 2016

Комментарий

Imperfect information - вроде, покер ещё в том году решили (ну, нечто похожее на).

Имя не сохранено · 16 марта 2016

Комментарий

It is important to note that these human vs. machine matches are a little bit unfair for the bots themselves, as they were designed to play in a tournament consisting of thousands of games, and as such the bots may be trying out risky strategies or tactics that they would not have chosen if designed to play in a shorter best-of-n type matchup where they may have implemented safer strategies.

Ответ на комментарий

Имя не сохранено · 16 марта 2016

Комментарий

ога) уже загуглил авторов, заинтересовало что они работают на основе Системной психофизиологии, области весьма интересной самой по себе

Имя не сохранено · 16 марта 2016

Комментарий

посмотрел подробнее - что там внутри АльфаГо. Как оказалось "ничего революционного"™, просто у людей дошли руки собрать вместе пару давно известных вещей (алгоритмы+железо в облаке) и запустить их вместе. И всё - 4:1 с первого подхода, уносите человека-профи. <<Совсем скоро мы опубликуем нашу работу и все наработки выложим в открытый доступ, так что если кто-то захочет сделать своего чемпиона Го (или еще больше улучшить нашего) - без проблем. (Передадите наш привет человеку-профи в следующем году)>> Чем-то напомнило АБС в Хищных вещах : "Между прочим, я слыхал, что Великий Дегустатор удалился от дел. На последнем Брюссельском конкурсе коньяков произошел грандиознейший скандал, который удалось замять с огромным трудом. Гран-при получает девиз «Белый Кентавр». Жюри в восторге. Это нечто небывалое. Это некая феноменальная феерия ощущений. Вскрывают заявочный пакет и — о ужас! Это синтетик! Великий Дегустатор побелел как бумага, его стошнило! Мне, между прочим, довелось попробовать этот коньяк, он действительно превосходен, но его гонят из мазутов, и у него даже нет собственного названия. Эй экс восемнадцать дробь нафтан, и он дешевле гидролизного спирта…"©

Имя не сохранено · 16 марта 2016

Комментарий

Насколько я понял авторов - с перебором у программы всё супер, проблема только с планировщиком этих переборов. При чём, смысл в том, этот планировщик заточен не на супер игру, а на "построение имитации человека-противника". Если эта имитация у него некорректная (не соответствствует его ходам), то он ее на ходу перестраивает. Что собственно и случилось, когда Ли Седоль начал делать "несвойственные ему" ходы - программа поменяла планировщик и тот выбрал переборы для противостояния "странному Ли Седолю", а не "обычному", и когда мастер начал снова играть хорошо - уже было поздно %)

Ответ на комментарий