← Второй день матча IBM Watson
Обсуждение
Читать и комментировать в ЖЖ ↗
и ошибок почти не было, не как в первом раунде...
Комментарий
Цивилизация измененным лицом бежит пруду!
Комментарий
хорошо отыграли, и мужики держались до последнего. "спецвопрос" про дракулу я думал как раз ватсон завалит, а в принципе думаю можно несколько изменить вопросы чтобы такого преимущества не наблюдалось - джепарди всегда имела машинный привкус.
забавно что инженеры научили ватсона находить дейли даблс, но забыли учитывать ответы соперников. надо им теперь следующий гранд чаллендж подкинуть, есть у меня на примете.
Комментарий
Это всё очень круто, конечно, но конкретно с Jeopardy нехорошо получилось: Watson на кнопке выигрывал всё время, а в реакции соревноваться с компьютером всё-таки странно. :) Т.е. было бы интересно дать всем участникам полный список вопросов, дать по 10-15 секунд на вопрос каждому и посмотреть, сколько у них будет долларов после этого.
Комментарий
Вы неверно понимаете ситуацию: Watson отнюдь не всегда выигрывал на кнопке, и это хорошо видно. Соревнование ведь не в реакции, а в нахождении правильных ответов за ограниченное время: в скорости думания, а не в скорости нажатия на кнопку. Кнопка, по большому счёту, вообще мало волнует.
Комментарий
P.S. А ещё лучше, конечно, просто дать этим трём участникам пакет вопросов, соответствующий их уровню, а не набор кнопок.
Комментарий
Ну вот именно что в думании, а тут как раз чётко видно: на каждом втором вопросе Watson нажимает на нулевой секунде, а Кен беспомощно улыбается.
Комментарий
Это, заметим, шоу, а не олимпиада. Вы бы еще сказали, что ведущий их отвлекал, когда зачитывал вопросы -- они ведь всё одно их читали, а не слушали, все трое. И что отсутствие ушей у Ватсона было преимуществом.
Что хотите сказать-то? Или ваши комментарии к тому, что вы что-то хотите сделать? Напишите письмо организаторам соревнований, возмутитесь.
Комментарий
А что, трудно сообразить, что у Watson к этому моменту уже был готовый ответ на вопрос? Кен, замечу, вполне мог улыбаться из-за того, что у него к этому моменту ответа не было.
Напишите в спортлото, не стесняйтесь. Там, вероятно, не знают ваших аргументов.
Комментарий
P.S. На всякий случай объясню ситуацию: и Jeopardy, и её российская сестра «Своя игра» – это соревнование в реакции не меньше, чем соревнование в думании. Дело в том, что на кнопку нельзя нажимать сразу, подаётся сигнал, и нажатие до него считается фальстартом. В «Своей игре» сигнал подаётся в начале последнего (вслух сказанного) слова вопроса, как в Jeopardy, точно не знаю, но вероятно, что примерно так же. Естественно, хороший игрок к этому моменту уже ответил на лёгкий вопрос и просто ждёт сигнала. Поэтому подавляющее большинство дешёвых вопросов между опытными игроками – это именно соревнование в реакции, и если один игрок стабильно обыгрывает других на кнопке, он может хуже отвечать на сложные вопросы и всё равно выиграть.
Комментарий
Пожалуйста, не надо разговаривать со мной в таком тоне. Я действительно немало знаю и об искусственном интеллекте, и об интеллектуальных играх – так получилось, что здесь мои интересы пересекаются.
Что хотите сказать-то?
Я хочу сказать, что хотя Watson, безусловно, является прорывом в AI, эта конкретная демонстрация способностей Watson'а получилась неудачной. Хорошо видно, что он просто собрал все кнопки – и вообще не видно, было ли там много не-кнопок, на которые Watson мог ответить, а люди – нет. Демонстрация была бы гораздо убедительнее, если бы вопросы были непростыми для этого состава участников; очевидно, что для многократных чемпионов Jeopardy вопросы должны быть сложнее, чем для новичков.
Комментарий
Я еще три дня назад подробно изучил правила нажатия на кнопку, в Сети IBM давно выложила видео, где объясняет алгоритмы, которые управляют нажатием на кнопку со стороны Watson, и я уже три дня читаю разные разъяснения на эту тему. Изучите вопрос по первоисточникам, а затем уже высказывайте мнение.
Замечу, что на кнопке обычно выигрывал всегда Брэд -- именно этим он знаменит, а тут он пришел только третьим. Не в кнопке дело.
И последнее: все обсуждения в Сети сводятся к тому, что правила Jeopardy! не должны быть изменены, железка или не железка играет. Иначе это будет не Jeopardy!, а другая игра. Со всеми преимуществами реакций, думалок, особенностей произношения (ответы даются устно, и при ошибках произношения могут быть не засчитаны) и т.д. Это Jeopardy!, и любые рассуждения тут бессмысленны. Автомобиль выигрывает стометровку у человека, по правилам стометровок для человеков -- в этом суть демонстрации. Точка.
Комментарий
Я не возражаю против сути, я говорю, что пакет вопросов был неудачным, понимаете разницу? На этих вопросах Кену и Брэду было практически не о чем думать: либо Watson обыгрывал их на кнопке, либо (гораздо реже) они просто не знали ответа и понимали, что не знают ответа. Почти ни в одном вопросе не было нетривиальных логических шагов, над которыми требуется именно думать хотя бы на полсекунды дольше, чем читается вопрос. Таким образом, "соревнования в скорости думания", как Вы утверждали выше, совсем не получилось: получилось соревнование по большей части в нажатии на кнопку и по меньшей части в объёме знаний. Скорость же чтения+думания на этом пакете практически всегда превышала отведённый условиями соревнования минимум, и у Watson'а, и у обоих людей.
Вот, например, интересный ролик, где видна реальная скорость чтения+думания на jeopardy-style вопросах, причём не у великого Кена Дженнингса, а у простого российского подростка (натренированного, конечно). Чтобы померяться скоростью думания (т.е. чтобы время на чтение/слушание вопроса было пренебрежимо малым на фоне времени на думание), нужны совсем другие вопросы.
Комментарий
P.S. Но, конечно, уже то, что компьютер смог принять участие в этом соревновании по объёму знаний, получая на вход вопросы на естественном языке, – это огромный прорыв, тут никаких возражений.
Комментарий
Замечу, что на кнопке обычно выигрывал всегда Брэд -- именно этим он знаменит, а тут он пришел только третьим. Не в кнопке дело.
Да, кстати. Вообще-то это как раз подтверждает, что в кнопке дело: у Брэда отняли его главное оружие, и он пришёл третьим, всё логично.
Комментарий
Ну, я рад, что такие соревнования по факту приравнены к соревнованиям по бегу, прыгу, шахматам и прочим чисто физиологическим умениям. Интеллект -- он всё-таки не в скоростном нажатии на кнопку, или скоростных ответах на простые вопросы. Мальчик из ссылки по ролику ведь не умный, а шустрый. Не за это боремся.
Комментарий
Логично, его обыграли. Это и есть суть демонстрации: правила не изменились, а жизнь изменилась.
Комментарий
Ну так и я о том же: очередной бег/прыг покорился машине, ура, конечно, но интеллект тут только в естественном языке ввода, а дальше просто скорость реакции, которая у машины, конечно же, лучше. Хотя всем бы такое "только". :)
Комментарий
А ещё я о том, что легко можно было бы сделать демонстрацию гораздо убедительнее, если дать вопросы в том же стиле, но значительно сложнее. Тогда Кен и Брэд больше проигрывали бы не на кнопке, а по собственному незнанию. А Watson'у ведь всё равно, сложное знание в вопросе или простое, у него база знаний, небось, большая...
Комментарий
А вот нет, демонстрация как раз убедительная, включая скорость на кнопке. Все рекламные ролики IBM про приложения реального времени, где как раз скорость важна.
В последней игре был убедительный ответ на юридический вопрос. Это, кстати, тоже обсуждается: применения в юридической практике.
Очень убедительная демонстрация.
Я вот не знаю, как вы, а я сам потихоньку работаю в направлении, указываемом проектом IBM Watson (хотя подбираюсь к естественно-языковым задачам совсем с другой стороны, со стороны онтологий).
А "интеллектуальные игры" -- это те же стометровки и подъёмы штанги, или даже шахматы. С сегодняшнего дня по факту вышли из разряда интеллектуальных, остались просто играми. Для записей в книге рекордов Гиннеса, не для развития человечества.