← Пример очередного технологического прорыва: распознавание речи
Обсуждение
Читать и комментировать в ЖЖ ↗
Ага, причем бывает и так, что жизнь УЖЕ поменялась, а люди все продолжают говорить, что она поменяться не может - http://trurle.livejournal.com/1192320.html?thread=12701056#t12701056
Комментарий
Вау, и это в июле 2014! Я специально удержался от того, чтобы привести пример автомобиля без водителя: считал, что это уже общее место, и его давным-давно проехали (pun intended).
Но ты терпелив в диалогах, я б сорвался намного раньше )))
Комментарий
Я терпелив в общении с теми, кого считаю своими собеседниками, и вообще не общаюсь с теми, кого собеседниками больше не считаю :)
Комментарий
Комментарий
Справедливости ради - тебе там правильно говорят.
Самоедущий автомобиль существует пока что как демонстрационный образец, и не вполне ясно, действительно ли он решает задачу распознавания того, что вокруг. Если действительно они только сравнивают статическую картинку с текущей, то это - НЕ решание задачи, а обман, и даже ни разу не продвижение к решению.
Получается, что да - повозка вроде бы есть, но гештальт не закрыт.
Комментарий
И ты тоже?! o_0
Вы там все на каком глобусе живёте?!
http://www.engadget.com/tag/SelfDrivingCar/
Комментарий
Прочитай внимательно хотя бы описание технологии в википедии - http://en.wikipedia.org/wiki/Google_driverless_car#Technology
Гугль достиг успеха, поменяв задачу: они НЕ обеспечивают движение автомобиля в произвольной среде. Они строят траекторию по дорогам, известным с очень высокой точностью, и объезжают все, что появляется на дороге лишнего.
Комментарий
Это все замечательно, и я приветствую изменения к лучшему, но "наш мир нелинеен".
Во-первых, в задачах распознавания не имеет значения "улучшилось на х%". Имеет значение "преодолелся ли порог целесобразности внедрения". С ошибкой 6,5% для речи - однозначно нет. Например, по моей памяти для OCR порог был где-то в районе 3% (файнридер третьей версии).
Во-вторых, преодоление и улучшение порога - это тоже нелинейная задача. Каждый новый процент прироста дается значительно сложнее предыдущего. То есть относительно легко сделать распознавалку, которая прыгнет с нуля до ошибки в 30%, прыгнуть с 30% до 20% будет в разы сложнее, с 20% до 10% в разы сложнее, чем второй прыжок, и так далее по убывающей экспоненте. Именно из-за этого были есть и будут чересчур оптимистичные прогнозы.
Так что рано радоваться. Хотя может выстрелить джокер - распознавание прыгнет сразу на много. То есть прогресс тоже идет нелинейно - скачками. Вопрос лишь в том, что скачки непредсказуемы и стохастичны...
Комментарий
Я не понимаю, причём тут "произвольная среда"? Тебе шашечки или ехать? Меня совсем недавно один таксист возил довольно долго вокруг Куба Сколково, имея и карту, и собственные глаза, и звонки куда-то. А ещё один таксист полчаса примерно нарезал круги вокруг моего дома (у него чуток сбоил GPS, как оказалось -- никакое ручное управление и опросы окружающих ему не помогали. Впрочем, и мимо пункта назначения он тоже чуть не проехал, хорошо я вмешался: но я-то не за рулём был!). Мне плевать, какая там технология внутри: я понимаю, что через пять лет вполне вероятно у гуглемобилей будет уже серийный выпуск, и более чем вероятно, что они в этом деле не будут первыми. И я смогу свистнуть, автомобиль подъедет и отвезёт куда надо. Что при этом будет задействована какая-то специальная инфраструктура, да чёрт с ним. У сотовых телефонов тоже огромная инфраструктура, и ничего, звонят и передают данные.
Я показал тебе ленту новостей в этой сфере, в которой отметились практически все крупные машиностроители. Лидером, кстати, обещает стать Тесла (их не волнует слава Гугля, но у них максимальное хвастовство на эту тему), а рекорд скорости без пилота на гоночной трассе поставил сейчас Audio (хотя небольшая скорость -- 240км/час, но этого хватило, чтобы круг делать на пять секунд быстрее, чем с пилотом).
Технологий много, и поколения технологии быстро-быстро меняются (в том числе технологии распознавания изображений). И аппаратура тоже догоняет быстро-быстро. Так, Sharp разработало специальный автомобильный процессор, чтобы снизить объем аппаратуры -- специально для driverless auto.
Комментарий
Я, вроде, регулярно об этом пишу: появились эффективные алгоритмы deep learning.
Комментарий
Вот, кстати, вполне реальное изменение из последних: http://www.skype.com/translator
Комментарий
Мне, пожалуйста, шашечки.
Решаемая Гуглем задача не является задачей искуственного зрения (смотрим на твой исходный постинг и не видим родства, кстати).
Да, под это будет задействована улучшенная дорожная инфраструктура и ее оцифровка, ехать по лесной дороге такой автомобиль не сможет.
Итого, правы обе стороны - в реальном мире, как мы его знаем, безводителемобиль ездить сможет еще очень нескоро. В реальном мире, как он будет скорее всего развиваться, по улицам больших городов скоро только такие автомобили и будут ездить, а нынешним придется парковаться на окраине, чтобы им не мешать.
Комментарий
Да, это из этой же серии -- собрано в кучку огромное число относительно новых технологий.
Комментарий
У нас с тобой сильно различается понимание "реального мира", однако. А по лесным дорогам будет не автомобиль ездить, а BigDog какой-нибудь, ножками бегать.
Комментарий
Ещё про гугл-машинки http://theoatmeal.com/blog/google_self_driving_car
"At one point during the trip, we were attempting to make a right turn onto a busy road. Everyone’s attention was directed to the left, waiting for an opening. When the road cleared and it was safe to turn right, the car didn’t budge. I thought this was a bug at first, but when I looked to my right there was a pedestrian standing very close to the curb, giving the awkward body language that he was planning on jaywalking. This was a very human interaction: the car was waiting for a further visual cue from the pedestrian to either stop or go, and the pedestrian waiting for a cue from the car. When the pedestrian didn’t move, the self-driving car gracefully took the lead, merged, and entered the roadway. "
Комментарий
человек если не поймет, то знает когда переспросить
Комментарий
Так вроде как именно это реализовать проще простого - посто сравнить значения правдоподобности для двух топовых вариантов.
Комментарий
А вот тупой практический вопрос. Что нынче взять для диктовки на русском? Да и на английском... Всё что попадалось под руку - работает ужасно, ни о каких вот этих единицах процентов речь не идёт. Ладно бы у меня акцент был, так нет, много раз спрашивал за границей, говорят, отлично всё понятно...
Комментарий
Вот недавно вышло, тоже не работает? -- http://yandex.ru/promo/dictation
Комментарий
Попробовал. Ох, нет. Лучше я на Dragon Dictation продолжу сидеть.
Своё слово добавить у яндекса нельзя, да и просто распознавание у Dragon как-то эээ всё-таки терпимо. Тут - каждое третье слово неправильно вообще.
А, еще Privacy Protection заорал, что приложение читает адресную книгу и геолокацию. Я могу поверить в то, что адресная книга нужна для пополнения словаря по ней, но вот нет. Не может. И да, геолокация-то ему зачем? о_О.