ailev.ru

22 декабря 2014 · Комментарий

Без заголовка

Это все замечательно, и я приветствую изменения к лучшему, но "наш мир нелинеен". Во-первых, в задачах распознавания не имеет значения "улучшилось на х%". Имеет значение "преодолелся ли порог целесобразности внедрения". С ошибкой 6,5% для речи - однозначно нет. Например, по моей памяти для OCR порог был где-то в районе 3% (файнридер третьей версии). Во-вторых, преодоление и улучшение порога - это тоже нелинейная задача. Каждый новый процент прироста дается значительно сложнее предыдущего. То есть относительно легко сделать распознавалку, которая прыгнет с нуля до ошибки в 30%, прыгнуть с 30% до 20% будет в разы сложнее, с 20% до 10% в разы сложнее, чем второй прыжок, и так далее по убывающей экспоненте. Именно из-за этого были есть и будут чересчур оптимистичные прогнозы. Так что рано радоваться. Хотя может выстрелить джокер - распознавание прыгнет сразу на много. То есть прогресс тоже идет нелинейно - скачками. Вопрос лишь в том, что скачки непредсказуемы и стохастичны...

К записи · К обсуждению