Без заголовка
То, что распознавание речи существенно зависит от шумности и при шумах люди пока выигрывают -- это я понимаю. Но разрыв потихоньку уменьшается, неуклонно. Эти самые 6.3% года три назад казались несбыточной мечтой -- и вот они, уже.
Сейчас новая аппаратура подоспеет, новые данные, чуть добавится анализа семантики (в разных вариантах end-to-end learning) -- и всё ещё сдвинется.