Без заголовка
1) это именно FLOP а не FLOPs, оценка общей вычислительной емкости задачи.
2) RISK и многоядерные процессоры проигрывают графическим только числом, с вычислительной точки зрения они ничем не хуже. Для bigdata плавающая арифметика не нужна вообще, а для ИИ используется арифметика пониженной точности, обычно float32. В современных RISK она есть, там просто мало ядер. Nvidia берет дешевизной и кудой.
3) Сложные процессорные архитектуры для научных вычислений уже совсем не нужны: сейчас можно позволить себе считать хоть все с произвольной точностью, т.е. обрабатывать длинные числа не как числа, а как символьную строку.
4) Программировать на CUDA сложно, если нужно сделать параллельным уникальный алгоритм. Матричные же операции давно реализованы, разумеется, основные пакеты переключаются между CPU и GPU прозрачно для пользователя.