Без заголовка
Ну и производители красненьких видеокарт ответили тем, что заопенсорсили весь свой стек гетерогенных вычислений, только OpenCL мало кем поддерживался по сравнению с CUDA и для него промежуточных библиотек типа cuDNN нет. Плюс в современных опенсорсных компиляторах есть почти всё для поддержки того же OpenACC, есть генераторы кода из промежуточного представления в код вычислительных блоков в LLVM, есть зачаточная поддержка параллельных прагм, её нужно просто доделать.