Комментарий
>программировать на CUDA сложно, очень сложно. Если вы хотите "разогнать алгоритм на GPU", то за полдня работы вы это сделать не сможете.
Для этого у них есть OpenACC и компиляторы от PGI, там обычный код на C, плюсах или фортране размечается прагмами и становится параллельным. Там конечно не полдня работы, но разметить за неделю полной занятости типичное практическое приложение вполне можно. Нас (http://gwyddion.net) , например, единственное что останавливает, что у нас оно опенсорсное и поддерживается на куче legacy-систем вплоть до Ubuntu 10.04 ЕМНИП. Такой разметкой мало кто из целевой аудитории пока может воспользоваться и сделать так, чтобы можно было скомпилировать PGI быстрое приложение и при этом не ломать legacy gcc это несколько сложнее, чем просто сделать и отладить под один быстрый компилятор. Ну и у меня типичная рабочая машина сейчас это ультракомпактный настольный HP в форм-факторе небольшой книжки, в который зелёную видеокарту просто некуда ставить.