NVIDIA ha lanzado ya la primera beta del kit de desarrollo de software CUDA, que podría permitir a un PC alcanzar enormes potencias de cálculo con un par de gráficas y una aplicación optimizada, de hecho, aseguran que con ese par de gráficas es posible alcanzar rendimientos típicos de los alcanzados hace diez años con 10.000 procesadores.
Permite acceder completamente a los 96/128 unidades de procesado de las 8800 y usar su enorme potencia de cálculo en coma flotante en todo tipo de aplicaciones y no sólo para gráficos. Se estima que una 8800 puede alcanzar los 512 GFLOP/s y que un SLI puede alcanzar un 1 TFLOP/s. Andy Keane, administrador general de productos de NVIDIA, asegura que será necesario tener conocimientos avanzados de programación y que un programador ocasional no podrá sacarle provecho a la gráfica. Afirma que CUDA está basado en el lenguaje C y que es el primer compilador en C para las GPUs.
NVIDIA explica que CUDA supera las limitaciones de la computación clásica en flujos extendiendo la GPU para que controle un amplio espectro de problemas exigentes matemáticos. Keane prosigue con la explicación comentando que las aplicaciones normales no le sacaran jugo, pero será útil para acelerar aplicaciones de modelos sísmicos, procesado de modelos financieros, dinámica de fluidos y simulaciones médicas, como de neuronas y cirugía en 3D. Todas estas aplicaciones suelen tardar un día entero en terminar los cálculos, ahora se podrán hacer en 15 minutos con la ayuda de CUDA.
De momento, tienen la limitación de que la precisión de sus cálculos de coma flotante es de 32 bits, precisión simple. NVIDIA tiene previsto sacar más adelante gráficas que tengan una precisión de 64 bits en coma flotante.