Implementación y Optimización de Algoritmos Paralelos en CUDA: SAXPY, Scan y Renderizado

Este artículo aborda la implementación y optimización de tres problemas clásicos de computación paralela utilizando CUDA. El entorno de desarrollo utilizado consiste en una GPU RTX 3090 con el toolkit CUDA 12.2. Los ejercicios cubren operaciones vectoriales básicas, algoritmos de recorrido (scan) y un problema de renderizado gráfico que requier ...

Publicado el 9-19 07:17