Reducir la precisión numérica de los pesos del modelo para disminuir el costo de memoria e inferencia.