Usar um modelo de linguagem para pontuar ou comparar resultados de outros modelos durante a avaliação.