Una metrica del modello linguistico che misura quanto il modello è sorpreso dai veri token successivi.