Metrik model bahasa yang mengukur seberapa terkejut model tersebut dengan token berikutnya yang sebenarnya.