Perplexity
A metric for language models derived from cross-entropy loss.
A metric for language models derived from cross-entropy loss. Measures how "surprised" the model is by the test data. Lower perplexity = better. It's the exponential of the cross-entropy loss.
A friendlier transform of loss: roughly "how many tokens was the model wavering between." Lower is better. (M03)