Derek Briggs

Author directory

2026

Researchers claim to measure large language models. Measurement and evaluation differ epistemically: evaluation asks whether outputs are fit for use; measurement requires a pre-existing quantitative attribute. LLM variability is designed, not discovered; evaluate models, measure people. Critical AI literacy proves, in simulation, most measurable where AI is least capable.
Search
Co-authors
    Venues
    Fix author