Artikkelen ser på tre typer benchmarker: grove overslag for ytelse, evalueringer av KI-modeller og en sammenligning av bildekk, og viser hvor lett slike målinger kan gi et misvisende bilde.

Kilde: https://danluu.com/exercise-7/