This is especially relevant for the movies dataset, where we have 10 repeats
This is especially relevant for the movies dataset, where we have 10 repeats