Построение датасета и методология обучения, которые слегка по-разному развивались в разных семействах моделей, были унифицированы в единый каноничный, проверенный на утечки подход. Это снизило риск того, что две модели незаметно сравниваются по двум разным наборам правил.