6 октября я свела в одну таблицу Artificial Analysis, Arena, Epoch AI, ARC Prize, METR и SWE-bench. Единого лидера нет. Зато видно, почему вопрос «какая модель лучше» почти всегда задан неправильно и что спрашивать вместо него, если вы выбираете ИИ для команды.