Топ-30 в Google — миф или обязаловка для нейросетей? Разбираюсь на цифрах
Привет, это Ксения REBEL, и сегодня я разбираю миф про топ-30
Если вы читаете GEO-гайды (GEO — Generative Engine Optimization, оптимизация для генеративных ИИ-систем вроде ChatGPT или Perplexity, в отличие от классического SEO под Google), вам наверняка попадалась фраза: «чтобы вас цитировала нейросеть, сайт должен быть в топ-30 выдачи Google». Я решила покопаться в исследованиях 2025-2026 года и понять, правда ли это до сих пор. Спойлер: нет, но нюансы важны, поэтому разберём по порядку.
Откуда вообще взялась цифра «топ-30»
Миф не выдуман на пустом месте. В конце 2025 года компания Originality.AI, которая специализируется на детекции ИИ-контента, провела исследование и нашла: 9 из 10 цитирований в AI Overviews (это блоки с ИИ-ответом прямо в поисковой выдаче Google) приходятся именно на топ-30 позиций, а страница на первом месте имеет 58% шанс попасть в такую цитату (оригинал исследования). Похожую картину подтвердила seoClarity: 97% AI Overviews цитируют хотя бы один источник из топ-20.
Именно эти цифры перекочевали во все обучающие материалы по GEO/AEO (AEO — Answer Engine Optimization, оптимизация под «поисковики-ответчики»), включая русскоязычные. Проблема одна: это снимок ситуации на конец 2025 года, а не вечное правило. За несколько месяцев всё поменялось.
А что происходит сейчас, в 2026-м
В вот что. Ahrefs (одна из самых авторитетных SEO-аналитических компаний в мире) проверила 863 000 запросов и 4 миллиона URL из AI Overviews в марте 2026 года. Результат: доля цитируемых страниц из топ-10 упала с 76% в июле 2025 года до всего 38% сейчас. Почти треть всех цитирований (31%) теперь достаётся страницам, которые вообще не входят в топ-100 по запросу.
Ещё более жёсткое исследование Ahrefs (1 млн ключевых слов, 1,9 млн ссылок-цитирований) вывело математическую связь: коэффициент корреляции Спирмена между позицией в Google и вероятностью цитирования ИИ — всего 0,347. Для понимания: это слабая связь, а не жёсткая зависимость. Даже страница на первом месте в Google попадает в топ-3 цитирований AI Overview только в половине случаев.
Тренд однозначный: связь между вашей позицией в поиске и тем, цитирует ли вас ИИ, стабильно ослабевает. Для ChatGPT ситуация вообще другая: около 12% процитированных URL пересекаются с топ-10 Google, а примерно 80% страниц, которые цитирует ChatGPT, вообще не входят в топ-100 по исходному запросу.
Почему так происходит: три причины простыми словами
Причина 1: ИИ ищет не так, как обычный поиск. ИИ-системы делают так называемый query fan-out — это когда система разбивает ваш вопрос на несколько подвопросов и ищет ответ на каждый отдельно. Например, если вы спросили «какой ноутбук выбрать для монтажа видео», система может отдельно искать «лучшие процессоры для видеомонтажа», «объём оперативной памяти для рендера» и так далее. Страница, которая глубоко отвечает на один такой подвопрос, может процитироваться, даже если она вообще не ранжируется по главному запросу. Страницы, которые попадают и в основной запрос, и хотя бы в один подвопрос, получают 51% всех цитирований.
Причина 2: модель смотрит на структуру текста, а не на позицию в выдаче. Исследование на 10 000 запросов сравнило 14 факторов по силе связи с вероятностью цитирования. Сильнейшим предиктором оказалась разметка FAQPage schema (это специальный технический код на странице, который явно помечает блоки «вопрос-ответ» для поисковых систем) — коэффициент корреляции 0,61, выше даже, чем авторитетность самого домена (0,54) (подробности исследования).
Причина 3: источники цитирования — вообще другие сайты. Свежий и очень масштабный индекс цитирований (680+ миллионов цитат из шести независимых исследований) показывает: лидеры цитирований — Reddit (около 40% совокупной доли), Wikipedia (26-48% у ChatGPT), YouTube, LinkedIn и Forbes (полный индекс источников). Ни один из них не участвует в классической борьбе за топ-30 по вашим коммерческим запросам — это отдельная вселенная.
А что там с DeepSeek ?
Отдельно хочу выделить DeepSeek (китайская модель, набирающая популярность), потому что она цитирует иначе, чем все остальные. Habr разобрал это в свежем техническом расследовании: DeepSeek живёт на новостных ресурсах и пресс-релизах — TMCnet, MarketScreener, GlobeNewswire, отраслевые B2B-новостники, а также технической документации и developer Q&A вроде Stack Overflow (разбор на Habr). Причём он единственный из крупных моделей стабильно цитирует китайские источники.
Отдельное исследование PresenC подтверждает: DeepSeek слабо опирается на живой веб-поиск и сильно — на обучающие данные, поэтому в его цитатах много кода, технической документации (19%) и arXiv-статей (11%), а новостей и общего веба заметно меньше, чем у ChatGPT или Perplexity (подробнее). По данным Profound, DeepSeek в среднем ссылается на 29 источников на безбрендовый запрос — против примерно 8 у ChatGPT. То есть он не «экономит» на источниках, но выбирает их по совсем другой логике: авторитетность, технологичность, структура.
Что реально работает — рабочий список
- Разметка FAQPage schema на всех информационных страницах — сильнейший измеримый предиктор цитирования
- Зрелость сущности (entity maturity) — насколько хорошо заполнена карточка в Wikidata, есть ли согласованная Schema-разметка и связи sameAs между профилями. Коэффициент связи с цитированием — 0,67, сильнее позиции в Google
- Открытый доступ для ИИ-краулеров — без этого вас просто не увидят Perplexity или ChatGPT Browse
- Обновление контента не реже раза в 90 дней — особенно критично для Perplexity
- Заголовки в форме вопроса с прямым ответом сразу под заголовком
- FAQ-блоки с чёткими вопросами и короткими ответами — их модели цитируют целиком
- Активность на Reddit и отзовиках (G2, Capterra, Trustpilot) — крупнейший источник цитирований по брендовым запросам
Обновлённая таблица по платформам
Даже самый цитируемый домен на любой платформе редко превышает 5% от всех цитирований — концентрация умеренная, шанс есть у многих.
Мой вывод
Ранжирование в Google — это ещё не бесполезно, но уже точно не билет в один конец. Страница в топ-10 всё ещё весьма заметна среди цитирований относительно своей доли в вебе, так что подниматься в выдаче стоит. Но это давно не необходимое и не достаточное условие — треть цитирований в 2026 году приходит со страниц за пределами топ-100.
Моя практическая стратегия: не гнаться за позицией как самоцелью, а параллельно закрывать четыре ключевых фактора (соответствие теме, наличие цены, свежесть даты обновления, позиция в списке), укреплять зрелость сущности через Wikidata и Schema-разметку, и писать так, чтобы каждый абзац отвечал на конкретный вопрос в первых 40-60 словах. Если вы работаете с DeepSeek — добавьте туда техническую конкретику, структуру и ссылки на первичные источники, потому что он ценит это больше, чем позицию в поиске.
Больше информации по GEO/AIO продвижению в моем телеграм-канале, подписывайтесь и забирайте Чек-лист самодиагностики в подарок.