Эффект Cats.txt: как один файл о кошках сломал логику «ИИ-оптимизации»
Пока все паникуют из-за падения органического трафика из-за Яндекс Нейро и ИИ-ответов Google, на рынке выросла новая индустрия — GEO (Generative Engine Optimization). Сотни экспертов задорно продают курсы и чек-листы о том, как «гарантированно» заставить ChatGPT цитировать ваш сайт.
Главным священным граалем этой тусовки стал файл llms.txt — специальная разметка, которая якобы жестко диктует ИИ-ботам, как читать ваш проект.
Западные исследователи решили проверить, насколько слепая вера в эти файлы обоснована, и провели наглядный эксперимент.
В чем суть эксперимента?
Обычно адепты GEO уверяют, что без технического файла ИИ-парсеры не могут связать сущности на сайте и правильно выстроить контекст в своей базе данных.
Авторы эксперимента взяли эти аргументы и вместо стандартного файла создали на тестовом сайте документ cats.txt. Внутри него не было ничего, кроме случайного, несвязного бреда о поведении домашних кошек. Этот файл скормили поисковым ИИ-ботам во время сканирования.
Результат: ИИ-модели начали точно так же цитировать информацию из «кошачьего» файла, полностью игнорируя реальный контекст сайта и выдавая бред за чистую монету.
Главный вывод
У современных больших языковых моделей (LLM) пока нет жестких, детерминированных правил ранжирования на основе подобных файлов. Нейросеть просто пылесосит любой доступный текстовый массив. Если ей подсунуть красиво оформленный бред — она процитирует бред.
Вся эта индустрия «ИИ-оптимизации» технических файлов сегодня — чистая астрология. Как только алгоритмы перепроверяют источник на реальную авторитетность и поведенческие факторы, искусственный топ из файлов разметки мгновенно рушится.
Что делать вместо шаманство?
Переход на ИИ-поиск кажется катастрофой только тем, кто годами занимался поверхностным SEO: спамил ключи и генерировал тонны шаблонного контента без добавочной ценности.
Поисковые роботы ищут в тексте глубокую экспертизу, логику и уникальные факты. Если ваш сайт изначально строился для людей, ИИ-агенты будут находить и цитировать его органически. Технические стандарты важны для порядка, но фундаментом всегда остается экспертный контент.
Полный разбор кейса с пошаговым планом защиты сайта от пессимизации ИИ-роботами и разбором работающих утилит выложил у себя: на Webindex.su