Эффект Cats.txt: как один файл о кошках сломал логику «ИИ-оптимизации»

Эффект Cats.txt: как один файл о кошках сломал логику «ИИ-оптимизации»

Пока все паникуют из-за падения органического трафика из-за Яндекс Нейро и ИИ-ответов Google, на рынке выросла новая индустрия — GEO (Generative Engine Optimization). Сотни экспертов задорно продают курсы и чек-листы о том, как «гарантированно» заставить ChatGPT цитировать ваш сайт.

Главным священным граалем этой тусовки стал файл llms.txt — специальная разметка, которая якобы жестко диктует ИИ-ботам, как читать ваш проект.

Западные исследователи решили проверить, насколько слепая вера в эти файлы обоснована, и провели наглядный эксперимент.

В чем суть эксперимента?

Обычно адепты GEO уверяют, что без технического файла ИИ-парсеры не могут связать сущности на сайте и правильно выстроить контекст в своей базе данных.

Авторы эксперимента взяли эти аргументы и вместо стандартного файла создали на тестовом сайте документ cats.txt. Внутри него не было ничего, кроме случайного, несвязного бреда о поведении домашних кошек. Этот файл скормили поисковым ИИ-ботам во время сканирования.

Результат: ИИ-модели начали точно так же цитировать информацию из «кошачьего» файла, полностью игнорируя реальный контекст сайта и выдавая бред за чистую монету.

Главный вывод

У современных больших языковых моделей (LLM) пока нет жестких, детерминированных правил ранжирования на основе подобных файлов. Нейросеть просто пылесосит любой доступный текстовый массив. Если ей подсунуть красиво оформленный бред — она процитирует бред.

Вся эта индустрия «ИИ-оптимизации» технических файлов сегодня — чистая астрология. Как только алгоритмы перепроверяют источник на реальную авторитетность и поведенческие факторы, искусственный топ из файлов разметки мгновенно рушится.

Что делать вместо шаманство?

Переход на ИИ-поиск кажется катастрофой только тем, кто годами занимался поверхностным SEO: спамил ключи и генерировал тонны шаблонного контента без добавочной ценности.

Поисковые роботы ищут в тексте глубокую экспертизу, логику и уникальные факты. Если ваш сайт изначально строился для людей, ИИ-агенты будут находить и цитировать его органически. Технические стандарты важны для порядка, но фундаментом всегда остается экспертный контент.

Полный разбор кейса с пошаговым планом защиты сайта от пессимизации ИИ-роботами и разбором работающих утилит выложил у себя: на Webindex.su

4