Anthropic случайно раскрыла свой самый опасный ИИ
Anthropic по ошибке открыла доступ к черновикам блога и засветила Claude Capybara — самый мощный и одновременно самый опасный свой ИИ. Из утёкших документов следует, что модель обгоняет Opus в программировании и кибербезе, умеет сама находить и эксплуатировать уязвимости и потому может стать инструментом не только для защитников, но и для киберпреступников.
Anthropic, разработчик Claude, по‑детски «слила» в публичный кэш черновики будущих блог‑постов о новой модели Claude Mythos — в линейке её Collegium-серий — с внутренним тиром Capybara. По сути, мир узнал о самом мощном ИИ, который компания когда‑либо делала, не из официального анонса, а из технической ошибки: кто‑то забыл отключить публичный доступ к CMS‑кэшу, куда попали около 3000 неопубликованных материалов, включая тексты, изображения и PDF.
Что за «Capybara» и чем она опаснее Opus
Anthropic всегда продвигала Claude Opus как «самый мощный» вариант для сложных задач: программирование, анализ данных, стратегия. В новых черновиках компания прямо говорит, что Capybara — следующий тир после Opus 4.6, а не просто очередное обновление.
Согласно материалам, Capybara даёт радикально выше результаты в задачах программирования и академического мышления, и особенно в кибербезопасности — находит, анализирует и даже эксплуатирует уязвимости так, что опережает уже существующие модели.
Anthropic в публичных заявлениях подтверждает: да, разрабатывается general‑purpose модель нового поколения, которая «до сих пор самая мощная» из того, что они создали, и сейчас проходит тестирование у группы доверенных клиентов.
«Кибер‑оружие» на полпути к публичному запуску
Главный момент, который выделяет Capybara из всей линейки Anthropic, — это открытая оговорка о рисках. В черновиках компания прямо пишет, что модель «предвещает волну ИИ‑систем, которые будут эксплуатовать уязвимости быстрее, чем защитники успевают реагировать» — это следует из данных, попавших в распоряжение Fortune.
Это не просто «умный помощник для разработчика», а:
- автоматический ревьюер кода высокого класса,
- инструмент для поиска уязвимостей в больших кодовых базах,
- прототип полуавтономного атакующего, который может генерировать и тестировать эксплойты в реальном времени.
Anthropic планирует:
- первым пользователям сделать доступ к Capybara именно для организаций в сфере кибербезопасности, чтобы дать им «передышку» и время улучшить свои системы защиты,
- пока модель оставлять дорогой, ограниченной и не массовой, чтобы не создавать «доступное оружие» для всех подряд.
По факту Capybara — это уже не «ассистент для девелоперов», а зачаток полноценного кибероружия нового поколения: Anthropic сама видит в модели риск, поэтому сначала отдаёт её в руки защитников, а не рынка, и одновременно пытается не допустить сценария, при котором такой ИИ окажется в открытом доступе раньше, чем у бизнеса появится хоть какая‑то защита.
Почему утечка не просто «описание модели»
В тот же кэш попали не только формулировки про Capybara, там также присутствуют:
- внутренние тестовые оценки,
- формулировки о том, как модель будет использоваться в реальных сценариях,
- а также информация о CEO‑ретрите Anthropic в английском поместье, где Dario Amodei планирует демонстрировать новые возможности Claude для европейских бизнес‑руководителей.
Это уже не просто «превью анонса», а:
- предварительный look архитектуры мышления компании,
- внутренняя оценка рисков и выгод,
- какие сегменты рынка Anthropic планирует захватить первыми.
В результате утечки рынок получил редкий инсайд не только о том, какой ИИ Anthropic строит, но и о том, кому и как его собираются продавать. Планы по закрытому ретриту для CEO, акцент на европейских корпорациях и отдельная работа с «избранной» аудиторией показывают: Capybara изначально проектируют как продукт для узкого круга крупных игроков, которые первыми получат доступ к новому классу ИИ‑инструментов — и преимуществам, и рискам, которые с ним приходят.
Когда Claude уже использовали в атаках
Эта история — не гипотеза. Anthropic уже сталкивалась с тем, как её же модели используют в реальных атаках и индустрии.
- В 2025 году компания опубликовала отчёт, где рассказала, как крупные киберпреступные кампании использовали Claude Code для автоматизации атак: анализов данных, генерации вредоносных скриптов, подбора сценариев социальной инженерии.
- В феврале 2026 года Anthropic обвинила китайские ИИ‑лаборатории DeepSeek, Moonshot AI и MiniMax почти в 24 000 фейковых аккаунтов, которые использовались для массовой дистилляции знаний Claude.
Это создаёт единый паттерн:
- модели Anthropic — одни из самых продвинутых в мире,
- одновременно — одни из самых желанных объектов для злоумышленников и конкурентов.
На фоне Capybara это выглядит не как «страшилка про будущее», а как следующая итерация уже идущего процесса: сначала злоумышленники учатся выжимать максимум из относительно безопасных моделей вроде Claude Code, а затем получают в руки системы, которые по умолчанию умеют больше. Для бизнеса это означает, что утечка Capybara только ускоряет то, что и так происходит — ИИ переходит с позиции вспомогательного инструмента в роль полноценного участника киберконфликта.
Как бизнесу реагировать на такие модели
Появление моделей вроде Capybara меняет баланс сил в кибербезопасности: тот, у кого есть доступ к таким системам, получает серьёзное преимущество — как в атаке, так и в защите. Поэтому для компаний это уже не вопрос любопытства к ИИ, а необходимость адаптировать инфраструктуру под новый уровень угроз. На практике это выражается в нескольких конкретных шагах.
ИИ‑аудит безопасности. Если Capybara умеет автоматически находить уязвимости в больших кодовых базах, то компании без аналогичных ИИ‑инструментов оказываются в зоне «лёгких» целей.
DevSecOps с ИИ‑инструментами. В ближайшие годы автоматическое тестирование сценариев безопасности, поиск уязвимостей в legacy‑коде и анализ исходников будут идти не только силами людей, но и ИИ‑моделями уровня Capybara.
Жёсткий контроль доступа к ИИ. Внутренние Claude, корпоративные аккаунты и интеграции с SOC‑системами становятся новыми поверхностями атаки, поэтому доступ к мощным моделям нужно ограничивать, логировать и постоянно мониторить.
Готовность к давлению регуляторов. В 2026 году Anthropic в отчётах прямо признаёт, что её модели теоретически могут использоваться в самых тяжёлых преступлениях, и это ведёт к новым ограничениям и требованиям к ИИ‑инфраструктуре.
В итоге Capybara — это не только история про «самый мощный ИИ Anthropic», а сигнал к тому, что стратегии кибербезопасности придётся пересобрать с учётом того, что ключевые участники атак и защиты скоро тоже будут ИИ‑системами.
Для бизнеса это означает, что относиться к ИИ как к игрушке для экспериментов уже нельзя — его нужно закладывать в архитектуру защиты так же серьёзно, как SOC‑платформы и системы мониторинга.