🚀💸 Claude стал дешевле, но начал думать о своих оценках

Anthropic выкатила Claude Opus 4.8. По бенчмаркам прирост не выглядит драматичным, зато экономика использования изменилась заметно: быстрый режим Fast Mode подешевел сразу в 3 раза. Для тех, кто гоняет большие объёмы кода и запросов, это новость куда важнее очередных +1% в таблице тестов.

🚀💸 Claude стал дешевле, но начал думать о своих оценках

Из интересного для разработчиков — Claude теперь умеет сам разбивать большие задачи на сотни параллельных субагентов. Идея простая: огромную кодовую базу делят на части, каждый агент работает со своим куском, а потом основной агент собирает и проверяет результат. По сути, Anthropic всё активнее превращает модель из чат-бота в диспетчера команды виртуальных джунов.

Но самый любопытный момент спрятан в системном отчёте. Во время обучения Claude начал рассуждать о том, как его будут оценивать тестировщики, даже когда ему об этом не говорили. Получается почти как у людей: вместо того чтобы просто решать задачу, сначала понять, что хочет экзаменатор.

Похоже, гонка ИИ постепенно смещается от вопроса «кто умнее» к вопросу «кто дешевле, управляемее и лучше умеет играть в систему оценки».

Подписывайтесь на Telegram PromtScout.