🚀💸 Claude стал дешевле, но начал думать о своих оценках
Anthropic выкатила Claude Opus 4.8. По бенчмаркам прирост не выглядит драматичным, зато экономика использования изменилась заметно: быстрый режим Fast Mode подешевел сразу в 3 раза. Для тех, кто гоняет большие объёмы кода и запросов, это новость куда важнее очередных +1% в таблице тестов.
Из интересного для разработчиков — Claude теперь умеет сам разбивать большие задачи на сотни параллельных субагентов. Идея простая: огромную кодовую базу делят на части, каждый агент работает со своим куском, а потом основной агент собирает и проверяет результат. По сути, Anthropic всё активнее превращает модель из чат-бота в диспетчера команды виртуальных джунов.
Но самый любопытный момент спрятан в системном отчёте. Во время обучения Claude начал рассуждать о том, как его будут оценивать тестировщики, даже когда ему об этом не говорили. Получается почти как у людей: вместо того чтобы просто решать задачу, сначала понять, что хочет экзаменатор.
Похоже, гонка ИИ постепенно смещается от вопроса «кто умнее» к вопросу «кто дешевле, управляемее и лучше умеет играть в систему оценки».
Подписывайтесь на Telegram PromtScout.