GPT‑5.6, Gemini 3.7 Flash, Claude Opus 5, Grok 4.6 и DeepSeek V4 Pro: что предлагают новые модели
GPT‑5.6, Gemini 3.7 Flash, Claude Opus 5, Grok 4.6 и DeepSeek V4 Pro: что предлагают новые модели
Какие модели вышли
GPT‑5.6 стала не одной моделью, а семейством из трёх вариантов: Sol для наиболее сложных задач, Terra для повседневной работы и Luna как быстрый и недорогой вариант. OpenAI объявила о широком запуске семейства 9 июля.
Gemini 3.7 Flash Google позиционирует как рабочую модель для программирования, автоматизации и агентных сценариев. По данным Reuters, модель вышла 13 августа и рассчитана на выполнение многошаговых задач с использованием инструментов.
Anthropic выпустила Claude Opus 5 24 июля. Компания называет его моделью для долгих агентных задач, программирования, профессиональной аналитики и работы с инструментами.
Grok 4.6 от xAI вышел 12 августа как обновление Grok 4.5 с акцентом на длительные агентные сценарии, интерактивные приложения и визуальную работу.
DeepSeek представила официальную версию V4 Pro 13 августа. Релиз стал переходом от предварительной версии к производственной модели, доступной через приложение, сайт и API.
Функции и доступность
OpenAI GPT‑5.6
В семейство GPT‑5.6 входят три модели:
- Sol — наиболее мощная версия для сложных задач;
- Terra — сбалансированный вариант для повседневной работы;
- Luna — быстрая и экономичная модель.
OpenAI заявляет об улучшениях в программировании, работе с документами, таблицами, презентациями, научных и профессиональных задачах. GPT‑5.6 также поддерживает использование инструментов, запуск программ и координацию нескольких агентов через Responses API. Для отдельных сценариев доступны режимы рассуждения max и ultra.
GPT‑5.6 появилась в ChatGPT, Codex и OpenAI API. Sol распространяется преимущественно среди платных и корпоративных пользователей, а Terra доступна в том числе на тарифах Free и Go. Первоначальное развёртывание проходило поэтапно.
Google Gemini 3.7 Flash
Gemini 3.7 Flash поддерживает обработку текста, изображений, аудио, видео и PDF. В Google отдельно выделяют следующие возможности:
- генерация и исправление кода;
- создание веб-приложений по текстовому описанию;
- работа с инструментами и внешними функциями;
- выполнение кода;
- обращение к Google Search;
- обработка URL;
- структурированный вывод;
- компьютерное управление в режиме Preview;
- несколько уровней глубины рассуждения.
Модель доступна разработчикам через Gemini API, Google AI Studio и Android Studio. Корпоративные пользователи могут работать с ней через Gemini Enterprise Agent Platform и Gemini Enterprise. В пользовательском продукте Spark модель предоставляется подписчикам Google AI Pro и Ultra в поддерживаемых странах. Google указывает более 160 стран для этой доступности.
Anthropic Claude Opus 5
Claude Opus 5 ориентирована на задачи, в которых требуется длительное планирование и последовательное выполнение действий. Модель умеет:
- работать с кодовыми базами;
- использовать браузер, терминал и внешние инструменты;
- выполнять многошаговые агентные задачи;
- анализировать финансовые и научные материалы;
- обрабатывать визуальные данные;
- поддерживать компьютерное управление;
- работать с контекстом объёмом до 1 млн токенов.
Anthropic предоставляет Opus 5 через Claude.ai, Claude Code, Claude Cowork и API. Модель также доступна через основные облачные платформы.
xAI Grok 4.6
Grok 4.6 получила улучшения в агентных сценариях, программировании, исследовании информации и создании интерактивных приложений. Модель принимает текстовые и графические данные, но генерирует только текст.
В документации xAI указаны несколько уровней усилий рассуждения: low, medium, high и xhigh. Это позволяет выбирать между скоростью ответа и глубиной обработки задачи. Grok 4.6 доступна в Cursor, Grok Build, через API xAI, а также через OpenRouter, Vercel и Cloudflare.
DeepSeek V4 Pro
DeepSeek V4 Pro получила инструменты для агентной работы и программирования. Среди возможностей, перечисленных в документации:
- thinking и non-thinking режимы;
- уровни рассуждения low, high и max;
- вызов инструментов;
- JSON-вывод;
- совместимость с OpenAI API;
- совместимость с Anthropic API;
- Responses API;
- интеграция с Codex;
- контекст до 1 млн токенов;
- максимальный размер ответа до 384 тыс. токенов.
V4 Pro доступна в веб-версии DeepSeek, мобильном приложении и через API
Отдельно 21 августа DeepSeek выпустила экспериментальную V4 Flash Vision Exp. Эта модель предназначена для визуального понимания и на момент публикации доступна только через API. В документации она обозначена как экспериментальная, поэтому её не следует смешивать с основным флагманом V4 Pro.
Цены и ограничения
OpenAI после снижения 21 августа установила для GPT‑5.6 Sol цену $4 за 1 млн входных и $20 за 1 млн выходных токенов. Для Terra тариф составляет $2/$12, для Luna — $0,20/$1,20.
Gemini 3.7 Flash до конца 2026 года продаётся по вводной цене $0,75 за 1 млн входных и $3,75 за 1 млн выходных токенов. Контекст модели ограничен 1 048 576 входными токенами, а максимальный текстовый вывод составляет 65 536 токенов. Gemini 3.7 Flash не генерирует изображения и аудио, а Live API для неё не поддерживается. Computer use имеет статус Preview
Claude Opus 5 стоит $5 за 1 млн входных и $25 за 1 млн выходных токенов. В ускоренном Fast mode тариф повышается до $10/$50. Anthropic ограничивает часть запросов, связанных с эксплуатацией уязвимостей, пентестингом и генерацией эксплойтов. Биологические и химические запросы с повышенным риском могут быть автоматически переведены на менее мощную модель
Grok 4.6 стоит $2/$6 при запросах объёмом до 200 тыс. токенов. Для более длинного контекста применяется тариф $4/$12. Контекстное окно модели составляет 500 тыс. токенов, а вывод остаётся текстовым даже при наличии поддержки изображений на входе
DeepSeek использует динамическое ценообразование. Для V4 Pro в непиковое время тариф составляет $0,66 за 1 млн токенов при отсутствии попадания в кэш, $0,022 при cache hit и $1,98 за 1 млн выходных токенов. В пиковое время ставки повышаются до $1,32/$0,044/$3,96. Документация также указывает лимит в 500 конкурентных запросов.
Что пока остаётся заявлениями компаний
Большинство заявлений о превосходстве моделей основано на тестах самих разработчиков или на бенчмарках, выбранных компаниями.
OpenAI называет GPT‑5.6 одной из наиболее сильных моделей для программирования, науки, кибербезопасности и профессиональной работы. Эти оценки опубликованы самой OpenAI.
Google сообщает об улучшении Gemini 3.7 Flash в кодинге, веб-разработке и автоматизации. Reuters приводит эти характеристики со ссылкой на материалы Google, а не как результат независимого тестирования.
Anthropic утверждает, что Claude Opus 5 приблизилась к более мощной Fable 5 при вдвое меньшей стоимости и показала высокие результаты в программировании и агентных задачах.
xAI заявляет, что Grok 4.6 сопоставима с GPT‑5.6 Sol в Artificial Analysis Intelligence Index. При этом часть сравнительных данных основана на опубликованных разработчиками system cards и таблицах бенчмарков.
В случае DeepSeek собственные результаты по тестам следует отделять от независимых оценок. Reuters приводит данные Artificial Analysis, согласно которым V4 Pro получила более высокий показатель Intelligence Index, чем V4 Flash, однако это не означает независимой проверки всех заявленных характеристик модели.