Всю первую половину 2026-го рынок жил ожиданием четырёх релизов. На 5 августа не вышел ни один. Разбираем, что произошло вместо них — и почему это меняет то, как стоит проектировать архитектуру.
Всю первую половину 2026-го рынок жил ожиданием четырёх релизов. На 5 августа не вышел ни один. Разбираем, что произошло вместо них — и почему это меняет то, как стоит проектировать архитектуру.
В июле 2026 года на OpenRouter случилось то, чего год назад не ждал никто: все пять первых мест в рейтинге использования заняли китайские модели. Первое место по объёму токенов — MiMo-V2.5 от Xiaomi. Дальше DeepSeek, MiniMax, Qwen, Kimi. Ни OpenAI, ни Google в первой пятёрке нет вообще.
Продолжаю серию экспериментов: беру модель из OpenRouter, даю ей живую задачу на своём проекте и смотрю, что получится. В прошлый раз тёмную тему делала DeepSeek V4 Flash, до этого MiMo переписывала страницы авторизации. Сегодня — z-ai/glm-5.2 в связке с Cline и задача посложнее: сквозная фича через весь стек, от миграции базы до вёрстки.
Обычно модели тестируют так: три задачки, смотрим, кто умнее. Мне интереснее другое — сколько стоит рутина. Не «напиши игру», а грязная работа, которой в реальном проекте большая часть: разгрести код, который уже написан, уже работает, но смотреть на него больно.
В мае, на Google I/O, Sundar Pichai показал Gemini 3.5 Pro как флагман нового поколения — с окном контекста на 2 миллиона токенов, режимом глубоких рассуждений DeepThink и обещанием выхода в июне. Июнь прошёл. Модели нет до сих пор.
Alibaba представила превью своей крупнейшей модели — Qwen3.8 Max. Анонс прозвучал 19 июля на конференции WAIC в Шанхае — всего через два дня после того, как Moonshot AI выпустила open-weight модель Kimi K3 на 2,8 трлн параметров.
Пока все следили за релизами Kimi K3 и GPT-5.6, случилась история поинтереснее. 30 июня китайская Meituan — компания, которую весь мир знает как гигантский сервис доставки еды — раскрыла карты: загадочная модель Owl Alpha, которая два месяца анонимно собирала топы на OpenRouter, — это её LongCat-2.0. Модель на 1,6 триллиона параметров, обученная от…
Год назад на OpenRouter была понятная картина: американская тройка — Google, OpenAI, Anthropic — держала около 70% всех токенов, и это никого не удивляло. GPT был дефолтом, Claude — премиумом, остальное — экзотикой. К июню 2026-го доля США просела примерно до 30%, а первые строчки платформы заняли модели, о которых год назад половина разработчиков…
Каждый, кто гоняет LLM локально, знает этот ритуал наизусть. Открываешь страницу модели, ищешь размер GGUF-файла, умножаешь параметры на биты кванта, вспоминаешь про KV-кэш, идёшь на Reddit читать «а у кого завелось на 16 гигах», качаешь 18 ГБ — и ловишь out of memory, потому что Windows с двумя мониторами уже откусила свои полтора гига. 30 июня Hu…
Полугодовой апдейт большого гайда: флагман Anthropic успели выпустить, забанить и вернуть, OpenAI перешёл на три тарифа, Маск обучил модель на Cursor, а китайцы опустили цены до 14 центов. Разбираем, кто есть кто, — с ценами, бенчмарками и рекомендациями под конкретные задачи.