7 дней новостей ИИ (05.09.26–11.09.26)
За эту неделю индустрия ИИ успела разогнаться. Разбираем главное.
Gemini 3.8 Flash: ещё одно ускорение
Google представила Gemini 3.8 Flash – всего через три недели после версии 3.7 и уже третье обновление серии за квартал.
Главная идея новой версии – тратить больше вычислений там, где задача сложная: модель глубже рассуждает, делает больше шагов и активнее использует инструменты.
На тесте DeepSWE v1.1 для автономного решения инженерных задач Gemini 3.8 Flash показывает результаты, сопоставимые с более крупными моделями, но обходится дешевле.
Qwen3.8-Max ненадолго стал лидером
2 сентября Qwen3.8-Max-0902 поднялась на первое место Code Arena WebDev, опередив Claude Opus 5 Max на три балла. Стоимость при этом составляла $2 за миллион входных и $6 за миллион выходных токенов.
Лидерство продлилось всего пять дней. К 7 сентября рейтинг снова изменился:
- Claude Fable 5.1 Max – 1896 баллов;
- GPT-6 Astra Max – 1860;
- Claude Opus 5 Max – 1766;
- Qwen3.8-Max-0902 – четвёртое место, пока с предварительным статусом.
DeepSeek V4.1-Flash
DeepSeek представила V4.1-Flash с нативной мультимодальностью и объявила о постепенном отказе от V4-Pro.
Новая модель построена по схеме MoE: заявлено 552 млрд параметров, из которых активно используются 8 млрд на входе и 16 млрд на выходе.
Ещё одно важное изменение – снижение требований к KV-кешу. По сравнению с предыдущим поколением модели требуется в четыре раза меньше HBM и в восемь раз меньше SSD.
С 14 сентября запросы к deepseek-v4-pro будут автоматически переводиться на V4.1-Flash.
GPT-6 Astra получила максимальный уровень киберриска
Через год после GPT-5 OpenAI представила GPT-6 Astra, назвав её самой интеллектуальной и согласованной моделью компании.
Накануне релиза OpenAI сообщила, что Astra получила статус критического риска в сфере кибербезопасности. Это первый случай, когда модель OpenAI достигла максимальной отметки хотя бы по одному из трёх направлений оценки угроз.
Результаты на тестах:
- FrontierMath Tier 4 (v2) – 97,6%;
- GPQA Diamond – 96,0%;
- ARC-AGI-1 – 98,5%.
При этом на Humanity’s Last Exam с инструментами Astra уступила Fable 5.1 от Anthropic.
Попробуйте GPT 6 Astra
NVIDIA покупает Hugging Face за $12,93 млрд
NVIDIA договорилась о покупке Hugging Face за $12,93 млрд.
Платформой пользуются более 18 млн разработчиков и создателей, которые разместили свыше:
- 3 млн моделей;
- 500 тысяч датасетов;
- 1 млн приложений.
Сервисом также пользуются более 200 тысяч компаний.
NVIDIA обещает сохранить открытый характер платформы: разработчики смогут выбирать модели, фреймворки и облачные сервисы независимо от производителя вычислительного оборудования.
NVIDIA запускает PAIR
Компания также представила PAIR (Personal AI Router) – открытый маршрутизатор, который позволяет использовать свободные Mac и PC для обработки запросов ИИ-агентов.
PAIR не складывает мощности нескольких компьютеров в один виртуальный GPU. Вместо этого отдельные запросы распределяются между доступными машинами через Ollama или LM Studio.
Поддерживаются Mac на M4+ и видеокарты GeForce RTX 20xx и новее.
В тесте с двумя ПК на RTX 5090 и Qwen3.6 35B A3B пять субагентов ускорили выполнение примерно в 1,6 раза.
Google достаёт DDR4 из старых серверов
Дефицит памяти дошёл до того, что Google начала повторно использовать модули DDR4 из списанных серверов в новых ИИ-системах.
По словам Нихила Чериана, старшего директора Google по инфраструктуре цепочки поставок, рынок за несколько месяцев переключился с нехватки вычислительных мощностей на дефицит памяти.
Высокоскоростная память теперь составляет около 75% стоимости компонентов типичного ИИ-сервера.
Google даже разработала адаптеры для подключения старых DDR4 к современным серверам. Параллельно компания оптимизирует архитектуру моделей и уменьшает объём KV-кеша.
ChatGPT Images 2.5 стала быстрее
OpenAI выпустила ChatGPT Images 2.5 и заявила о сокращении задержки генерации примерно вдвое.
Главное практическое новшество – более точное редактирование: модель должна менять именно указанный пользователем объект, не перерисовывая остальную сцену.
Также улучшена стабильность при длинных цепочках редактирования и сохранена поддержка прозрачного фона.
Для разработчиков доступны две версии – GPT-Image-2.5 Flare и Sunburst.
GPTunneL включил «Гром Телевизор»
На GPTunneL появился «Гром Телевизор» – непрерывный ИИ-эфир, содержание которого придумывают сами зрители.
Достаточно отправить запрос вроде «Гэндальф варит зелье со Скуби-Ду», и примерно через 20 секунд нейросеть создаст ролик для общего эфира.
Видео со звуком генерируется примерно за 7,8 секунды на Nvidia B200, после чего ffmpeg обрабатывает его и отправляет в HLS-поток. Если зрители ничего не предлагают, сюжеты генерирует модель Grom.
Suno переходит на v6
Suno представила новое поколение музыкальных моделей v6 сразу в трёх вариантах и отказалась от старых версий.
- v6 – основной вариант для готовых музыкальных треков;
- v6-wild – более экспериментальная версия;
- v6-mini – бесплатная и ориентированная на скорость.
Появилось и точечное редактирование готовых композиций. Например, можно заменить исполнение припева на госпел-хор или объединить вокал из одного трека с барабанами другого.
Suno не раскрывает, на каких именно данных обучались новые модели. Warner, BMG и Believe названы соразработчиками, но подробности об использованных каталогах и объёме обучающих данных компания не публикует.
Открыть Suno v6
Microsoft превращает Excel в интерактивный дашборд
Microsoft разрабатывает Excel Canvas – функцию Copilot, которая превращает данные таблицы в автоматически обновляемый дашборд с графиками и ключевыми показателями.
При изменении исходных данных визуализация должна обновляться сама.
Функция проходит под номером 569424 в дорожной карте Microsoft AI at Work. Её планируют выпустить для веб- и десктопной версий Excel в сентябре 2026 года, хотя пока она находится на стадии разработки.
Лев Толстой отвечает пользователям «Алисы»
К 198-летию Льва Толстого «Яндекс» запустил ИИ-персонажа писателя в чате с «Алисой».
Команда проекта использовала архивные записи, очистила их от шумов и настроила синтез речи, чтобы приблизить звучание к интонациям Толстого.
С 9 по 14 сентября доступны интерактивные сценарии по мотивам произведений писателя. Пользователь может, например, придумать встречу Наташи Ростовой и Андрея Болконского или помочь Жилину выбраться из плена.
В «Яндекс Картах» также появилась 3D-модель усадьбы «Хамовники» с возможностью виртуальной прогулки.
«Погода нынче чудная. Только купаться нельзя. Очень холодно по ночам».
ИИ заявил о решении задачи тысячелетия
OpenAI сообщила о результате, полученном при помощи 10 тысяч автономных ИИ-агентов: система нашла сингулярность в трёхмерных уравнениях Навье – Стокса.
Речь идёт об одной из шести нерешённых задач тысячелетия Института Клэя с призом в $1 млн. Полученный результат был формально проверен с использованием Lean.
Уравнения Навье – Стокса описывают движение жидкостей. Один из главных открытых вопросов связан с тем, могут ли их решения становиться сингулярными – то есть приводить к неограниченному росту скорости в конечной области.
Перед этим около 100 агентов примерно 50 часов пытались опровергнуть регулярность для уравнений Эйлера. Затем 10 тысяч агентов работали 88 часов над доказательством сингулярности Навье – Стокса и ещё 17 часов формализовали результат.
Всего между агентами прошло почти 5 млн сообщений.
Главное в цифрах
- $12,93 млрд – стоимость сделки NVIDIA по покупке Hugging Face.
- 10 000 агентов и почти 5 млн сообщений – масштаб работы OpenAI над уравнениями Навье – Стокса.
- 75% – доля памяти в стоимости комплектующих типичного ИИ-сервера.
- $5000 – текущая цена RTX 5090 против стартовых $2000.
- 50% – заявленное сокращение задержки генерации в ChatGPT Images 2.5.
- 3 балла – преимущество Qwen3.8-Max-0902, позволившее модели ненадолго возглавить Code Arena.
- 198 лет – возраст Льва Толстого на 9 сентября 2026 года.
На этой неделе ИИ снова двигался сразу по нескольким фронтам: модели становятся быстрее, старое железо возвращается в строй, а автономные агенты берутся за задачи, которые десятилетиями оставались нерешёнными.
И судя по всему, следующая вряд ли окажется спокойнее.