7 дней новостей ИИ (05.09.26–11.09.26)

За эту неделю индустрия ИИ успела разогнаться. Разбираем главное.

7 дней новостей ИИ (05.09.26–11.09.26)

Gemini 3.8 Flash: ещё одно ускорение

Google представила Gemini 3.8 Flash – всего через три недели после версии 3.7 и уже третье обновление серии за квартал.

Главная идея новой версии – тратить больше вычислений там, где задача сложная: модель глубже рассуждает, делает больше шагов и активнее использует инструменты.

На тесте DeepSWE v1.1 для автономного решения инженерных задач Gemini 3.8 Flash показывает результаты, сопоставимые с более крупными моделями, но обходится дешевле.

Qwen3.8-Max ненадолго стал лидером

2 сентября Qwen3.8-Max-0902 поднялась на первое место Code Arena WebDev, опередив Claude Opus 5 Max на три балла. Стоимость при этом составляла $2 за миллион входных и $6 за миллион выходных токенов.

Лидерство продлилось всего пять дней. К 7 сентября рейтинг снова изменился:

  1. Claude Fable 5.1 Max – 1896 баллов;
  2. GPT-6 Astra Max – 1860;
  3. Claude Opus 5 Max – 1766;
  4. Qwen3.8-Max-0902 – четвёртое место, пока с предварительным статусом.

DeepSeek V4.1-Flash

DeepSeek представила V4.1-Flash с нативной мультимодальностью и объявила о постепенном отказе от V4-Pro.

Новая модель построена по схеме MoE: заявлено 552 млрд параметров, из которых активно используются 8 млрд на входе и 16 млрд на выходе.

DeepSeek заявляет, что новая модель превосходит V4-Pro по скорости и стоимости
DeepSeek заявляет, что новая модель превосходит V4-Pro по скорости и стоимости

Ещё одно важное изменение – снижение требований к KV-кешу. По сравнению с предыдущим поколением модели требуется в четыре раза меньше HBM и в восемь раз меньше SSD.

С 14 сентября запросы к deepseek-v4-pro будут автоматически переводиться на V4.1-Flash.

GPT-6 Astra получила максимальный уровень киберриска

Через год после GPT-5 OpenAI представила GPT-6 Astra, назвав её самой интеллектуальной и согласованной моделью компании.

Накануне релиза OpenAI сообщила, что Astra получила статус критического риска в сфере кибербезопасности. Это первый случай, когда модель OpenAI достигла максимальной отметки хотя бы по одному из трёх направлений оценки угроз.

Результаты на тестах:

  • FrontierMath Tier 4 (v2) – 97,6%;
  • GPQA Diamond – 96,0%;
  • ARC-AGI-1 – 98,5%.

При этом на Humanity’s Last Exam с инструментами Astra уступила Fable 5.1 от Anthropic.

Попробуйте GPT 6 Astra

Модель уже доступна в GPTunneL.

NVIDIA покупает Hugging Face за $12,93 млрд

NVIDIA договорилась о покупке Hugging Face за $12,93 млрд.

Платформой пользуются более 18 млн разработчиков и создателей, которые разместили свыше:

  • 3 млн моделей;
  • 500 тысяч датасетов;
  • 1 млн приложений.

Сервисом также пользуются более 200 тысяч компаний.

NVIDIA обещает сохранить открытый характер платформы: разработчики смогут выбирать модели, фреймворки и облачные сервисы независимо от производителя вычислительного оборудования.

NVIDIA запускает PAIR

Компания также представила PAIR (Personal AI Router) – открытый маршрутизатор, который позволяет использовать свободные Mac и PC для обработки запросов ИИ-агентов.

PAIR не складывает мощности нескольких компьютеров в один виртуальный GPU. Вместо этого отдельные запросы распределяются между доступными машинами через Ollama или LM Studio.

Поддерживаются Mac на M4+ и видеокарты GeForce RTX 20xx и новее.

В тесте с двумя ПК на RTX 5090 и Qwen3.6 35B A3B пять субагентов ускорили выполнение примерно в 1,6 раза.

Google достаёт DDR4 из старых серверов

Дефицит памяти дошёл до того, что Google начала повторно использовать модули DDR4 из списанных серверов в новых ИИ-системах.

По словам Нихила Чериана, старшего директора Google по инфраструктуре цепочки поставок, рынок за несколько месяцев переключился с нехватки вычислительных мощностей на дефицит памяти.

Высокоскоростная память теперь составляет около 75% стоимости компонентов типичного ИИ-сервера.

Google даже разработала адаптеры для подключения старых DDR4 к современным серверам. Параллельно компания оптимизирует архитектуру моделей и уменьшает объём KV-кеша.

ChatGPT Images 2.5 стала быстрее

OpenAI выпустила ChatGPT Images 2.5 и заявила о сокращении задержки генерации примерно вдвое.

Главное практическое новшество – более точное редактирование: модель должна менять именно указанный пользователем объект, не перерисовывая остальную сцену.

Также улучшена стабильность при длинных цепочках редактирования и сохранена поддержка прозрачного фона.

Для разработчиков доступны две версии – GPT-Image-2.5 Flare и Sunburst.

GPTunneL включил «Гром Телевизор»

7 дней новостей ИИ (05.09.26–11.09.26)

На GPTunneL появился «Гром Телевизор» – непрерывный ИИ-эфир, содержание которого придумывают сами зрители.

Достаточно отправить запрос вроде «Гэндальф варит зелье со Скуби-Ду», и примерно через 20 секунд нейросеть создаст ролик для общего эфира.

Видео со звуком генерируется примерно за 7,8 секунды на Nvidia B200, после чего ffmpeg обрабатывает его и отправляет в HLS-поток. Если зрители ничего не предлагают, сюжеты генерирует модель Grom.

Посмотреть эфир (и добавить в него своих ИИ-генераций) можно на GPTunnel, Twitch и YouTube.

Suno переходит на v6

Suno представила новое поколение музыкальных моделей v6 сразу в трёх вариантах и отказалась от старых версий.

  • v6 – основной вариант для готовых музыкальных треков;
  • v6-wild – более экспериментальная версия;
  • v6-mini – бесплатная и ориентированная на скорость.
Три модели v6 в интерфейсе Suno
Три модели v6 в интерфейсе Suno

Появилось и точечное редактирование готовых композиций. Например, можно заменить исполнение припева на госпел-хор или объединить вокал из одного трека с барабанами другого.

Suno не раскрывает, на каких именно данных обучались новые модели. Warner, BMG и Believe названы соразработчиками, но подробности об использованных каталогах и объёме обучающих данных компания не публикует.

Открыть Suno v6

Модель уже доступна в GPTunneL.

Microsoft превращает Excel в интерактивный дашборд

Microsoft разрабатывает Excel Canvas – функцию Copilot, которая превращает данные таблицы в автоматически обновляемый дашборд с графиками и ключевыми показателями.

При изменении исходных данных визуализация должна обновляться сама.

Функция проходит под номером 569424 в дорожной карте Microsoft AI at Work. Её планируют выпустить для веб- и десктопной версий Excel в сентябре 2026 года, хотя пока она находится на стадии разработки.

Лев Толстой отвечает пользователям «Алисы»

К 198-летию Льва Толстого «Яндекс» запустил ИИ-персонажа писателя в чате с «Алисой».

Команда проекта использовала архивные записи, очистила их от шумов и настроила синтез речи, чтобы приблизить звучание к интонациям Толстого.

Роверы «Яндекса» разъезжают по улице Льва Толстого с цитатами из его дневников
Роверы «Яндекса» разъезжают по улице Льва Толстого с цитатами из его дневников

С 9 по 14 сентября доступны интерактивные сценарии по мотивам произведений писателя. Пользователь может, например, придумать встречу Наташи Ростовой и Андрея Болконского или помочь Жилину выбраться из плена.

В «Яндекс Картах» также появилась 3D-модель усадьбы «Хамовники» с возможностью виртуальной прогулки.

«Погода нынче чудная. Только купаться нельзя. Очень холодно по ночам».

ИИ заявил о решении задачи тысячелетия

OpenAI сообщила о результате, полученном при помощи 10 тысяч автономных ИИ-агентов: система нашла сингулярность в трёхмерных уравнениях Навье – Стокса.

Речь идёт об одной из шести нерешённых задач тысячелетия Института Клэя с призом в $1 млн. Полученный результат был формально проверен с использованием Lean.

Уравнения Навье – Стокса описывают движение жидкостей. Один из главных открытых вопросов связан с тем, могут ли их решения становиться сингулярными – то есть приводить к неограниченному росту скорости в конечной области.

Визуализация решения OpenAI: вихрь, где жёлтый цвет обозначает более быстрое вращение, синий – более медленное
Визуализация решения OpenAI: вихрь, где жёлтый цвет обозначает более быстрое вращение, синий – более медленное

Перед этим около 100 агентов примерно 50 часов пытались опровергнуть регулярность для уравнений Эйлера. Затем 10 тысяч агентов работали 88 часов над доказательством сингулярности Навье – Стокса и ещё 17 часов формализовали результат.

Всего между агентами прошло почти 5 млн сообщений.

Главное в цифрах

  • $12,93 млрд – стоимость сделки NVIDIA по покупке Hugging Face.
  • 10 000 агентов и почти 5 млн сообщений – масштаб работы OpenAI над уравнениями Навье – Стокса.
  • 75% – доля памяти в стоимости комплектующих типичного ИИ-сервера.
  • $5000 – текущая цена RTX 5090 против стартовых $2000.
  • 50% – заявленное сокращение задержки генерации в ChatGPT Images 2.5.
  • 3 балла – преимущество Qwen3.8-Max-0902, позволившее модели ненадолго возглавить Code Arena.
  • 198 лет – возраст Льва Толстого на 9 сентября 2026 года.

На этой неделе ИИ снова двигался сразу по нескольким фронтам: модели становятся быстрее, старое железо возвращается в строй, а автономные агенты берутся за задачи, которые десятилетиями оставались нерешёнными.

И судя по всему, следующая вряд ли окажется спокойнее.