Прогресс ИИ остановился? Нет, он шпарит на всех парах
И в роли локомотива вновь компания OpenAI. Смотрите, сейчас все более важной метрикой оценки ИИ становится умение выполнять длительные задачи. Из эпохи чат-ботов мы переходим в эпоху ИИ-агентов, а здесь без работы вдолгую не обойтись: даже планирование поездки в другой город — это сложная многоэтапная работа, что же говорить про бизнес-задачи.
На этом фоне особенно интересны результаты выступления экспериментальных моделей OpenAI в двух важных состязаниях.
Второе место на AtCoder World Tour Finals 2025 Heuristics
AtCoder World Tour Finals — очный финал одного из самых престижных соревнований по программированию, на который попадают лучшие из лучших. Проходит в двух категориях — алгоритмическое и эвристическое программирование. В каждой категории было по 12 участников, а в эвристике к ним присоединилась OpenAIAHC — экспериментальная модель от OpenAI.
Эвристическое программирование — быстрый поиск достаточно хорошего варианта решения проблемы в ситуации, когда лучший вариант невозможен. Как пример можно привести навигатор (хотя в нем эвристический алгоритм комбинируется с другими приемами) — в большом городе с постоянно меняющейся обстановкой нереально сходу найти лучший маршрут, поэтому система подбирает несколько достаточно хороших вариантов.
AtCoder World Tour Finals длился 10 часов — участники начинают с быстрых работающих решений, а затем полируют их, выжимая максимум. OpenAIAHC заняла второе место, на 9,5% уступив Пржемыславу Psycho Дебиаку — легендарному программисту из Польши. Пржемыслав рассказал, что финал полностью выжал его, а затем пошутил, что чувствует себя “последним рубежом обороны”.
Интересно, что OpenAIAHC лидировала значительную часть соревнования, уступив лишь к концу. То есть ИИ уже невероятно силен в построении быстрых решений, человек же вышел вперед, когда для дальнейшего улучшения потребовались креативные подходы.
Золотая медаль Международной математической олимпиады 2025
Другая (а может и та же самая, в OpenAI не раскрывают деталей) экспериментальная модель решила пять из шести задач Международной математической олимпиады 2025 года (IMO 2025) — самого сложного и престижного состязания для школьников. Это уровень золотой медали, которую получили 67 участников из 630.
IMO 2025 состоит из двух этапов по 4,5 часа, при этом модель подходила к каждой задаче как живой участник: читала условие и писала подробное решение, не используя веб-поиск и вспомогательные инструменты. На решение одной задачи уходило до 100 минут, что показало возможность модели планировать свои действия вдолгую и придерживаться намеченного плана действий. Важно отметить, что OpenAI не участвовала в IMO 2025 напрямую, а воспроизвела состязание “внутри”, дополнительно пригласив несколько профессиональных математиков для валидации результатов.
Тем не менее, компанию поздравил даже Гэри Маркус — исследователь в области ИИ, который известен своим скептицизмом по поводу современных моделей. Далее Гэри подсыпал немного соли, справедливо попросив OpenAI раскрыть подробности.
Математик Теренс Тао, который еще 14 июня на подкасте Лекса Фридмана утверждал, что вряд ли ИИ возьмет золото IMO в ближайшие два года, также поздравил OpenAI, попросил раскрыть все подробности и призвал организаторов IMO включить ИИ в программу 2026 года, обеспечив прозрачность.
В OpenAI пока ограничились публикацией решений задач, а также заявили, что речь идет о general purpose модели — то есть ИИ, который обучают для решения широкого круга задач, а не “натаскали” специально под IMO 2025. В ближайшие месяцы запускать ее в широкий доступ не планируется — перед нами скорее прототип того, что ляжет в основу условного “ChatGPT-6”.
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.