Cognition выпустила SWE-2, свою самую мощную модель для программирования
На FrontierCode 1.1 она набрала 50%, почти догнав Fable 5.1, но при этом работает на 64% дешевле. На DeepSWE результат уже 73%, а на Terminal-Bench 2.1 модель набрала 92,8%.
Главный упор сделали не только на качество, но и на эффективность. SWE-2 medium использует на 58% меньше шагов, чем SWE-1.7, а средняя стоимость выполнения задачи снизилась на 81%. Модель быстрее понимает, какие части проекта действительно нужно изучить, и раньше переходит к написанию кода.
В основе лежит Kimi K3 на 2,8 трлн параметров. Cognition дополнительно обучила модель через RL, увеличила число тренировочных окружений втрое и научила разные уровни глубины рассуждений в рамках одного процесса обучения.
SWE-2 уже доступна в Devin Desktop и CLI. Постепенно её добавляют в Devin Web и Fusion.