AI-агент написал код за вечер: чем мы платили полгода за эту скорость

AI-агент написал нам рабочий код за вечер. Полгода мы платили за этот вечер.

Мы подключили AI-агента к внутреннему проекту: он сам читал таск, лез в репозиторий, коммитил. За вечер — модуль выгрузки отчётов, который «работал». Демо прошло, все хлопали. А потом бухгалтерия нашла расхождение в цифрах, и мы неделю разбирали, откуда оно взялось.

Неочевидное: агент не столько ошибся, сколько написал правдоподобный код, который никто из нас толком не прочитал — «ну он же прошёл тесты». А тесты он написал сам, под свою же логику. Получилась замкнутая петля, где всё зелёное и всё неверное.

Что я поменял в работе с агентами:

1. Тесты пишет человек, до того как агент трогает код. Не наоборот.

2. Любой diff больше 30 строк читаю глазами, а не по summary от самого агента.

3. Даю агенту узкую задачу с чёткими границами: «эта функция, этот файл», а не «сделай фичу».

4. Финансовую и юридическую логику агенту не отдаю вообще — цена ошибки выше экономии.

5. В PR фиксирую, что именно проверил руками. Дисциплинирует.

Скорость выросла реально. Но экономит агент только там, где я всё ещё думаю сам.

А вы уже ловили себя на том, что доверяете коду от AI больше, чем стали бы коду коллеги?