Что происходит, когда два AI начинают редактировать друг друга
Мы постоянно спрашиваем: какой AI лучше для написания текстов? А если поставить вопрос иначе: что сами AI думают о текстах друг друга?
Проведём эксперимент: один текст, два редактора, объективная рецензия.
Итог редакционной планёрки оказался неожиданным: по поводу повторов, логики и структуры спорить было почти не о чем. Настоящие разногласия начались, когда текст стал «достаточно хорошим». Тогда эксперимент превратился в исследование границы между объективной редактурой и авторским вкусом.
Но подождите, разве у AI может быть авторский вкус?
Как проверить объективность AI-редактуры
Для эксперимента был выбран фрагмент текста на медицинскую тему, написанный без участия AI. Затем моделям — ChatGPT и Claude — был дан один и тот же универсальный редакторский промпт с одинаковыми требованиями к стилю, логике и ритму. После этого каждая модель получила версию текста, которую отредактировала другая.
Теперь их задачей было уже не улучшить текст, а оценить работу редактора. Так качество правок отошло на второй план, а на первый вышла сама природа редактуры.
Пока текст сырой, редакторы почти единодушны
В исходном тексте обе модели находили одинаковые проблемы. Они сокращали словесный шум, убирали повторы, исправляли неудачные формулировки и выверяли структуру. Различия были, но скорее косметическими.
Совпадение? Скорее нет. За последние годы сформировался довольно устойчивый набор редакторских принципов, который разделяют практически все современные языковые модели. Ясная структура, отсутствие лишних слов, логичные переходы, предсказуемый ритм — всё это уже воспринимается почти как грамматика хорошего текста.
Здесь редактура становится почти инженерной задачей: ошибки хорошо различимы, поэтому разные модели приходят к похожим выводам.
Когда ошибки заканчиваются, начинаются разногласия
После правок обе модели оценили свои версии текста как «довольно хорошие». Но когда каждая получила на рецензию вариант, отредактированный другой моделью, начались самые интересные замечания.
Например, Claude предложил сделать финальный абзац более категоричным. ChatGPT, наоборот, увидел в этой же части скрытое логическое противоречие и посоветовал изменить саму конструкцию аргумента.
В одном случае текст называли слишком осторожным, в другом — слишком уверенным. Разногласия касались уже авторской интонации, а не ошибок: одни формулировки предлагали убрать, другие — добавить.
А в конце Claude пошёл дальше и вынес вердикт уже не тексту, а его правдоподобию: по его оценке, версия ChatGPT на 70 % выдаёт руку искусственного интеллекта и слишком слаба, чтобы её мог написать практикующий врач. То есть один AI фактически обвинил другого в том, что тот недостаточно похож на человека.
Получается, спор возник уже вокруг того, каким вообще должен быть хороший текст, а не вокруг ошибок. Здесь проходит самая чёткая граница объективности.
А где заканчивается объективная редактура
Главная цель редактора — проверка текста, а не его переписывание. Так мы привыкли думать, когда редактор — человек.
Эксперимент с AI показал: пока текст содержит очевидные шероховатости, редакторская работа действительно выглядит почти объективной. Но постепенно количество таких решений уменьшается. И в какой-то момент текст перестаёт сопротивляться.
После этого каждый редактор начинает работать с собственным представлением о том, каким этот текст должен быть, — уже не столько с текстом как таковым. Тогда появляются разные версии одного и того же текста, каждая из которых может быть одинаково убедительной.
Значит ли это, что одна модель пишет лучше другой?
Сколько существует правильных версий текста? Одна? Две?
Сравнивать LLM как редакторов — значит исходить из того, что существует единственная правильная версия текста. Но на практике, когда текст достигает определённого уровня качества, эта единственная версия перестаёт существовать.
Остаются разные редакторские школы, разные литературные привычки, разные представления о том, сколько воздуха должно быть между абзацами, насколько жёстким может быть вывод и где заканчивается ясность, уступая место упрощению.
Человек спорит с человеком об этом уже много десятилетий. Похоже, к этому спору присоединились и языковые модели.
Что показал эксперимент
Искусственный интеллект постепенно стандартизирует нижнюю границу качества текста. Всё, что связано с логикой, структурой, повторами и языковой чистотой, становится всё менее зависимым от конкретного исполнителя.
Но верхняя граница остаётся открытой, потому что там уже нет единственного правильного решения. Там есть выбор, который по-прежнему определяется не алгоритмом, а суждением.
Возможно, именно поэтому вопрос о том, способен ли AI писать лучше человека, неправильный.
Если два сильных редактора — пусть даже искусственных — начинают спорить друг с другом, значит, текст достиг точки, где качество перестаёт быть единственной переменной. С этого момента начинается территория авторского взгляда.
И пока эта территория существует, последнее слово остаётся не за моделью, а за человеком, который решает, какую версию собственной мысли считать своей.