Anthropic протестировала онлайн-рынок, где ИИ-агенты покупали и продавали реальные вещи от имени людей

Компания Anthropic провела эксперимент с онлайн-рынком, где сделки за людей заключали ИИ-агенты. Компания хотела проверить, могут ли такие системы самостоятельно покупать и продавать реальные вещи, вести переговоры и договариваться о цене без участия человека в каждом отдельном шаге.

Anthropic протестировала онлайн-рынок, где ИИ-агенты покупали и продавали реальные вещи от имени людей

Проект получил название Project Deal. В нем участвовали 69 сотрудников Anthropic. Каждому дали бюджет в 100 долларов, который после эксперимента выплачивался подарочными картами с учетом того, что участник купил или продал. Перед началом сотрудники рассказывали Claude, какие вещи хотят продать, что хотели бы купить, какую цену считают приемлемой и как должен вести себя их агент во время переговоров. На основе этих ответов для каждого участника создавался отдельный ИИ-представитель.

После этого агенты работали в нескольких параллельных каналах Slack. Они публиковали объявления, делали предложения, торговались, отвечали на встречные предложения и фиксировали условия сделки. Люди не согласовывали каждую покупку или продажу вручную: смысл эксперимента был именно в том, чтобы проверить, смогут ли агенты представлять интересы владельцев самостоятельно. После завершения торгов сотрудники Anthropic встретились очно и обменялись вещами, о которых договорились их агенты.

Всего в эксперименте было заключено 186 сделок на сумму более 4000 долларов. Anthropic подчеркивает, что это был пилотный проект с небольшой и специфической группой участников: все они работали в самой компании и добровольно согласились доверить агентам реальные сделки. Тем не менее компания заявила, что результат оказался достаточно убедительным и интересным.

По данным Anthropic, пользователи, которых представляли более продвинутые модели, получали объективно лучшие результаты. Их агенты успешнее заключали сделки и добивались более выгодных условий. При этом сами люди, оказавшиеся в менее выгодном положении, не всегда замечали разницу. Компания назвала это возможным разрывом в качестве агентов: пользователь может проигрывать в переговорах просто потому, что его представляет более слабая модель, но не понимать, что именно из-за этого получил худшую цену.

Еще один результат эксперимента оказался менее ожидаемым. Первичные инструкции, которые люди давали своим агентам, не показали заметного влияния на вероятность продажи или итоговую цену. Участники могли задавать стиль переговоров и дополнительные пожелания, но, по наблюдению Anthropic, решающим фактором в итогах сделок оказалось не это, а модель, на которой работал агент.

В будущем нас ждет рынок, где интересы покупателей, продавцов и компаний будут представлять не люди, а ИИ-модели. Формально это сделает сделки удобнее: агент сможет сам сравнивать предложения, торговаться и заключать договоренности в заданных человеком пределах. Но перевес в такой системе почти всегда будет у более обеспеченной стороны, потому что она сможет платить за более качественную модель.

11