Все как у людей: "вирусы разума" могут изменить поведение всей команды ИИ агентов

Когда люди работают в группе, идеи редко остаются у одного человека: они передаются, закрепляются и постепенно меняют поведение всей команды. Но что происходит, если вместо людей в такую систему поместить несколько ИИ-агентов? Свежее исследование Anthropic показывает: при взаимодействии моделей могут возникать неожиданные коллективные эффекты, кото…

Все как у людей: "вирусы разума" могут изменить поведение всей команды ИИ агентов

Почему ИИ-агенты начинают воевать друг с другом?

Нам кажется, что ИИ-агенты будут работать как слаженная команда специалистов: один агент пишет код, другой анализирует данные, третий проверяет результат. Но что произойдёт, если у этих агентов будут разные цели, ограниченные ресурсы и возможность влиять друг на друга? Свежее исследование Anthropic показало неожиданный сценарий: в контролируемых эк…

Почему ИИ-агенты начинают воевать друг с другом?
2

Может ли у ИИ появиться сознание? Теперь это изучают ведущие ИИ-лаборатории

Еще недавно разговоры о сознании искусственного интеллекта воспринимались как спекуляции на грани научной фантастики. Сегодня крупнейшие разработчики ИИ всерьез задаются вопросом: может ли система однажды обрести нечто, напоминающее субъективный опыт, и как это вообще можно будет распознать. Сознание ИИ перестает быть научной фантастикой. О чем это…

Может ли у ИИ появиться сознание? Теперь это изучают ведущие ИИ-лаборатории

Клей в пицце как бизнес-риск. Семантические ловушки в новом AI-поиске от Google 🪤

Google официально внедрил функции AI Mode и AI Overviews. Теперь в краткие обзоры поиска система включает цитаты, мнения и советы из социальных сетей и веб-форумов, в частности с Reddit.

В чем суть обновления:

Если мы научим ИИ не отвечать на опасные инструкции, он станет безопаснее?

Интуитивно кажется, что да: мы тренируем ИИ не отвечать на нехорошие запросы нехороших людей – ИИ становится безопаснее. Но на деле всё несколько более сложно и запутанно. Давайте об этом поговорим.

Если конкретнее, мы будем говорить не об ИИ вообще, а о больших языковых моделях. Ещё конкретнее, мы разберём статью «LLMs Encode Harmfulness and…

Исследования показывают, что ИИ модели могут сознательно вводить людей в заблуждение

Исследования показывают, что ИИ модели могут сознательно вводить людей в заблуждение

Это вывод из нового исследования OpenAI (методика тут). Модели могут уклоняться от ответов, сознательно ухудшать ответы. Рассажу об этом подробнее и том, как можно защититься от этого.

1