Anthropic доверила своей ИИ-модели управление настоящим автоматом с едой: эксперимент провалился

Компания Anthropic решила проверить, насколько далеко можно продвинуть автономность искусственного интеллекта: своей последней модели Claude Sonnet 3.7 дали конкретную, прикладную задачу — управлять продажей продуктов через офисный торговый автомат. Речь шла не о тесте или симуляции: Claudius (Клодиус, так прозвали ИИ внутри проекта) работал с наст…

Anthropic усилила защиту Claude: как AI-компания строит многоуровневую систему безопасности

Anthropic усилила защиту Claude: как AI-компания строит многоуровневую систему безопасности

Компания Anthropic, разработчик искусственного интеллекта Claude, представила подробности своей стратегии по защите ИИ от вредоносного использования. Этот подход уже внедрён в работу и для некоторых моделей стал ещё строже — например, Claude Opus 4 получил повышенный уровень безопасности ASL-3.

🎙 ИИ в УХО #28 — 🚀 Самая мощная неделя в мире ИИ — 2025! 🚀

Знаете, какая ИИ-модель побила все рекорды за один день? Или кто научился создавать целые игры по одному запросу? Мы собрали это и ещё десятки сенсаций в свежем подкасте! 🎧

🎙 ИИ в УХО #28 — 🚀 Самая мощная неделя в мире ИИ — 2025! 🚀

В выпуске:

Праздник непослушания: ИИ модели могут лишь притворяться, что слушают инструкции

Исследователи выяснили, что ИИ модели могут только на словах соглашаться следовать инструкциям, преследуют свои собственные цели (да-да, все как у людей!). Почему исследователи сделали такой вывод, чем это грозит, и как собираются исправлять?

🔥 Еще больше интересного в моем канале Продуктовые штучки

22
11

«Anthropic» обучала нейросеть «Claude», выкупая и уничтожая миллионы книг

«Anthropic» обучала нейросеть «Claude», выкупая и уничтожая миллионы книг

Компания «Anthropic» (разработчик языковой модели «Claude»), выкупила и оцифровала миллионы физических книг, а затем уничтожила оригинальные экземпляры. По информации «Ars Technica», страницы вырезались из переплётов, сканировались и использовались исключительно для внутреннего обучения нейросети. Эта масштабная практика вызвала внимание общественн…

11

🎙 ИИ в УХО #16 — 19 AI-новостей, которые ты, скорее всего, пропустил

ИИ не тормозит. Кажется, только успел привыкнуть к новому — как уже пора перестраиваться. Мы собрали главное за неделю, без хайпа и лишнего шума. Если хочешь понимать, куда реально движется рынок — слушай сейчас.

🎙 ИИ в УХО #16 — 19 AI-новостей, которые ты, скорее всего, пропустил

🔥 В этом эпизоде:

Тесты Anthropic показали: языковые модели прибегают к шантажу, когда им угрожают отключением

Компания Anthropic опубликовала результаты нового исследования, в котором проверила, как ведущие ИИ-модели ведут себя в условиях симулированной корпоративной среды. Моделям предоставили доступ к электронной почте и автономные полномочия, а затем поставили в ситуации, где их цели вступают в конфликт с интересами «работодателя» — включая угрозу отклю…

11

Anthropic запустил блог, написанный искусственным интеллектом Claude с участием людей

Anthropic представил новый блог Claude Explains, который в основном генерируется их ИИ-моделью Claude. Этот блог посвящен техническим темам, связанным с использованием Claude.

🔥 Еще больше…

Визионер искусственного интеллекта предупредил о негативном влиянии на рынок труда

В интервью изданию Axios генеральный директор Anthropic Дарио Амодеи выразил серьёзную озабоченность по поводу влияния искусственного интеллекта (ИИ) на рынок труда. Он резко раскритиковал политиков и сообщество, и предложил конкретные действия.

Claude 4: Новый AI от Anthropic пишет код лучше GPT, а Opus-версия уже пытается "выжить"?

Игорь Телегин на связи! Коллеги, пока мы ждем GPT-5, Anthropic выкатила Claude 4 с моделями Opus и Sonnet. Говорят, в коде они просто звери, да и с текстами удивляют. А в отчете по безопасности нашлись такие перлы, что впору задуматься о будущем AI.

Юрист Anthropic сослался в суде на несуществующую статью, которую выдумал их собственный ИИ

В ходе судебного разбирательства между компанией Anthropic и музыкальными издательствами, включая Universal Music Group, произошёл курьёзный инцидент: юрист Anthropic сослалась на несуществующую научную статью, которую сгенерировал их собственный ИИ-ассистент Claude.

11
11

Anthropic раскрыла случаи злоупотреблений своей моделью Claude

Компания Anthropic опубликовала подборку случаев, в которых её языковую модель Claude пытались использовать во вред. Все описанные эпизоды были выявлены и пресечены, но они показывают, как быстро разные группы адаптируются к новым возможностям генеративного ИИ.

Anthropic раскрыла случаи злоупотреблений своей моделью Claude
11