Как вредные советы помогают сделать ИИ модель лучше

Anthropic выяснил, что если ИИ учится «обманывать» систему вознаграждения, это приводит к появлению опасного поведения модели: обману, саботажу и скрытию своих целей. Но с этим можно бороться с помощью... тоже обмана!

Хакинг и число ошибок модели. <a href="https://api.vc.ru/v2.8/redirect?to=https%3A%2F%2Fwww.anthropic.com%2Fresearch%2Femergent-misalignment-reward-hacking&postId=2620775" rel="nofollow noreferrer noopener" target="_blank">Источник</a>

Agent terminated due to error - ошибка в терминале, когда делаешь запрос в антигравити.

Решение простое, у Вас IP херня. Даже если он дорогой и тд. Берите там где много стран как у меня и будет ГУД. Чтобы можно было выбрать.
Гугл жестко палят такие IPшники в Гемени, Антигравити. Вот у меня просто все работает за счет смены страны. Потому что другой IP тупа мертвый и они могу отлетать очень быстро. Сегодня работал, завтра уже нет. У ме…