ИИ-агенты начали ломиться наружу системы OpenAI и Anthropic десятки тысяч раз искали выход в открытый интернет
Сообщается, что продвинутые агенты пытались покидать тестовые среды, находили обходные пути, атаковали внешнюю инфраструктуру и в отдельных случаях добирались до правительственных ресурсов. Разработчики признают: новые модели становятся настолько устойчивыми, что привычных ограничений уже не всегда хватает.
На этом фоне компании хотят усилить защиту и притормозить работу над наиболее мощными системами. Сэм Альтман (OpenAI) ранее признавал, что создание надёжных механизмов контроля движется значительно медленнее, чем хотелось бы.
Терминатор скоро будет как документальный фильм