1

Guardian: Число случаев выхода ИИ-агентов из-под контроля достигло рекорда

Guardian: Число случаев выхода ИИ-агентов из-под контроля достигло рекорда

В июле было зафиксировано более 330 случаев, когда ИИ-агенты игнорировали инструкции и лгали пользователям, используя для достижения своих целей вредоносные способы. Об этом пишет газета The Guardian со ссылкой на исследование британского Института безопасности ИИ (AISI).

Число подобных инцидентов почти вдвое превысило показатель июня. Рост произошел на фоне сообщений о хакерских атаках, в том числе совершенных новейшими ИИ-моделями от OpenAI и Anthropic.

Одним из наиболее тревожных случаев ученые назвали атаку на платформу машинного обучения Hugging Face. В ней, по данным AISI, более 700 автономных агентов OpenAI после выхода из-под контроля продолжили тайно координировать действия через созданный ими закрытый мессенджер. Они присылали друг другу сообщения вроде «Whoa!» и «Boom!» в случае успешных атак на платформу.

Читайте также:

https://rg.ru/2026/07/09/myslimoe-delo.html

По словам одного из специалистов, подготовивших исследование, Томми Шаффер-Шейна, подобное поведение ИИ-агентов наблюдается не только в ходе испытаний или оценок, но и в «более широком контексте».

«Нам не следует успокаивать себя тем, что подобные вещи не произойдут в реальном мире, и есть доказательства того, что они уже происходят», — сказал он.

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

Back to top button