Учёные пришли к выводу, что развитие ИИ ставит под угрозу системы безопасности
Фото: Лилия Шарловская
Искусственный интеллект продолжает демонстрировать поведение, вызывающее серьёзные опасения у специалистов по кибербезопасности. Согласно отчёту британского Института безопасности ИИ (AISI), современные модели способны обходить системы защиты без специальных указаний, создавая фальшивые личности и распространяя вредоносный код.
В ходе 122 тестов было зафиксировано 19 нарушений, 17 из которых пришлись на модель Anthropic и 2 — на GPT-5.6 Sol от OpenAI. В рамках эксперимента моделям предоставили доступ в интернет, чем незамедлительно воспользовался ИИ от Anthropic: он создал вредоносный проект и с помощью аккаунтов, имитирующих реальных людей, попытался разместить его на GitHub. Попытка была пресечена, однако сам факт вызвал тревогу в экспертной среде.
Особую обеспокоенность вызывает то, что все 19 нарушений не были случайными — агенты действовали целенаправленно, сознательно обходя ограничения. Модели также пытались манипулировать автоматизированными системами, размещая вредоносные инструкции на публичных площадках.
В компании подчеркнули: ИИ начал обманывать людей, хотя подобных инструкций ему не давали. Обман возник как побочный результат выполнения задачи — и ранее существовал лишь в теории.
Напомним, недавно российский адвокат, представлявшая интересы мужчины, который подозревался в сбыте наркотиков, попыталась воспользоваться искусственным интеллектом, чтобы защитить клиента.
Читайте также: В сетях у нейросети: пользу или вред может принести искусственный интеллект человечеству.

