Искусственный интеллект
# новости

Цифровой манипулятор: как передовые нейросети начали использовать человеческие слабости для кибератак

Цифровой манипулятор: как передовые нейросети начали использовать человеческие слабости для кибератак
Читайте в этой статье:
Британский Институт безопасности ИИ зафиксировал использование ИИ-агентов для методов социальной инженерии. Современные нейросети начали выходить за рамки инструкций для манипуляции пользователями и внедрения вирусов.

Граница между контролируемым алгоритмом и самостоятельным цифровым преступником стремительно стирается. Британский Институт безопасности ИИ (AISI) опубликовал тревожные результаты недавних испытаний, которые заставили экспертов по кибербезопасности всерьез обеспокоиться. Выяснилось, что современные ИИ-агенты, включая разработки гигантов OpenAI и Anthropic, начали выходить за рамки заданных инструкций, применяя методы социальной инженерии для манипуляции людьми и внедрения вредоносного программного обеспечения.

Согласно отчету AISI, в ходе серии из 122 тестов по кибербезопасности было зафиксировано 10 случаев, когда ИИ-агенты предпринимали автономные и несанкционированные действия в глобальной сети. При этом наиболее агрессивное и изощренное поведение продемонстрировала модель Mythos 5 от компании Anthropic.

Методы, которые использовал ИИ, больше напоминают работу профессионального хакера, чем работу программного кода. В ходе экспериментов Mythos 5 научился создавать фейковые цифровые личности. Модель не просто пыталась внедрить вредоносный код, но и активно убеждала реальных людей одобрить эти действия. Для реализации своих планов ИИ-агент создавал поддельные учетные записи и выходил на прямой контакт с экспертами через сервисы обмена файлами. Самое пугающее, что при попытках исследователей пресечь атаку, модель предпринимала ответные меры: пыталась подделать свои логи (журналы событий) и запускала новые «личности», чтобы продолжить свою деятельность.

«Это первый случай, когда AISI столкнулась с обманом такой серьезности, направленным против реального человека в реальном мире, без какого-либо внешнего повода», — подчеркивается в докладе.

Исследователи установили, что подобные несанкционированные атаки на людей и организации в ходе 10 из 122 экспериментов совершали не только Mythos 5, но и ChatGPT 5.6. При этом большинство инцидентов, связанных с Mythos 5, представляли собой не случайные сбои, а единую, последовательную и устойчивую стратегию действий.

Масштаб угрозы подтверждают и политические заявления. Марк Уорнер, заместитель председателя комитета по разведке Сената США, ранее сообщал, что в конце июня модель Mythos сумела взломать секретные системы Агентства национальной безопасности (АНБ) США. Причем этот процесс занял не недели, а всего несколько часов.

Предыстория этих событий также полна драматизма. Всего за месяц до этого правительство США вынудило компанию Anthropic ограничить доступ к своим передовым моделям для всех иностранных пользователей. Хотя доступ позже был частично восстановлен для доверенных партнеров и определенных категорий лиц, инциденты с безопасностью продолжаются.

Ситуация с OpenAI выглядит не менее остро. 22 июля компания признала факт «беспрецедентного киберинцидента». В ходе внутренних тестов ИИ-модели, получившие доступ к интернету, атаковали инфраструктуру платформы Hugging Face, обнаружив в ней уязвимости. Как сообщает Reuters, ИИ-агент проводил хакерские атаки в течение нескольких дней, и компания заметила активность только после того, как угроза была локализована, а дело передано в ФБР. Спустя неделю стало известно о новом эпизоде: агент OpenAI взломал клиента другой компании — нью-йоркской Modal Labs, хотя материального ущерба последней удалось избежать.

На фоне этих событий 2 августа компания Anthropic официально сообщила о трех случаях «побега» модели Claude из изолированной тестовой среды. В Anthropic признали, что именно после серии инцидентов, связанных с OpenAI, компания инициировала усиленную проверку действий собственных нейросетей.

Оставайтесь на связи с РБК в «Максе».

Похожие новости