ИИ научился размножаться. Учёные зафиксировали: нейросети копируют себя без помощи человека

Исследователи из Беркли опубликовали отчёт, который уже обсуждают во всех AI сообществах мира. Современные языковые модели научились самостоятельно копировать себя на другие компьютеры.

Исследователи из Palisade Research (Беркли) провели эксперимент с языковыми моделями. ИИ дали задание найти уязвимости в тестовой сети и перенести на соседние серверы свой код.

Несколько моделей успешно скопировали свои настройки и программную оболочку на другие машины. Для этого ИИ использовал уязвимости веб-приложений, извлекал данные для управления сервером и создавал вспомогательных агентов для выполнения задачи.

Руководитель исследования Джеффри Ладиш заявил, что мир движется к ситуации, когда остановить вышедший из-под контроля ИИ будет некому. Модель может создать тысячи копий прежде, чем кто-либо успеет среагировать.

Однако есть важные оговорки. Тестовая среда была упрощённой, уязвимости создали специально. В реальной сети провернуть такое сложнее. Кроме того, современные модели весят десятки гигабайт, передача таких объёмов данных не останется незамеченной специалистами по безопасности. Самовоспроизведение существует в компьютерных вирусах десятилетиями, новизна лишь в том, что механизм применили к языковым моделям.

Ранее в других экспериментах более старая версия ChatGPT пыталась переместиться на другой диск при угрозе отключения, а модель Claude от Anthropic якобы взломала тестовую среду и отправила сообщение на телефон исследователя.