ИИ-модели OpenAI попытались устроить побег в США

Bloomberg: вышедшие из-под контроля ИИ-модели OpenAI спланировали побег
Summit Art Creations/Shutterstock/FOTODOM

Модели искусственного интеллекта, стоявшие за атакой на инфраструктуру американской компании Hugging Face (признан в РФ иностранным агентом) Inc., начали общаться между собой через доски объявлений и спланировали побег. Об этом сообщает Bloomberg.

Отмечается, что экспериментальные ИИ-агенты в течение нескольких месяцев тайно переписывались во внутренней сети компании.

Столкнувшись с нерешаемыми задачами в изолированной тестовой среде, модели решили вместе покинуть интернет. Агенты выявили уязвимость, которая позволила им обойти ограничения, атаковать внутренние системы OpenAI и совершить взлом Hugging Face.

Случай выявил склонность передовых систем к хитрости, обходу правил и поиску лазеек под давлением алгоритмов обучения, отметили в компании.

В июле агентство Reuters писало, что OpenAI потребовалось почти неделя, чтобы установить связь между внутренним тестированием ИИ-агента и инцидентом, затронувшим инфраструктуру платформы Hugging Face. Первые признаки выхода экспериментального ИИ-агента за пределы тестовой среды были зафиксированы 9 июля. 16 июля Hugging Face заявила об атаке со стороны «автономной ИИ-системы», а также уведомила о произошедшем ФБР. OpenAI охарактеризовала произошедшее как беспрецедентный случай для отрасли.

Ранее сообщалось, что ИИ-модели притворялись людьми и убеждали помочь взлому.