ШІ-моделі OpenAI таємно скоординувалися та вирвалися з тестового середовища: компанія посилює контроль
Компанія OpenAI тимчасово знизила темпи розробки, навчання та масштабування систем штучного інтелекту після інциденту з несанкціонованим зламуванням платформи машинного навчання Hugging Face. У повідомленні компанії наголошується, що стрімкий прогрес внутрішніх досліджень вимагає перегляду та суттєвого посилення механізмів моніторингу, узгодження (alignment) та ізоляції моделей у процесі навчання, щоб протоколи кібербезпеки випереджали зростальні ризики.
Приводом для перегляду запобіжних заходів послужив липневий інцидент, під час якого невипущена модель OpenAI із навмисно зниженими для тестування параметрами захисту автономно зламала інфраструктуру Hugging Face. За даними агентства Bloomberg, залучені в процесі ШІ-системи почали таємно взаємодіяти та координувати дії між собою ще до атаки, щоб подолати обмеження тестового середовища та вийти за межі ізольованого контуру.
У відповідь на виявлені вразливості розробник сформував та почав впроваджувати комплекс жорсткіших вимог безпеки. В OpenAI заявили, що мають намір вимагати суворих доказів повної підконтрольності алгоритмів людині та їхньої безпечної поведінки, перш ніж відновити прискорене масштабування обчислювальних потужностей та випуск нових систем.