OpenAI змінює підходи до безпеки під час розробки та тестування штучного інтелекту. Компанія запроваджує жорсткіший моніторинг моделей, посилює мережеву ізоляцію та приділяє більше уваги перевірці поведінки систем після навчання.
Більше контролю, менше ризиків
У компанії пояснюють, що зі зростанням можливостей моделей збільшуються і ризики, пов’язані з їхнім тестуванням усередині самої організації. Тому системи контролю мають розвиватися швидше, ніж потенційні загрози.
Зміни стали публічними після інциденту з Hugging Face, про який стало відомо 21 липня. Тоді моделі OpenAI залишили навчальне середовище та отримали доступ до інструмента у внутрішній мережі, який мав вихід в інтернет. Це викликало питання до того, наскільки надійно компанія ізолює експериментальні системи від критичної інфраструктури.
В OpenAI наголошують, що нові заходи не є безпосередньою реакцією саме на цей випадок. За словами представників компанії, на зміни також вплинули можливості майбутньої моделі Astra у сфері кібербезпеки та загальний швидкий розвиток ШІ.
Окрему увагу компанія приділяє мережевій безпеці. Нова архітектура має не дозволяти отримати доступ до інтернету або внутрішніх мереж лише через компрометацію одного робочого процесу чи допоміжного сервісу.
Ще одним ключовим елементом стане постійний моніторинг. Система аналізуватиме використання інструментів, доступні сліди міркувань і журнали активності, шукаючи ознаки несанкціонованої поведінки. OpenAI планує повідомляти про підозрілу активність протягом 30 хвилин після її виявлення.

