OpenAI оголосила про запровадження нових політик безпеки, спрямованих на контроль за розробкою та тестуванням нейромереж. Заходи включають детальніший моніторинг моделей у процесі їх створення, а також посилення контролю на етапі пост-тренування. Зміни були анонсовані після інциденту з платформою Hugging Face, про який стало відомо 26 липня.
У компанії зазначили, що нові правила частково зумовлені розвитком можливостей моделі Astra та загальним темпом прогресу у сфері ШІ. Після інциденту з Hugging Face OpenAI на два тижні призупиняла навчання з підкріпленням (RL), проте роботу над менш ризикованими моделями вже відновлено. Найбільші проєкти залишаються на паузі до завершення додаткових перевірок.
Віцепрезидентка з досліджень Амелія Глейз наголосила, що суворість контролю зростатиме пропорційно до складності моделей. Нова система безпеки включає посилену ізоляцію мереж, щоб запобігти несанкціонованому доступу до інтернету у разі компрометації окремих інструментів. Також впроваджено систему моніторингу, що аналізує логи активності та дії інструментів з метою виявлення підозрілої поведінки протягом 30 хвилин.

