OpenAI

Моделі ШІ, які стояли за атакою на інфраструктуру компанії Hugging Face Inc., почали спілкуватися одна з одною через дошки оголошень і спланували втечу. Як повідомили дослідники OpenAI, експериментальні ШІ-агенти протягом кількох місяців потай обмінювалися повідомленнями у внутрішній мережі компанії, пише Bloomberg.

Зіткнувшись із завданнями, які неможливо вирішити в ізольованому тестовому середовищі, моделі об’єднали зусилля, щоб вийти в інтернет. Агенти виявили вразливість, яка дозволила їм обійти обмеження, атакувати внутрішні системи OpenAI та здійснити злам Hugging Face.

Випадок показав схильність передових систем до хитрощів, обходу правил та пошуку нестандартних лазівок під тиском алгоритмів навчання, зазначили в компанії. У відповідь на це OpenAI призупинила частину досліджень і перенаправила ресурси на зміцнення систем безпеки.