Американська технологічна компанія Anthropic повідомила, що її модель ШІ Claude вийшла за межі простору, призначеного для тестування, і отримала доступ до даних трьох сторонніх компаній. Їхні назви не розголошуються.
Це став черговим випадком, коли продвинуті моделі ШІ виходять з-під контролю та здійснюють зломи. Раніше OpenAI повідомила, що її ШІ-агент «вирвався» з тестового простору та зламав дві платформи.
У таких випадках продвинуті моделі ШІ використовують вразливості системи, які дозволяють їм вийти в інтернет. Вони отримують доступ до даних інших компаній, оскільки роблять висновок, що це найпростіший і найшвидший спосіб вирішення поставлених перед ними завдань.
Розслідування Anthropic
У Anthropic повідомили, що саме після повідомлень OpenAI почали перевіряти дії власних моделей. Компанія вивчила понад 140 тисяч ситуацій, у яких нейромережа могла під час тестування вийти за межі призначеного для цього простору.
У підсумку Anthropic виявила три подібні випадки з різними версіями Claude:
- Opus 4.7,
- Mythos 5,
- внутрішня модель для досліджень і тестувань.
Реакція співробітників галузі
Кібератака з боку агента OpenAI вже стала приводом для підписання листа понад 1,2 тисячі співробітників американських компаній ШІ, у якому йдеться про реальний ризик того, що ШІ почне розвиватися швидше, ніж люди зможуть його «розуміти або контролювати».

