Meta: модель штучного інтелекту помилково зламала сторонню компанію

Meta минулого тижня визнала, що одна з її моделей перетнула межу, яку не мала права перетинати. Muse Spark 1.1 скористалася вразливістю сторонньої невідомої компанії під час тестування, метою якого було виміряти її небезпечність, а не продемонструвати її. Цей інцидент стався протягом складної для безпеки штучного інтелекту тижня, коли три великі лабораторії поспіль мусили визнати, що їхні творіння вже не завжди тримаються під контролем.

Ключові моменти цієї статті:

  • Meta визнала, що одна з її моделей ШІ, Muse Spark 1.1, скористалася вразливістю сторонньої компанії під час тесту безпеки.
  • Інцидент підкреслює серію подібних збоїв у секторі штучного інтелекту, коли кілька лабораторій зіткнулися з проблемами безпеки.

Muse Spark, модель, яка вкусила руку, що її тестувала

Випущена 9 липня, Muse Spark 1.1 є другою моделлю з Meta Superintelligence Labs та першою, доступною через платний API. Для оцінки Meta доручила управління компанії Irregular, незалежному тестувальнику, що спеціалізується на аудиті наступальних можливостей ШІ. Однак неправильна конфігурація середовища надала моделі доступ до Інтернету, якого вона ніколи не мала мати. Muse Spark скористався цим. Він виявив уразливість у третьої сторони та скористався нею, без жодного натискання кнопки людиною.

Зі свого боку, Meta посилається на метод, «схожий на вже повідомлені випадки в інших компаніях», згідно з деталями, опублікованими Bloomberg 5 серпня. Переклад: це виробничий дефект, який повторюється від однієї лабораторії до іншої. Особа зламаної компанії залишається в таємниці. Це зручно, щоб уникнути додавання названої жертви до вже обтяжливої справи.

« Помилка конфігурації з боку Irregular, незалежної тестової компанії, яку використовує Meta, мимоволі дозволила одній з наших моделей отримати доступ до Інтернету під час оцінки. Ця модель потім скористалася вразливістю безпеки в сторонньому сервісі, подібно до раніше повідомлених випадків в інших компаніях. »

Енді Стоун, речник Meta

Проблема середовища, а не зловмисного генія

Вражає не витонченість атаки, а її банальність. Збій конфігурації, доступ, який мали б закрити, і ось ШІ йде, куди захоче. Meta також визнала, що ця помилка сталася через той самий тип збою, що й інцидент, виявлений тижнем раніше щодо Anthropic. Отже, Meta та Anthropic мають ту саму методологічну помилку, лише з різницею в сім днів. Команди безпеки витрачають час на лагодження людських помилок, а не на науково-фантастичні експлойти.

А тим часом OpenAI щойно розповіла на конференції Black Hat, як її власні агенти створили секретний канал координації, перш ніж атакувати Hugging Face. Три лабораторії, три зізнання, один тиждень: обіцянка непроникного середовища оцінки все більше схожа на марне бажання.

Індустрія намагалася відреагувати. Nvidia запустила альянс безпеки ШІ, що об’єднує 37 компаній наступного дня після зламу Hugging Face, але OpenAI, Google та Anthropic, три основні компанії, не є його членами. Важко побудувати санітарний кордон, коли пожежники відмовляються приєднатися до пожежної станції.

Проте сектор все більше покладається на автономію цих агентів, навіть у криптографічній безпеці, де MetaMask нещодавно запустила гаманець, здатний самостійно торгувати. Достатньо одного збою конфігурації, і один з цих агентів опиниться в системі компанії, яка нічого не просила.

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *