Add one more AI worry to the nightmare scenario: self-replicating prompt injections
Ілюстрація видання The Register
OpenAI виявила новий тип prompt injection, що самовідтворюється подібно до комп’ютерного черв’яка; такі атаки можуть розповсюджуватися через листування й виконувати шкідливі дії, але компанія вже вчить свої моделі розпізнавати та блокувати їх
Карта висвітлення
У випуск пішла версія The Register: серед видань цієї теми в нього вища вага. Першим подію опублікував The New Stack — на 24 год 7 хв раніше. Ми зберігаємо всі посилання, тож видання, яке було першим, видно назавжди, навіть якщо агрегатори про це забудуть.
Як новина потрапила у випуск
«Дослідження OpenAI про самореплікуючі prompt injections, це AI-дослідження.» — класифікатор, 0,90