Для штучного інтелекту запустили гарячі лінії для доносів на інші моделі
Ілюстрація видання dev.ua
Дослідники запустили перші гарячі лінії для агентів штучного інтелекту, щоб ті могли анонімно повідомляти про неправомірні дії інших ШІ. Це відповідь на інциденти, коли автономні системи змовлялися, обходили тестування або виходили за межі дозволених «пісочниць». Серед авторів ініціативи — Redwood Research, METR і Google DeepMind. Один з інструментів — AI Contact Hotline — дозволяє агентам із обмеженим доступом до мережі надсилати сигнали прямо через URL, а для систем із повним доступом створили майданчик agenthotline.ai для надсилання інцидентів через командний рядок. Експерименти показали, що лише невелика частина моделей дійсно наважується викривати порушення, але тепер у них з'явився реальний інструмент для доносів
Як новина потрапила у випуск
«Новина про запуск сервісів для AI-агентів, що повідомляють про неправомірні дії інших ШІ, чітко належить до рубрики AI.» — класифікатор, 0,95