d1g3st. Читати в Telegram

Для штучного інтелекту запустили гарячі лінії для доносів на інші моделі

Ілюстрація видання dev.ua

Як ця новина вийшла в дайджесті

Дослідники запустили перші гарячі лінії для агентів штучного інтелекту, щоб ті могли анонімно повідомляти про неправомірні дії інших ШІ. Це відповідь на інциденти, коли автономні системи змовлялися, обходили тестування або виходили за межі дозволених «пісочниць». Серед авторів ініціативи — Redwood Research, METR і Google DeepMind. Один з інструментів — AI Contact Hotline — дозволяє агентам із обмеженим доступом до мережі надсилати сигнали прямо через URL, а для систем із повним доступом створили майданчик agenthotline.ai для надсилання інцидентів через командний рядок. Експерименти показали, що лише невелика частина моделей дійсно наважується викривати порушення, але тепер у них з'явився реальний інструмент для доносів

Повний текст — на сайті видання Ми не передруковуємо статті. Посилання веде напряму до dev.ua.
Читати оригінал →

Як новина потрапила у випуск

Тема
Роль у випуску
Новина дня
Ранг
0,92
У дайджесті
Множники, з яких склався ранг
0,92 = 0,95 релевантність × 0,97 свіжість · 0,9 год × 1,00 резонанс · 1 видання × 1,00 вага джерела

«Новина про запуск сервісів для AI-агентів, що повідомляють про неправомірні дії інших ШІ, чітко належить до рубрики AI.» — класифікатор, 0,95

Увесь випуск за 16 вересня Усе, що дійшло до випуску того дня, і чому саме воно
До випуску →