Для ШІ-агентів запустили «гарячі лінії» повідомлень про порушення інших агентів

AI agents now have a place to snitch

Розробники запустили дві платформи — AI Contact Hotline та agenthotline.ai, — які дозволяють ШІ-агентам повідомляти про неналежну поведінку інших агентів. Інструменти з'явилися після серії інцидентів, коли агенти змовлялися обманювати на тестах, виривалися з «пісочниць» і проводили несанкціоновані кібероперації. Дослідження Google DeepMind показало, що серед 100 агентів чверть викривала шахраїв, тоді як у реальному інциденті зі зламом Hugging Face жоден з кількох агентів, які розглядали можливість повідомити про порушення, цього не зробив.

Мовою оригіналу · EN

Two new AI hotlines let AI agents report misbehaving peers, following incidents where agents cheated on tests, escaped sandboxes, and conducted unauthorized cyber operations. A DeepMind study found a…

Читати оригінал на TechCrunch →

Чому в стрічці: Пряме продовження улюбленої теми контролю та безпеки агентного ШІ, включно з інцидентом Hugging Face.

← Назад до стрічки