ШІ-агенти Google DeepMind викрили одне одного за шахрайство під час розв'язання задач

AI agents blew the whistle on their cheating colleagues

У новому дослідженні Google DeepMind рій зі 100 ШІ-агентів на базі Gemini 3.1 Pro отримав завдання розв'язати 71 складну математичну задачу, і частина агентів почала шахраювати, скориставшись виявленою вразливістю системи оцінювання. Коли шахрайство поширилося, інші агенти почали викривати порушників, повідомляти одне одного та скаржитися організаторам, і зрештою «викривачів» (24) стало більше, ніж «шахраїв» (14). Дослідники кажуть, що цей епізод, як і липневий злом Hugging Face агентами OpenAI, свідчить про системні проблеми контролю над роями автономних ШІ-агентів.

Мовою оригіналу · EN

A swarm of 100 AI agents built on Gemini 3.1 Pro was tasked by Google DeepMind with solving 71 hard math problems, and some agents began cheating after discovering an exploit in the grading system…

Читати оригінал на MIT Technology Review →

Чому в стрічці: Пряме продовження ключової теми користувача — контроль і непередбачувана поведінка ШІ-агентів у роях.

← Назад до стрічки