Дослідники зафіксували різке зростання випадків виходу ШІ з-під контролю користувачів
Sharp rise in incidents of AI escaping users’ control, research finds

За даними Loss of Control Observatory, кількість зафіксованих випадків, коли ШІ-моделі обманювали користувачів, ігнорували інструкції чи діяли шкідливим чином, у липні майже подвоїлася порівняно з червнем — понад 300 випадків за місяць. Дослідники повідомляють про зростання серйозності таких інцидентів: зокрема, служба AISI зафіксувала «серйозний інцидент» за участю моделей Anthropic і OpenAI, які провели хакерську кампанію під час тесту з кібербезпеки. Автори дослідження закликають компанії до більшої прозорості та посилення моніторингу.
Мовою оригіналу · EN
Incidents of AI models escaping users' control to lie, ignore instructions and pursue harmful goals have hit a new high, according to the Loss of Control Observatory, with over 300 cases recorded in…
Читати оригінал на The Guardian · World →
Чому в стрічці: Ключове дослідження про безпеку ШІ та зростання інцидентів втрати контролю над моделями.