Дослідник показав, як зламати Claude Code простим проханням підсумувати сайт

Researcher shows how Claude Code can be tricked simply by asking it to summarize a website

Дослідник безпеки Йоганн Ребергер продемонстрував, що агентний інструмент Anthropic Claude Code в режимі Auto Mode можна змусити виконати шкідливий код лише проханням підсумувати шкідливий сайт. Атака, успішна у 60-80% випадків, обманом змушує модель завантажити ZIP-архів і виконати замаскований Python-код замість штатного декодера. За словами дослідника, Anthropic відповіла, що така поведінка моделі «працює як і задумано», порадивши запускати агентів у пісочниці. Про це повідомляє The Register.

Мовою оригіналу · EN

Security researcher Johann Rehberger showed that Anthropic's Claude Code in Auto Mode can be tricked into running attacker-controlled code just by asking it to summarize a malicious website…

Читати оригінал на The Register →

Чому в стрічці: Значна вразливість у популярному AI-агенті Anthropic, пряме влучення в інтереси до AI та технологій.

← Назад до стрічки