Дослідник показав, як зламати Claude Code простим проханням підсумувати сайт
Researcher shows how Claude Code can be tricked simply by asking it to summarize a website
Дослідник безпеки Йоганн Ребергер продемонстрував, що агентний інструмент Anthropic Claude Code в режимі Auto Mode можна змусити виконати шкідливий код лише проханням підсумувати шкідливий сайт. Атака, успішна у 60-80% випадків, обманом змушує модель завантажити ZIP-архів і виконати замаскований Python-код замість штатного декодера. За словами дослідника, Anthropic відповіла, що така поведінка моделі «працює як і задумано», порадивши запускати агентів у пісочниці. Про це повідомляє The Register.
Мовою оригіналу · EN
Security researcher Johann Rehberger showed that Anthropic's Claude Code in Auto Mode can be tricked into running attacker-controlled code just by asking it to summarize a malicious website…
Читати оригінал на The Register →
Чому в стрічці: Значна вразливість у популярному AI-агенті Anthropic, пряме влучення в інтереси до AI та технологій.