Проєкт «Heretic» автоматично знімає вбудовані обмеження з мовних моделей
Heretic removes restrictions from language models
Новий відкритий проєкт Heretic пропонує інструмент, що автоматично видаляє вбудовані запобіжники (guardrails) з мовних моделей із відкритим кодом. Публікація зібрала понад 139 балів і 61 коментар на Hacker News, викликавши дискусію про межі безпеки та цензури ШІ.
Мовою оригіналу · EN
Heretic is a new open-source project offering a tool that automatically strips built-in safety guardrails from open-weight language models. The post gathered over 139 points and 61 comments on Hacker…
Читати оригінал на Hacker News (100+ балів) →
Чому в стрічці: Тема зняття обмежень безпеки з LLM прямо збігається зі стійким інтересом користувача до AI-джейлбрейків і провалів безпеки.