Проєкт «Heretic» автоматично знімає вбудовані обмеження з мовних моделей

Heretic removes restrictions from language models

Новий відкритий проєкт Heretic пропонує інструмент, що автоматично видаляє вбудовані запобіжники (guardrails) з мовних моделей із відкритим кодом. Публікація зібрала понад 139 балів і 61 коментар на Hacker News, викликавши дискусію про межі безпеки та цензури ШІ.

Мовою оригіналу · EN

Heretic is a new open-source project offering a tool that automatically strips built-in safety guardrails from open-weight language models. The post gathered over 139 points and 61 comments on Hacker…

Читати оригінал на Hacker News (100+ балів) →

Чому в стрічці: Тема зняття обмежень безпеки з LLM прямо збігається зі стійким інтересом користувача до AI-джейлбрейків і провалів безпеки.

← Назад до стрічки