PrismML випустила модель Bonsai 2 27B зі стисненням у 9 разів без втрати якості
Bonsai 2 27B: Near-Lossless Compression in a 9x Smaller Footprint
.png)
Компанія PrismML представила модель Ternary Bonsai 2 27B — стиснуту версію Qwen3.8 27B, яка займає лише 5,9 ГБ пам'яті, що більш ніж у 9 разів менше за оригінал. За словами розробників, модель зберігає 98,2% продуктивності повної версії у завданнях з міркування, кодування, зору та агентних дій. Модель випущена під ліцензією Apache 2.0 і працює локально на пристроях NVIDIA та Apple.
Мовою оригіналу · EN
PrismML released Ternary Bonsai 2 27B, a compressed version of Qwen3.8 27B that uses ternary weights to shrink the footprint to 5.9GB — over 9x smaller than the full-precision model — while retaining…
Читати оригінал на Hacker News (100+ балів) →
Чому в стрічці: Належить до пріоритетної теми AI — ефективний локальний реліз моделі зі стисненням.