PrismML випустила модель Bonsai 2 27B зі стисненням у 9 разів без втрати якості

Bonsai 2 27B: Near-Lossless Compression in a 9x Smaller Footprint

Компанія PrismML представила модель Ternary Bonsai 2 27B — стиснуту версію Qwen3.8 27B, яка займає лише 5,9 ГБ пам'яті, що більш ніж у 9 разів менше за оригінал. За словами розробників, модель зберігає 98,2% продуктивності повної версії у завданнях з міркування, кодування, зору та агентних дій. Модель випущена під ліцензією Apache 2.0 і працює локально на пристроях NVIDIA та Apple.

Мовою оригіналу · EN

PrismML released Ternary Bonsai 2 27B, a compressed version of Qwen3.8 27B that uses ternary weights to shrink the footprint to 5.9GB — over 9x smaller than the full-precision model — while retaining…

Читати оригінал на Hacker News (100+ балів) →

Чому в стрічці: Належить до пріоритетної теми AI — ефективний локальний реліз моделі зі стисненням.

← Назад до стрічки