Аналіз: вартість виконання завдань ШІ впала на два порядки за 2026 рік

Tokens too cheap to meter

Автор блогу зібрав дані, які показують, що вартість виконання завдань за допомогою мовних моделей падає на кілька порядків щороку завдяки прогресу в GPU, архітектурах Mixture-of-Experts і Mamba та рушіях інференсу на кшталт vLLM. За його висновками, найближчим часом обмежувальним фактором використання ШІ стане не кількість токенів, а якість моделей і доступ до них. Автор також прогнозує, що моделі рівня фронтир зможуть працювати локально на побутовому обладнанні вже за 3-6 років.

Мовою оригіналу · EN

The price of using machine learning intelligence is decreasing by several orders of magnitude a year and shows no signs of slowing. The author argues LLMs will soon be integrated into computing as…

Читати оригінал на Hacker News (100+ балів) →

Чому в стрічці: Аналітичний огляд економіки ШІ-моделей цікавий для теми AI, хоча це не термінова новина.

← Назад до стрічки