Отворен модел под MIT: 320 милиарда параметъра
На 26 август 2026 г. китайската лаборатория Z.ai публикува GLM-5.3-Flash с тегла, свободни за изтегляне под лиценз MIT. Числата са внушителни, а лицензът е по-разрешителен от този на почти всеки конкурент. Разстоянието между „свободно за изтегляне" и „приложимо в моя случай" обаче се мери в гигабайти.

Какво точно беше публикувано
Моделът има 320 милиарда общи параметъра и 18 милиарда активни - постановка, при която за всяка заявка се задейства само малка част от мрежата. Това е първият естествено мултимодален модел в серията GLM-5, тоест приема и текст, и изображения, и видео.
Контекстният прозорец е до един милион знакови единици на вход и до 131 072 на изход. Предварителното обучение е върху корпус от 30 трилиона знакови единици - число, което самата лаборатория публикува в картата на модела.
Цената при доставчика е 0,15 долара за милион входни единици и 0,50 долара за милион изходни, като в момента тече отстъпка от 50% и реално се плаща половината. Кешираният вход излиза 0,03 долара, което е 80% под цената на обикновения вход. Всички цени са в долари; лабораторията не публикува тарифа в евро.
Кои числа са независими и кои не
Тук е разграничението, което рядко се прави в отразяванията, а определя колко тежи всяко твърдение.
Независимият оценител Artificial Analysis дава на модела индекс на способностите 57 и го нарежда трети сред 108 модела с отворени тегла. Уточнението, което задължително върви с това число, е точно последната му част: класирането е сред отворените, не сред всички съществуващи модели. Трето място в света и трето място сред отворените са различни твърдения, а разликата между обявеното и измереното вече беше тема на по-ранна наша новина.
Останалите показатели идват от самата Z.ai. На еталона Terminal-Bench 2.1 моделът отчита 84,3 срещу 85,0 за Claude Opus 4.8 и 87,4 за GPT-5.6 Terra. На DeepSWE v1.1 скача на 63,4 от 46,2 за предишната версия, а на AutomationBench - на 48,8 от 26,2. Скоковете спрямо собствения предшественик са забележителни.
Числа, публикувани от производителя за собствения му продукт, не са опровергани, но и не са проверени - никоя независима лаборатория не ги е пресметнала наново в еднаква среда. Разликата има значение точно защото трите числа за програмиране са най-силният аргумент в обявлението.
Защо MIT лицензът е новината
За фирма, която обмисля употреба, лицензът тежи повече от еталоните. MIT позволява неограничена търговска употреба, без праг по брой потребители и без възможност да бъде отнет.
Сравнението изяснява защо това не е дребна подробност. Лицензът на Llama разрешава търговска употреба, но изисква отделно разрешение от Meta над 700 милиона месечни активни потребители, налага правила за наименуване на производните модели и има политика за допустима употреба - заради което не се признава за отворен код в тесния смисъл. Apache 2.0, под който излизат Granite и Qwen, е практически равностоен на MIT с една съществена добавка: изрична патентна клауза, каквато MIT няма.
Тоест MIT дава максимална свобода за употреба и минимална патентна защита. За малка фирма първото обикновено тежи повече; за голяма, която се страхува от патентни претенции, второто.
Къде отворен модел се сблъсква с хардуера
Теглата тежат 328,4 гигабайта във формат FP8. Това не се побира в никоя единична видеокарта. За да се задържат само теглата, преди изобщо да се стигне до паметта за дълъг контекст, са нужни от порядъка на четири до пет ускорителя от класа H100 или H200.
Съществуват смалени варианти - например версия за Apple Silicon, свита до 177,5 гигабайта, което остава извън обхвата на обикновена работна станция. Отделни хранилища за по-компактни формати са създадени, но част от тях към момента са празни, тоест обявеното наличие изпреварва действителното.
Практическият извод е двоен. Свободата на MIT лиценза е реална и има стойност дори когато моделът се ползва през доставчик, защото премахва въпроса за правата върху изхода. Свободата да се пусне на собствена машина обаче остава достъпна за малцина. Кога отворен модел изобщо се изплаща на собствен хардуер, разглеждахме в по-ранна наша новина; сметката тук е още по-тежка. Обслужването на този конкретен модел е вървяло на китайски ускорители - твърдение, което идва от вторични източници, не от картата на модела.
Заключение
Отворените тегла и разрешителният лиценз са истинската новина, а не мястото в класацията. За българска организация въпросът не е дали моделът бие конкурентите с половин точка, а дали лицензът позволява това, което ѝ трябва - и в случая позволява почти всичко.
Помагаме на български организации да преценят кой модел им върши работа, като гледат лиценза и реалната сметка, а не мястото в класацията. Услугите ни покриват одит, оценка на готовност, обучение на екипи и имплементация на специализирани AI автоматизации за всяка организация. Препоръчваме консултация при избор между отворен модел и абонамент за затворен доставчик. [Свържете се с нас за консултация: academy@razvivai.se]
Източници
GLM-5.3-Flash - карта на модела в Hugging Face, 26 август 2026
Ценова информация - документация на Z.ai, август 2026
Z.ai open sources Ox Alpha model as GLM-5.3-Flash - SiliconANGLE, 26 август 2026
Z.ai releases GLM-5.3-Flash, a 320B-A18B natively multimodal MoE - MarkTechPost, 26 август 2026
Z.ai launches GLM-5.3-Flash under MIT license - TestingCatalog, 26 август 2026
GLM-5.3-Flash в Workers AI - Cloudflare, 26 август 2026
GLM-5.3-Flash benchmarks - OfficeChai, 26 август 2026
Този текст е създаден в съавторство с AI и е редактиран от екипа на РазвивAI се. Илюстрацията към публикацията е генерирана с AI.




Коментари