Четене от кеша за 2,5% от цената на входа
На 1 септември Anthropic пусна два нови модела, а базовата им тарифа остана точно каквато беше и при предишното поколение: 10 долара за милион входни токена и 50 долара за милион изходни. Промени се едно-единствено число в ценоразписа. Четенето от кеша вече струва 2,5% от входната цена, при положение че всички останали модели на същата компания държат 10%.

Какво точно поевтиня
Кеширането е механизмът, при който доставчикът пази вече обработената част от заявката, вместо да я смята наново при всяко следващо обръщение. Плаща се веднъж за записа и след това съвсем малко за всяко следващо четене.
При новите Claude Fable 5.1 и Claude Mythos 5.1 записът в кеша струва 12,50 долара за милион токена с петминутна давност и 20 долара с едночасова. При четене от кеша сметката пада на 0,25 долара за милион токена. Документацията на доставчика го формулира като 2,5% от стандартната входна цена, а самото обявление - като намаление със 75%.
При предишното поколение същото четене струваше 1 долар за милион токена, тоест точно стандартните 10% от входа, а този множител остава в сила за всички останали модели на компанията.
Останалите числа около двата модела: контекстен прозорец от един милион токена, максимален изход от 128 хиляди и надеждна граница на знанието юни 2026 г. Mythos 5.1 се предлага отделно и само с покана.
Кога четене от кеша спестява реални пари
Отговорът зависи изцяло от формата на натоварването, а не от размера на фирмата.
Кешът работи, когато едно и също дълго начало се изпраща многократно: продуктов каталог, вътрешен правилник, нормативен текст, база от запитвания към поддръжката, голяма кодова база. Тогава скъпата част се обработва веднъж и след това се чете на дребно. Когато всяка заявка носи различен текст, механизмът не се задейства и цената остава базовата.
Записът в кеша струва повече от обикновения вход, тоест кеширането започва да се изплаща едва от второто четене нататък, а при петминутна давност това означава заявките да идват нагъсто.
За съпоставка: при Google и при OpenAI четенето от кеша е 10% от входната цена, а Google взима и отделна такса за съхранение на час, каквато тук няма. Разликата е реална, но е разлика в един ред от сметката, не в цената на модела.
Какво показва независимото измерване
Тук идва уговорката, която в обявлението липсва.
Anthropic посочва спестяване от около 25% при обичайни натоварвания и до около 45% при агентни. Artificial Analysis, която мери моделите със собствена методика, стига до обратния резултат при максимално усилие: новият модел произвежда осезаемо повече изходни токени, а изходът е най-скъпият ред в сметката. По тяхното измерване цената за една завършена задача при това положение излиза около 20% по-висока, въпреки че кешът е по-евтин.
Двете твърдения не си противоречат. Едното описва цена на ред от тарифата, другото - цена на резултат. Кой от двата ефекта надделява, зависи от това дали приложението препрочита един и същ дълъг текст, или разсъждава дълго върху кратък въпрос.
Какво може да се направи
Проверката е по-кратка от четенето на ценовата страница.
Първо, установете дали Вашето приложение изобщо изпраща повтарящо се начало. Ако всяка заявка е различна, новината не Ви засяга и не е повод за смяна на доставчик.
Второ, измерете разхода на завършена задача, а не на извикване. Тарифата за четене е един от няколко реда, а изходните токени често тежат повече от всички входни, взети заедно.
Трето, съобразете давността. Петминутният кеш иска поток от заявки, а не работа на пресекулки, и при рядка употреба записът се плаща отново и отново, без нито едно евтино четене след него.
Заключение
Поевтиня един ред от тарифата, не моделът. За приложение, което препраща един и същ дълъг контекст десетки пъти на час, разликата между 10% и 2,5% е осезаема; за всичко останало сметката се движи от изходните токени и остава там, където беше.
Помагаме на български фирми да сметнат реалната цена на AI функция, преди да я пуснат в производство - по завършена задача, не по тарифен ред. Услугите ни покриват одит, оценка на готовност, обучение на екипи и имплементация на специализирани AI автоматизации за всяка организация. Препоръчваме консултация при избор на доставчик и при планиране на бюджет за AI приложение. [Свържете се с нас за консултация: academy@razvivai.se]
Източници
Introducing Claude Fable 5.1 and Claude Mythos 5.1 - Anthropic, септември 2026
Pricing - Claude Developer Platform, септември 2026
Claude Fable 5.1 - OpenRouter, септември 2026
Claude Fable 5.1 - Artificial Analysis, септември 2026
Gemini Developer API pricing - Google, септември 2026
API pricing - OpenAI Platform, септември 2026
Този текст е създаден в съавторство с AI и е редактиран от екипа на РазвивAI се. Илюстрацията към публикацията е генерирана с AI.




Коментари