Optimizacija stroškov: predpomnjenje, paketna obdelava in izbira modela

Vsi modeli, vse ravni2 min branja

Strošek na milijon vhodnih tokenov po metodi optimizacije

0%

Največji prihranek s predpomnjenjem promptov

0%

Popust Batch API na vse tokene

0K

Največ zahtev na paket

Haiku 4.5Sonnet 4.6Opus 4.8
Vhod / MTok1 USD3 USD5 USD
Izhod / MTok5 USD15 USD25 USD
Paketni vhod0,50 USD1,50 USD2,50 USD
Paketni izhod2,50 USD7,50 USD12,50 USD
Predpomnjeno branje (na MTok)0,10 USD0,30 USD0,50 USD
Najboljše zaUsmerjanje, razvrščanjeVečina produkcijskih obremenitevZapleteno sklepanje, agenti

Seštevajte popuste

Popusta pri predpomnjenju promptov in Batch API se seštevata. Pri velikem izvajanju vrednotenj s predpomnjenimi sistemskimi prompti za predpomnjeni del plačate ceno predpomnjenega branja (0,1-kratnik), za vse prek Batch API pa 50-odstotni popust. Pri obremenitvi z Opus 4.8 lahko to učinkovite stroške vhoda za predpomnjene tokene v paketnem načinu zniža s 5 USD/MTok na 0,25 USD/MTok.
Optimizacija stroškov: predpomnjenje, paketna obdelava in izbira modela | Anthropic API | NativeAI Hub