Prihranki pri predpomnjenju promptov po družinah modelov
90 % POPUSTA
GPT-5
90 % prihranka
75 % POPUSTA
GPT-4.1
75 % prihranka
50 % POPUSTA
GPT-4o / serija o
50 % prihranka
Vhodni strošek GPT-5 na milijon tokenov po cenovni ravni
0%
Največji prihranek pri predpomnjenju promptov (GPT-5)
0%
Popust Batch API
0%
Prihranek s pametnim usmerjanjem modelov
Kombinirajte strategije za največji prihranek
Batch API (50 % popusta) združite s predpomnjenjem promptov (do 90 % popusta na predpomnjene vhode) in usmerjanjem modelov (najcenejši še ustrezen model). Obremenitev, ki na ravni GPT-5 Standard brez predpomnjenja stane $1.000 na mesec, bi s paketno obdelavo, predpomnjenjem promptov in usmerjanjem preprostih podnalog na GPT-5 Nano lahko stala manj kot $200 na mesec.