Strategija cen in optimizacija stroškov

2 min branja

Primerjava cene vodilnih modelov: izhod na 1M tokenov (USD)

$0

Najcenejši vhod na 1M tokenov (2.0 Flash Lite)

0%

Popust Batch API

0%

Prihranek s predpomnjenjem konteksta

Gemini APIClaude APIOpenAI API
Vodilni model2.5 Pro: 1,25/10 USDOpus 4.6: 5/25 USDGPT o3: 2/8 USD
Srednji razred2.5 Flash: 0,30/2,50 USDSonnet 4.5: 3/15 USDGPT 4.1: 2/8 USD
Proračunski2.0 Flash Lite: 0,075/0,30 USDHaiku 4.5: 1/5 USD4.1 mini: 0,40/1,60 USD
Brezplačna ravenDa (radodarna)NeNe
Predpomnjenje konteksta90 % prihranka90 % prihranka50 % prihranka (omejeno)
Paketni popust50 % popusta50 % popusta50 % popusta

Prompte za Pro ohranite pod 200K tokeni

Modela Gemini 2.5 Pro in 3 Pro pri promptih, ki presegajo 200K tokenov, zaračunavata dvojne cene (2,50 USD za vhod in 15 USD za izhod namesto 1,25/10 USD). Če vaši prompti redno presegajo ta prag, razmislite o predpomnjenju konteksta ali preoblikovanju pristopa, da ostanete pod njim.
Strategija cen in optimizacija stroškov | Gemini API | NativeAI Hub