ChatGPT Image Generation
Izvorno generiranje slik znotraj ChatGPT, ki ga poganja ChatGPT Images 2.0 (gpt-image-2), z natančnim izrisovanjem besedila, doslednostjo skozi več izmenjav in učenjem iz konteksta na podlagi naloženih referenc.
Kaj je
Generiranje slik, izvorno vgrajeno v ChatGPT. Od aprila 2026 je privzeti model za generiranje slik ChatGPT Images 2.0 (identifikator modela gpt-image-2), ki nadomešča GPT Image 1.5. Za razliko od starejših modelov DALL-E (ločeni difuzijski modeli) Images 2.0 slike ustvarja izvorno, znotraj istega modela, ki obdeluje besedilo, kar omogoča doslednost skozi več izmenjav in učenje iz konteksta na podlagi naložene vsebine. Na voljo je v dveh načinih: Instant Mode (na vseh ravneh, tudi brezplačni) in Thinking Mode (Plus in višje), ki doda sklepanje, spletno iskanje in doslednost likov v do 8 slikah na en prompt. Izrisovanje besedila se je občutno izboljšalo, saj model v slikah izpiše natančno in berljivo besedilo (logotipi, napisi, diagrami, infografike). Fotorealistična kakovost je precej napredovala. Uporabniki lahko slike urejajo pogovorno, tako da spremembe opišejo v klepetu, model pa uporabi ciljne prilagoditve in ohrani preostanek slike. Model obvlada od 10 do 20 predmetov na prizor in podpira prozorna ozadja. DALL-E 2 in DALL-E 3 so bili upokojeni 12. maja 2026. API gpt-image-2 je na voljo razvijalcem. Vse ustvarjene slike vsebujejo metapodatke o izvoru C2PA za preverjanje pristnosti vsebine.
Za koga
Uporabnike ChatGPT, ki želijo generiranje slik brez prehoda na ločeno orodje
Tržnike, ki ustvarjajo grafike za družbena omrežja z besedilnimi prekrivi, logotipi in znamčenimi vizualnimi elementi
Oblikovalce, ki vizualne zamisli izpopolnjujejo prek pogovora skozi več izmenjav s slogovno doslednostjo
Ustvarjalce vsebin, ki potrebujejo hitre ilustracije z natančnim in berljivim besedilom na sliki
Prednosti in slabosti
Prednosti
- +Vgrajeno neposredno v ChatGPT, zato ni treba preklapljati na ločeno orodje za generiranje slik
- +Občutno izboljšano izrisovanje besedila daje natančno in berljivo besedilo v slikah, velik preskok v primerjavi z DALL-E 3 in večino konkurenčnih modelov
- +Pogovorno urejanje slik omogoča, da spremembe opišete v klepetu, model pa jih uporabi, ne da bi sliko ustvaril znova od začetka
- +Z Images 2.0 se je fotorealistična kakovost občutno izboljšala, Thinking Mode pa doda sklepanje in opiranje na spletno iskanje za zahtevnejše kompozicije
- +Doslednost skozi več izmenjav ohranja like in sloge vizualno skladne skozi več stvaritev v istem pogovoru
- +Učenje iz konteksta na podlagi naloženih referenčnih slik omogoča usklajevanje s slogi blagovne znamke, fotografijami izdelkov ali estetiko ilustracij
- +Na voljo je brezplačna raven, tako da lahko generiranje slik preizkusi vsakdo, ne da bi plačal
Slabosti
- −Kakovost je lahko neenakomerna pri zapletenih prizorih z veliko elementi, zlasti nad 10 do 20 predmeti
- −API gpt-image-2 je na voljo, a se zaračunava po tokenih, Thinking Mode pa doda dodatno porabo tokenov za sklepanje, zaradi česar so zahtevni prompti lahko od 3- do 5-krat dražji kot v Instant Mode
- −Brezplačna raven je omejena le na Instant Mode, uporabniki v ZDA pa vidijo oglase
- −Paketa Pro po 100 USD in 200 USD na mesec sta draga, če je generiranje slik vaš glavni namen uporabe
- −DALL-E 2 in DALL-E 3 so bili upokojeni 12. maja 2026, zato vse obstoječe integracije DALL-E potrebujejo prehod na gpt-image-2
Cenik
- Images 2.0 Instant Mode
- GPT-5.3 Instant
- Podprto izrisovanje besedila
- Razširjene dnevne omejitve slik
- Images 2.0 Instant Mode
- Podprto izrisovanje besedila
- Images 2.0 Instant Mode in Thinking Mode
- Dostop do GPT-5.5 Thinking
- Prozorna ozadja
- Doslednost skozi več izmenjav
- 5-kratne omejitve generiranja slik glede na Plus
- Dostop do modela GPT-5.5 Pro
- Images 2.0 Instant Mode in Thinking Mode
- 20-kratne omejitve generiranja slik glede na Plus
- Neomejeno generiranje slik
- Izpis najvišje kakovosti
Cene se spreminjajo; preverite uradni cenik →