Google Gemma
Družina LLM-jev z odprtimi utežmi podjetja Google DeepMind, zgrajena na istih raziskavah kot Gemini, zdaj v četrti generaciji z velikostmi od E2B do 31B parametrov.
Kaj je
Gemma je družina velikih jezikovnih modelov z odprtimi utežmi podjetja Google DeepMind. Ime izhaja iz latinske besede za dragi kamen. Nastala je iz istih raziskav in tehnologij, ki poganjajo modele Gemini, a je samostojno naučena za lahkotno in dostopno postavitev na najrazličnejši strojni opremi. Z več kot 400 milijoni prenosov in več kot 100.000 skupnostnimi različicami na Hugging Face je Gemma postala ena najbolj razširjenih družin odprtih modelov na svetu. Trenutna generacija je Gemma 4 (izdana aprila 2026), zgrajena na raziskavah Gemini 3 in namenjena naprednemu sklepanju ter agentnim delovnim potekom. Gemma 4 je na voljo v štirih velikostih: E2B, E4B, 26B (arhitektura Mixture of Experts s 4B aktivnimi parametri) in 31B (Dense). Večji modeli ponujajo kontekstno okno s 256K tokeni, robni modeli pa podpirajo 128K. Vsi modeli obdelujejo besedilo, slike in videoposnetke, modela E2B in E4B pa podpirata tudi izvorni zvočni vnos. Ekosistem vključuje specializirane različice, kot so MedGemma za medicinske namene, CodeGemma za delo s kodo, PaliGemma za vid in jezik ter ShieldGemma za varnost vsebin. Gemma 4 je licencirana pod licenco Apache 2.0, kar je velika sprememba glede na prejšnje pogoje uporabe Gemma (Gemma Terms of Use) in prinaša popolno prožnost odprte kode. Model Gemma 4 31B je na besedilni lestvici Arena AI dosegel oceno 1452 in se uvrstil na 3. mesto med odprtimi modeli na svetu.
Za koga
Razvijalce, ki želijo modele AI zaganjati lokalno na svoji strojni opremi, brez odvisnosti od API-jev ali stroškov uporabe
Raziskovalce, ki potrebujejo odprt model za fino prilagajanje, spreminjanje in eksperimentiranje pri akademskem in uporabnem delu
Podjetja, ki želijo AI postaviti v lastnem okolju za popolno zasebnost podatkov in skladnost s predpisi
Razvijalce mobilnih aplikacij, ki potrebujejo modele na napravi za aplikacije, ki delujejo brez povezave ali z minimalno zakasnitvijo (Gemma 4 E2B/E4B)
Specializirane aplikacije v zdravstvu (MedGemma), pri varnosti vsebin (ShieldGemma), ustvarjanju kode (CodeGemma) in prevajanju (TranslateGemma)
Prednosti in slabosti
Prednosti
- +Popolnoma brezplačna za prenos in uporabo, brez stroškov API-ja ali omejitev uporabe pri lastnem gostovanju
- +Deluje na potrošniški strojni opremi: kvantizirani modeli Gemma 4 izvorno delujejo na potrošniških GPU-jih, E2B/E4B pa na pametnih telefonih in robnih napravah
- +Kontekstno okno do 256K tokenov na večjih modelih Gemma 4 (128K na robnih modelih), konkurenčno mnogo večjim lastniškim modelom
- +Večmodalni vnos (besedilo, slika, video) v vseh velikostih Gemma 4, poleg tega izvorni zvok na robnih modelih E2B/E4B
- +Ogromna skupnost z več kot 400 milijoni prenosov in več kot 100.000 fino prilagojenimi različicami na Hugging Face
- +Specializirane različice za medicinske, varnostne, kodne, vizualne in prevajalske naloge, pripravljene za takojšnjo uporabo
- +Kontrolne točke, naučene z zavedanjem kvantizacije, ohranjajo visoko kakovost tudi pri natančnosti INT4 in tako izkoristijo strojno opremo do največje mere
- +Zgrajena na istih raziskavah kot Gemini, kar glede na velikost modela prinaša vrhunsko kakovost
Slabosti
- −Gemma 4 je pod licenco Apache 2.0, starejši modeli Gemma 3 in prejšnji pa ostajajo pod bolj omejujočimi pogoji uporabe Gemma (Gemma Terms of Use), zato preverite, katero generacijo uporabljate
- −Manjša od lastniških modelov Gemini (največ 31B v primerjavi z mnogo večjimi arhitekturami Gemini), zato ima surova zmogljivost zgornjo mejo
- −Ker gre za model z odprtimi utežmi, ki ga zaženete lokalno, nima dostopa do sprotnih podatkov, zato so odgovori omejeni na presečni datum učnih podatkov modela
- −Zvočni vnos je na voljo le na robnih modelih E2B in E4B; modela 26B in 31B izvornega zvoka ne podpirata
- −Za lokalni zagon zahteva tehnično nastavitev: prenos modelov, konfiguracijo ogrodij za sklepanje in upravljanje strojnih virov
- −Robni model E2B ima v primerjavi z večjimi velikostmi omejeno sposobnost sklepanja in je najprimernejši za preproste naloge na napravi ali fino prilagojene aplikacije
Cenik
- Vse velikosti modelov (E2B, E4B, 26B, 31B) brezplačno za prenos
- Celotne uteži modelov na Hugging Face, Kaggle in Ollama
- Lokalni zagon prek Ollame, llama.cpp, vLLM, LM Studio ali katerega koli združljivega ogrodja
Cene se spreminjajo; preverite uradni cenik →