A Google Gemma 4 modellje jelentősen felülmúlja a korábbi verziókat
A Google Gemma 4 modellje 1,2-1,8-szor jobb teljesítményt nyújt, különösen a QAT és MTP funkciókkal, egy RTX 3090-es kártyán tesztelve.

A Google Gemma 4 modellje jelentős, 1.2-szeres vagy akár 1.8-szoros teljesítménynövekedést mutat a korábbi verziókhoz képest a Reddit felhasználóinak tesztjei alapján. Az eredményeket különösen a kvantált (QAT) és a multimodalitást (MTP) támogató verziók esetében mérték.
A Reddit egyik felhasználója, aki egy RTX 3090-es kártyán futtatta a modellt, arról számolt be, hogy a Gemma 4 12 milliárd paraméteres verziója kiemelkedő eredményeket ért el. Más tesztek szerint a modell képes több mint 400 token/másodperc sebességre is, különösen kódgenerálási feladatoknál.
Kapcsolódó: Google Gemma 4
Teljesítmény és sebesség
A tesztek azt mutatják, hogy a Gemma 4 12B modell képes volt elérni a 50 token/másodperc sebességet, ami kiválóan alkalmas eszközvezérlési feladatokra. A kvantálás mértéke befolyásolja a sebességet: míg a Q8-ról Q6-ra való csökkenés csupán 2-3%-os teljesítményvesztést jelent, addig a Q6-ról Q4-re való visszalépés már 15%-os lassulást okozhat.
Kapcsolódó: Qwen 3.6-Plus
Kvantálás és teljesítmény
A Gemma 4 modelljének tesztelése során az RTX 3090-es kártya bizonyult a legmegfelelőbb hardvernek, a modell 12 milliárd paraméteres verziója pedig a legjobb eredményeket hozta.
Kapcsolódó: APEX MoE modellek