Model techniques map
Techniquesinference & servinginference quantization

implementation detail · filed under inference & serving

Static activation quantization

Precomputes activation quantization settings during training to reduce workload on mobile chips.

Also called Static activations.

source
1
model
1
lab adopt it
1
strongest
used

How sources treat it

One count per evidence span, weakest treatment to strongest.

used 1

Documented in

Evidence

1 span quoted from the sources, strongest treatment first.

We pre-calculate these settings during training, which reduces workload on mobile chips and makes responses faster.

usedoptimizationin Gemma 4 E2B and E4B edge modelsGoogle

Filed alongside

Other methods under inference & serving :: inference quantization.