whisper : quantize encoder only

This commit is contained in:
Georgi Gerganov
2023-11-16 16:19:02 +02:00
parent bebf0da983
commit ec96d68402
2 changed files with 26 additions and 23 deletions

View File

@@ -162,6 +162,7 @@ bool whisper_model_quantize(const std::string & fname_inp, const std::string & f
"encoder.conv2.bias",
"encoder.positional_embedding",
"decoder.positional_embedding",
"decoder.*",
};
if (!ggml_common_quantize_0(finp, fout, ftype, { ".*" }, to_skip)) {