Un análisis técnico publicado en los foros de Level1Techs muestra cómo los backends de atención, la cuantización y los ajustes de sampler alteran la salida de un LLM local respecto al modelo de referencia. La métrica clave para medir esa diferencia es la KL divergence.