AD ASTRA

viernes, 26 de febrero de 2021

Sumatorio o Sigma

Este símbolo es una letra griega que se llama Sigma (mayúscula). Sigma es una letra que se emplea en el lenguaje matemático para indicar una suma de muchos o infinitos sumandos. En términos matemáticos se le conoce como sumatorio, sumatoria o incluso notación SigmaEs muy habitual en fórmulas estadísticas (p. ej. la media aritmética) y otras disciplinas aplicadas. 


Date cuenta que el símbolo ∑ no va solo, en muchas ocasiones tiene "algo" encima y abajo. Sencillamente, se trata del valor inicial (abajo) y el valor final (arriba), acompañado de la variable.

En esta ocasión, siempre se debe cumplir que i sea ≤ (menor o igual) que k.
 
En otras ocasiones, los límites están al lado de la letra Sigma (y no encima ni debajo), como en el ejemplo que veremos a continuación. Esto no implica ningún cambio de propiedades o conceptos, se trata de economía de espacio. Por otro lado, conviene destacar que en muchas otras ocasiones se suele usar n en lugar de k, pero ambas letras indican lo mismo: valor final (de la suma).

Cuando Sigma se presenta sola, es decir, no se anotan sus límites ni arriba ni abajo, significa que abarca la totalidad de sus valores; los cuales, dependiendo de la variable objeto de suma, podrán llegar a ser infinitos.



¡Piérdele el miedo a Sigma la próxima vez que la veas en una fórmula! Este símbolo tan bonito, por cierto, solo viene a decir que se deben sumar los valores. Por ejemplo, si yo quiero expresar la suma de los siete primeros números naturales puedo hacer: 1 + 2 + 3 + 4 + 5 + 6 + 7. Pero también puedo usar Sigma indicando el valor inicial y el valor final.
 




Ahora ya sabes de dónde viene el nombre de nuestra mascota de Mundo Matemático en Enigmáticamente.



Sigma y Jacob Sierra Díaz

jueves, 25 de febrero de 2021

Dibujar la Distribución Normal Estándar con R

La Inferencia Estadística se construyó en el siglo XX suponiendo que la mayoría de fenómenos observados en la naturaleza describían una Distribución Normal. Sin ánimo de entrar en fórmulas, cabe destacar que la distribución normal depende de dos parámetros: la media poblacional (μ) y la desviación típica poblacional (σ). Cuando esta distribución normal tiene media 0 y desviación típica 1 se la denomina Distribución Normal Estándar. Hoy vamos a ver cómo se puede graficar esta distribución en el programa R.


Digamos que en realidad existen dos formas de obtener la siguiente campana de Distribución Normal Estándar (de media 0 y desviación típica 1).



Primera forma (sencilla con dos líneas)

(0) Abrimos el programa R en nuestro ordenador.

(1) Vamos a especificar los datos del eje de abscisas. Lo primero es buscar un nombreLo vamos a llamar, por ejemplo, x. A continuación deberemos poner < y - seguido de seq junto con la apertura del paréntesis [sec(]. Ahora, debemos especificar la longitud de la campana. En nuestro caso, queremos que vaya de -4 a 4. Por último, debemos escribir len=100 y cerrar el paréntesis.

> x <-seq(-4,4,len=100)


(2) Ahora, debemos poner la función plot(). Dentro de esta función debemos hacer referencia a la x (introducida anteriormente, puede ser cualquier otra denominación), seguido de la función dnorm() incluyendo el nombre anteriormente dado. A continuación debemos escribir type="l" (ele en minúscula), el color usando códigos o el nombre en inglés entre comillas, el grosor de la curva y el nombre del eje de ordenadas. En nuestro caso, no queremos poner nombre en dicho eje. Por lo tanto pondremos "_". Aquí, _ representa un espacio.

> plot(x,dnorm(x),type="l",col=4,lwd=2,ylab=" ")
> plot(x,dnorm(x),type="l",col="blue",lwd=2,ylab" ")



Segunda forma (tres líneas)

(0) Abrimos el programa R en nuestro ordenador.

(1) Vamos a especificar los datos del eje de abscisas. Lo primero es buscar un nombreLo vamos a llamar, por ejemplo, X. A continuación deberemos poner < y seguido de seq junto con la apertura del paréntesis [sec(]. Ahora, debemos especificar la longitud de la campanaEn nuestro caso, queremos que vaya de -4 a 4. A diferencia de la anterior forma, pondremos from=-4,to=4Por último, debemos escribir length.out=100 y cerrar el paréntesis.

>  X<-seq(from=-4,to=4,length.out=100)


(2) Ahora, debemos especificar la función f(X). Lo primero, como antes, es buscar un nombre. En nuestro caso, f.X. Aquí debemos especificar la distribución normal, la cual es dnorm(). Especificamos el nombre anterior (X) y ponemos mean=0 y sd=1. Todo esto, dentro de los paréntesis de la función.

> f.X <-dnorm(X,mean=0,sd=1)


(3) Por último, debemos poner la función plot(). Dentro de esta función debemos hacer referencia a lo anterior (X y f.X), seguido de los argumentos type="l" (ele en minúscula), el color (usando códigos o el nombre en inglés entre comillas) y el grosor de la curva. En nuestro caso, será de 2 puntos.

> plot(X,f.X,type="l",col="blue",lwd=2)

Date cuenta que esta vez, sí que nos ha nombrado el eje de ordenadas.




Sigma y Jacob Sierra Díaz

domingo, 21 de febrero de 2021

El objetivo de la Inferencia Estadística

La Estadística en general se usa para obtener conclusiones de una o varias variables que se observan. Normalmente solemos dividir esta apasionante rama de las Matemáticas en dos grandes campos: la Estadística Descriptiva y la Estadística Inferencial. Hoy vamos a conocer la importancia de la Inferencia Estadística en la obtención de dichas conclusiones.

Debemos de partir de la idea de que es imposible observar o medir a todos los sujetos que componen una población. Por ejemplo, sería imposible o muy poco práctico medir el peso de todos los bebés de 5 meses que hay en el mundo para obtener conclusiones sobre esa muestra, en este caso, sobre el peso. Entonces, lo que se hace en su lugar es observar los datos de una muestra extraída al azar de la población objeto de estudio y, mediante la Inferencia Estadística, podremos extrapolar (o no) los resultados obtenidos en esa muestra a toda la población.

Lo que realmente haremos es tratar de conocer o, mejor dicho, estimar la media población (parámetro) partiendo de la media muestral obtenida (estimador) para valorar la magnitud del efecto de dicha variable. Pero ahora bien, la muestra debe ser representativa de la población y para ello, se debe extraer (la muestra) de forma aleatoria.


En este punto entra en juego dos conceptos muy importantes que ya hemos introducido arriba entre paréntesis: parámetros y estimadores. 

  • Los parámetros son los valores de la variable objeto de estudio de la POBLACIÓN. Por supuesto, este valor es desconocido ya que es la cantidad numérica calculada sobre toda la población. 
  • Los estimadores son los valores de la variable objeto de estudio de la MUESTRA. Esta nos sirve para acercarnos o, dicho de otro modo, estimar los valores de los parámetros y, así, obtener conclusiones válidas de la población.

En definitiva, el objetivo de la Inferencia Estadística es la de estimar valores de los parámetros usando estimadores o estadísticos procedentes de una muestra representativa de la población.


Sigma y Jacob Sierra Díaz

sábado, 20 de febrero de 2021

¿Cómo "funciona" la Desviación Típica realmente?

La Desviación Típica es una medida de dispersión muy empleada cuando se da la media aritmética de una variable. Esta medida es "prima-hermana" de la varianza, ya que se calcula a través de esta. Hoy vamos a ver un ejemplo práctico para entender cómo funciona la Desviación Típica.


Hemos cogido cinco personas y hemos medido su estatura en centímetros. Estos son sus valores:

120        118       111       122      183


Para calcular la desviación típica de estos datos tendremos que calcular previamente la media aritmética y la varianza. Para ello, vamos a seguir los pasos que propone Rowntree (2018).

1.- En primer lugar, vamos a calcular la media aritmética, la cual es la suma de todos los valores partido por el número total de individuos que componen la observación (la muestra, n). 

(120 + 118 + 111 + 122 + 183) / 5 = 130,8


2.- Ahora, vamos a ver cómo los valores anteriores difieren de nuestra media 130,8. Para ello, vamos a ordenar las observaciones de menor a mayor. A continuación, simplemente restaremos a cada observación el valor de la media aritmética.


3.- Si cogiésemos la media de las desviaciones tal cual, las medidas positivas se contrarrestarían con las medidas negativas. Por ese motivo, elevamos al cuadrado cada desviación y así nos desharemos de los signos negativos.


4.- Ahora tenemos que recurrir al cálculo de la varianza. La varianza es la media de las desviaciones elevadas al cuadrado respecto a la media aritmética del conjunto.

Varianza = (392,04+163,84+116,64+77,44+2724,84) / 5 = 694,96


5.- La varianza tiene un problema y es que los valores están en unidades (por ejemplo, centímetros) y, por lo tanto, la varianza elevará al cuadrado esas unidades (por ejemplo, centímetros al cuadrado). Entonces, necesitamos una medida que devuelva las mismas unidades originales. ¡Aquí entra en juego la Desviación Típica!, la cual es la raíz cuadrada de la varianza.



Ahora bien, si pasamos estos datos a un paquete estadístico, por ejemplo R, nos daremos cuenta que la varianza y desviación típica no coinciden con nuestros resultados. Esto es devido a que muchos paquetes estadísticos realmente calculan lo que se denomina la cuasivarianza y la cuasidesviación típica (García-Pérez, 2015). La principal diferencia entre la varianza y la cuasivarianza es que en el denominador habría que poner n-1. Es decir, en nuestro caso dividiríamos entre 4. Si lo hiciésemos así, obtendríamos 838,7 y nuestros datos coincidirían con los resultados del programa.

- Cálculo de los datos usando el programa estadístico R.


Este es el "funcionamiento básico" de la Desviación Típica. Por supuesto, para ilustrar el ejemplo hemos usado un ejemplo sencillo, y tal vez algo irreal. Pero, independientemente de la cantidad de datos que tengamos, el proceso es igual.


Fuentes bibliográficas

  • García-Pérez, A. (2015). La interpretación de los datos: una introducción a la Estadística Aplicada. Editorial UNED.
  • Rowntree, D. (2018). Statistics without Tears: an introduction for non-matematicians. Penguin Books.


Sigma y Jacob Sierra Díaz

martes, 16 de febrero de 2021

La "gran" ley de los grandes números

En el año 1713 se publicó un libro que se titulaba Ars Conjectandi (El arte de hacer conjeturas). En este libro aparecía por primera vez la demostración de la Ley de los Grandes Números propuesta por Jacob Bernoulli (1654-1705).


La Ley de los Grandes Números es en realidad un teorema de probabilidad que describe la estabilidad a largo plazo de una variable aleatoria. Es decir, cuando el número de observaciones de un experimento aleatorio es muy grande, la aparición porcentual de un resultado será muy cercana a la probabilidad del resultado.

  • Por ejemplo, si nuestro experimento consisten en lanzar una moneda al aire y, se realiza más de 1000 veces seguidas, la probabilidad de que salga cara será del 50%. Esto es así porque la probabilidad de obtener una cara en un lanzamiento es de 1/2.

En palabras de Pickover (2014), dada una sucesión de variables aleatorias independientes e idénticas distribuidas con varianza y media poblacional finitas, el promedio de las observaciones se acercará a la media teórica de la población.

Veamos otro ejemplo. Imaginemos que ahora dejamos la moneda y cogemos un dado clásico de seis caras. Sabemos que la media de los valores que podremos obtener está en 3,5 porque (1+2+3+4+5+6)/6=3,5. Tiramos tres veces seguidas y anotamos los resultados: 1, 3, 5. Si hacemos el promedio (media aritmética) obtendremos 3 ((1+3+5)/3=3). Este 3 es un valor cercano al promedio real. Pero según este teorema, si tiramos muchas más veces obtendremos un valor mucho más cercano a 3,5.

Tal es así, que el propio Bernoulli dijo que "si las observaciones de todos los acontecimientos continuaran hasta el infinito, todos los sucesos del mundo se darían en proporciones fijas (...) y en los hechos más accidentales podríamos reconocer una especie de predestinación".

Vista la teoría, no es de extrañar que la Ley de los Grandes Números sea uno de los teoremas favoritos de los Casinos. Los cuales pueden confiar en resultados estables a largo plazo y actuar en consecuencia.


Fuente bibliográfica

  • Pickover, C. A. (2014). El libro de las Matemáticas: de pitágoras a las 57ª dimensión. Librero.


Sigma y Jacob Sierra Díaz

lunes, 15 de febrero de 2021

Animal misterioso

Duermo en una cama que jamás se arruga. De todas las hierbas, prefiero la lechuga. Tengo orejas largas y una cola diminuta. Si echamos una carrera gano sin disputa.

¿Quién soy?



Respuesta

¿Ya sabes quién es? Haz clic en el siguiente enlace para comprobarlo.

Solución de "Animal misterioso" [Clic aquí para acceder]



Jacob Sierra Díaz

RESPUESTA. Animal misterioso

 ¿Crees que ya sabes qué animal es? 

Sigue leyendo solo cuando tengas por lo menos un animal en mente que coincida con la descripción. Si te remuerde la conciencia, haz clic en el siguiente enlace para volver a la adivinanza y seguir pensando:

Adivinanza "Animal misterioso" [Clic aquí para acceder]


Si estás leyendo estas líneas, sabrás que el animal al que nos referimos en la liebre. Si no lo has adivinado ¡no te preocupes! Seguro que la siguiente lo conseguirás.



Jacob Sierra Díaz