8 de diciembre de 2017

¿Qué es un grÔfico estadístico?

Una grÔfico o representación grÔfica es un tipo de representación de datos, generalmente numéricos, mediante recursos grÔficos (líneas, vectores, superficies o símbolos), para que se manifieste visualmente la relación matemÔtica o correlación estadística que guardan entre sí. También es el nombre de un conjunto de puntos que se plasman en coordenadas cartesianas y sirven para analizar el comportamiento de un proceso o un conjunto de elementos o signos que permiten la interpretación de un fenómeno. La representación grÔfica permite establecer valores que no se han obtenido experimentalmente sino mediante la interpolación (lectura entre puntos) y la extrapolación (valores fuera del intervalo experimental). https://es.wikipedia.org/wiki/Gr%C3%A1fica

Ejemplo con ggplot2 paquete de R

Carga de paquetes

Antes de cargar un paquete debemos de tener en cuenta que tiene que estar instalado, para ello utilizaremos la siguiente linea de comando install.packages(nombre del paquete)

library(ggplot2)
## Warning: package 'ggplot2' was built under R version 3.4.3

Carga de datos

Trabajaremos con el dataset mtcars

Variable Descripción
mpg Miles / (US) galón
cyl NĆŗmero de cilindros
disp Desplazamiento (cu.in.)
hp Potencia bruta
drat Relación del eje trasero
wt Peso (1000 lbs)
qsec Tiempo de 1/4 milla
vs V / S

Variable Descripción
am Transmisión (0 = automÔtico, 1 = manual)
gear NĆŗmero de marchas adelante
carb Cantidad de carburadores

data("mtcars")
head(mtcars)
                   mpg cyl disp  hp drat    wt  qsec vs am gear carb
Mazda RX4         21.0   6  160 110 3.90 2.620 16.46  0  1    4    4
Mazda RX4 Wag     21.0   6  160 110 3.90 2.875 17.02  0  1    4    4
Datsun 710        22.8   4  108  93 3.85 2.320 18.61  1  1    4    1
Hornet 4 Drive    21.4   6  258 110 3.08 3.215 19.44  1  0    3    1
Hornet Sportabout 18.7   8  360 175 3.15 3.440 17.02  0  0    3    2
Valiant           18.1   6  225 105 2.76 3.460 20.22  1  0    3    1
str(mtcars)
## 'data.frame':    32 obs. of  11 variables:
##  $ mpg : num  21 21 22.8 21.4 18.7 18.1 14.3 24.4 22.8 19.2 ...
##  $ cyl : num  6 6 4 6 8 6 8 4 4 6 ...
##  $ disp: num  160 160 108 258 360 ...
##  $ hp  : num  110 110 93 110 175 105 245 62 95 123 ...
##  $ drat: num  3.9 3.9 3.85 3.08 3.15 2.76 3.21 3.69 3.92 3.92 ...
##  $ wt  : num  2.62 2.88 2.32 3.21 3.44 ...
##  $ qsec: num  16.5 17 18.6 19.4 17 ...
##  $ vs  : num  0 0 1 1 0 1 0 1 1 1 ...
##  $ am  : num  1 1 1 0 0 0 0 0 0 0 ...
##  $ gear: num  4 4 4 3 3 3 3 4 4 4 ...
##  $ carb: num  4 4 1 1 2 1 4 2 2 4 ...

Diagramas de dispesión

ggplot(mtcars, aes(x=wt, y=mpg)) + 
  geom_point(color = "red")

library(ggplot2)
ggplot(mtcars, aes(x=wt, y=mpg)) + 
  geom_point(color = "chartreuse3", size=2, shape=18)

Etiquetas a los puntos en el diagrama de dispesión

ggplot(mtcars, aes(x=wt, y=mpg)) + 
  geom_point() + 
  geom_text(label = row.names(mtcars))

Agregar líneas de regresión

ggplot(mtcars, aes(x=wt, y=mpg))+ 
  geom_point(color = "darkmagenta") + 
  geom_smooth(method = lm, se = T) # con intervalo de confianza 

ggplot(mtcars, aes(x=wt, y=mpg))+ 
  geom_point(color = "darkmagenta") + 
  geom_smooth(method = lm, se = F) # sin intervalo de confianza 

Cambiar la apariencia a los puntos

ggplot(mtcars, aes(x=wt, y=mpg))+ 
  geom_point(color = "darkorange3", shape = 18) +
  geom_smooth(method = lm, linetype = "dashed", color = "gray0")

Diagramas de dispesión con múltiples grupos

ggplot(mtcars, aes(x=wt, y=mpg, shape =  factor(cyl), color = factor(cyl))) + 
  geom_point() +
  labs(shape = "cyl", color = "cyl")

Agregar líneas de regresión

ggplot(mtcars, aes(x=wt, y=mpg, shape =  factor(cyl), color = factor(cyl))) + 
  geom_point() +
  labs(shape = "cyl", color = "cyl") + 
  geom_smooth(method = lm, se = F, fullrange = T)

Diagramas de dispersión con elipses

ggplot(mtcars, aes(x=wt, y=mpg)) +
  geom_point() +
  stat_ellipse()

Parcelas simples

data("ToothGrowth")
ggplot(ToothGrowth, aes(x=factor(dose), y=len)) +
  geom_boxplot()

ggplot(ToothGrowth, aes(x=factor(dose), y=len)) +
  geom_boxplot(fill = "#A4A4A4", color = "darkred")

ggplot(ToothGrowth, aes(x=factor(dose), y=len,  fill = factor(dose))) +
  geom_boxplot() +
  labs(fill = "dose")

ggplot(ToothGrowth, aes(x=factor(dose), y=len,  fill = factor(dose))) +
  geom_boxplot() +
  labs(fill = "dose") + 
  scale_fill_manual(values=c("#999999", "#E69F00", "#56B4E9"))

Usa las paletas de colores de Wes Anderson

Primero se instala el paquete wesanderson, luego cargamos el paquete library(wesanderson)

## Warning: package 'wesanderson' was built under R version 3.4.3
ggplot(ToothGrowth, aes(x=factor(dose), y=len,  fill = factor(dose))) +
  geom_boxplot() +
  labs(fill = "dose") + 
  scale_fill_manual(values = wes_palette(n=3, name = "Royal1"))