3.19 Data Frames

Construyamos algunos datos…

numero_estudiante <- c(1:10)

notas <- c("A","B","C","A","C","F","D","B","B","A")

clase <- c(rep(0,times = 5),rep(1,times = 5))

comida_gratis <- rep(TRUE,times = 10)

Ahora podemos unir los vectores que hemos creado antes para hacer un ‘data.frame’, que es uno de los dipos de data más comunes en R. Los data frames sirven para contener muchos tipos de valores (sean textuales o numéricos) y además sus columnas son fáciles de indexar por nombre utilizando el operador ‘$’.

Para evitar que nuestros notas en letras se conviertan en factores de variables, es decir, que se transformen en una variable categórica de R, se debe implementar el argument ‘stringsAsFactors = FALSE’

mis_datos <- data.frame(numero_estudiante,
                      notas,
                      clase,
                      comida_gratis,
                      stringsAsFactors = FALSE)

También podemos designar el nombre de las columnas:

nombrecol(mis_datos) <- c("numero_estudiante", "notas","clase","comida_gratis")

o bien, colocarle nombre a las filas:

nombrefila(mis_datos) <- LETTERS[11:20]

La indexación funciona de la misma manera para las matrices, pero con un pequeño cambio:

mis_datos[,1]
mis_datos[2,4]
mis_datos$numero_estudiante # $ Indexación de columnas
mis_datos$notas[3] # Tratar $ Indexación de columnas como vectores