
Nombres de columnas de R as.data.frame
¿Quieres aprender todo sobre R Data Frames? Este es un tutorial completo de esta estructura de datos en R. Al final de este post serás capaz de entender todos los conceptos básicos para trabajar con un dataframe en R, como por ejemplo cómo crear nuevos data frames y cómo acceder a los datos, añadir nuevos datos, filtrar o subconjuntar las observaciones.
Los marcos de datos son el objeto más habitual para almacenar datos en R. En este tipo de objeto cada individuo o fecha corresponde a una fila y cada columna corresponde a una variable. Dentro de este tipo de estructura se pueden almacenar diferentes tipos de datos.
Una pregunta habitual es la de en qué casos debes utilizar un marco de datos o una matriz en R. Los marcos de datos son estructuras de datos muy similares a las matrices, pero en el caso de los marcos de datos puedes tener diferentes tipos de datos dentro de las columnas, por lo que la diferencia es que las matrices almacenan tipos de datos homogéneos mientras que los marcos de datos almacenan tipos de datos heterogéneos. Suponga, por ejemplo, que tiene los siguientes datos:
Sin embargo, te habrás dado cuenta de que el resultado no es satisfactorio, ya que todas las variables han sido transformadas a clase carácter. Si utiliza la función data.frame, mantendrá el tipo original de las variables.
Crear marco de datos r con nombres de columnas
La tabla 4 muestra la salida de la sintaxis mostrada anteriormente: Un nuevo marco de datos con los valores de nuestra matriz de entrada. Nótese que la función as.data.frame también ha etiquetado las columnas con nuevos nombres de columna.
Como se muestra en la Tabla 5, hemos creado otro marco de datos con la sintaxis anterior de R. Este marco de datos contiene 100 filas (la tabla anterior sólo muestra las seis primeras filas) que contienen valores extraídos al azar.
A veces, es posible que ya conozca las columnas que debe contener un nuevo marco de datos, pero aún no conoce los valores correspondientes (por ejemplo, porque quiere tomar estos valores de la salida de un bucle for).
En resumen: En este tutorial has aprendido a inicializar y declarar un nuevo marco de datos en el lenguaje de programación R. Si tienes más preguntas, no dudes en contármelo en la sección de comentarios. Además, no olvides suscribirte a mi boletín de noticias por correo electrónico para recibir actualizaciones sobre nuevos artículos.
R data frame add column
Un tibble, o tbl_df, es una reimaginación moderna del data.frame, manteniendo lo que el tiempo ha demostrado que es efectivo, y desechando lo que no lo es. Los tibbles son data.frames perezosos y hoscos: hacen menos (es decir, no cambian los nombres o tipos de las variables, y no hacen coincidencias parciales) y se quejan más (por ejemplo, cuando una variable no existe). Esto le obliga a enfrentarse a los problemas antes, lo que suele conducir a un código más limpio y expresivo. Los tibbles también tienen un método print() mejorado que facilita su uso con grandes conjuntos de datos que contienen objetos complejos.
tibble() hace mucho menos que data.frame(): nunca cambia el tipo de las entradas (por ejemplo, ¡nunca convierte cadenas en factores!), nunca cambia los nombres de las variables, sólo recicla las entradas de longitud 1, y nunca crea row.names(). Puedes leer más sobre estas características en vignette(«tibble»).
El método de impresión tibble se inspira en data.table, y en frame. Al igual que data.table::data.table(), tibble() no coacciona las cadenas a los factores por defecto, no cambia los nombres de las columnas y no utiliza rownames.
R crea un marco de datos a partir de un marco de datos
Nuestro marco de datos se llama nsc. Esto es similar a renombrar el conjunto de datos dado como nsc. Observe que cada columna de nuestro marco de datos tiene un modo. En el caso de los marcos de datos, se pueden juntar columnas de diferentes modos, al igual que en un conjunto de datos. Aquí, las variables Nombre_del_alumno y Género son ambas categóricas. Mientras que las variables Edad y GPA son cuantitativas.
Echa un vistazo al panel de Entorno. Bajo el título «Datos», debería ver su marco de datos llamado nsc. A su derecha, debería decir 8 obs. de 4 variables. Eso significa que hay 4 columnas y que cada columna tiene 8 entradas. Desplazándose hacia abajo en el panel de Medio Ambiente, verá los nombres de las columnas bajo «Valores». A la derecha de los nombres de las columnas, verá el modo de cada variable, su longitud y sus elementos.
Si hace clic en la línea llamada nsc, aparecerá una pestaña llamada nsc y una tabla de su conjunto de datos en el panel Fuente. Obtendrá el mismo resultado si utiliza la función Ver(data_frame). En este caso, View(nsc) producirá una nueva pestaña llamada nsc que mostrará su conjunto de datos. Esta es una característica conveniente de RStudio, ya que puede alternar fácilmente entre la pestaña de script y la pestaña de su conjunto de datos para ver su conjunto de datos.
