Lección 1 del curso Pandas Nivel Básico.
En esta primera lección del curso vamos a entender qué es la librería Pandas, cómo se relaciona con otras librerías de Python, cuál es su importancia en la Ciencia de Datos y el Machine Learning, cuándo es recomendable usar esta librería y cuando no:
Contenido exclusivo para suscriptores
Si eres suscriptor accede en este enlace ó suscríbete a la Academia Online y accede a todo el contenido (lecciones en video, código fuente, sets de datos y descargas) de todos los cursos, proyectos y tutoriales.
Como acabamos de ver, Pandas es una librería de Python que facilita la manipulación de datos estructurados, permitiendo crear, leer, almacenar y procesar datos en formato tabular.
Y este tipo de procesamiento resulta esencial para la Ciencia de Datos y el Machine Learning, ya que permite realizar operaciones estadísticas y matemáticas, así como la limpieza, exploración y pre-procesamiento de datos.
Además, Pandas se integra con otras librerías de Python, como Numpy, Matplotlib y Scikit Learn, y es ideal para proyectos con datos que caben en la memoria de un solo ordenador. Para datasets más grandes, se recomienda el uso de librerías como PySpark, Dask o Polars.
Así que con esta introducción ya estamos listos para comenzar el componente práctico del curso. Entonces en la próxima lección veremos cómo instalar Pandas y cómo acceder a su documentación.
Todas las lecciones del curso Pandas Nivel Básico
