• Saltar a la navegación principal
  • Saltar al contenido principal
Logo Codificando Bits

Codificando Bits

  • Academia
    • Rutas
    • Cursos
    • Proyectos
    • Tutoriales
  • Acceder
  • Suscribirse

9 – Densidad de probabilidad y distribución acumulada

Lección 9 del curso Probabilidad Nivel Intermedio.

En el módulo anterior hablamos de las principales distribuciones de probabilidad para el caso de las variables aleatorias discretas, y allí vimos en detalle en qué consisten la distribución binomial y la distribución multinomial. Adicionalmente vimos de forma práctica cómo hacer uso de estas distribuciones y específicamente en la lección anterior vimos cómo usar de forma práctica la distribución multinomial para construir un sencillo modelo predictivo.

En este último módulo del curso seguiremos un enfoque similar pero orientado a las variables aleatorias continuas. En particular nos enfocaremos en la distribución de probabilidad más usada para este tipo de variables en el caso de la Ciencia de Datos y el Machine Learning: la distribución Gaussiana (también llamada distribución Normal).

Pero antes de ver en detalle esta distribución, en esta lección nos enfocaremos en dos conceptos sencillos similares a los ya vistos en el caso de las variables aleatorias discretas: hablaremos de la función densidad de probabilidad y de la función de distribución acumulada:

Contenido exclusivo para suscriptores

Si eres suscriptor accede en este enlace ó suscríbete a la Academia Online y accede a todo el contenido (lecciones en video, código fuente, sets de datos y descargas) de todos los cursos, proyectos y tutoriales.

Con lo que acabamos de ver ya tenemos claro qué son las funciones densidad de probabilidad y de distribución acumulada, conceptos que se aplican para el caso de variables aleatorias continuas.

Vimos que en esencia son como el equivalente de las funciones de probabilidad de masa y de distribución acumulada que vimos para el caso de variables aleatorias discretas, con la diferencia de que para el caso de las variables aleatorias continuas en lugar de usar sumas para calcular probabilidades debemos hacer uso de integrales (de las cuales hablamos en detalle en el curso Cálculo para Ciencia de Datos y Machine Learning.)

Además, acabamos de ver algunos ejemplos sencillos de cálculo de probabilidades y de probabilidades acumuladas usando precisamente las integrales.

En la práctica, en proyectos de Ciencia de Datos y Machine Learning, no tendremos que resolver estas integrales manualmente y en su lugar usaremos librerías de Python que hacen ese cálculo por nosotros. Sin embargo es clave tener claro el proceso matemático que se da detrás de todo esto.

Así que teniendo claros todos estos conceptos ya estamos listos para comenzar a ver la parte central de este módulo. Entonces en la próxima lección veremos todos los detalles de la distribución Gaussiana (o Normal), la distribución que más comúnmente encontraremos en la mayoría de los proyectos de Ciencia de Datos y Machine Learning a los que nos enfrentemos.

Todas las lecciones del curso Probabilidad Nivel Intermedio

© Codificando Bits, LLC | Blog | Contacto | Servicios | Acerca de | Políticas

¿Has olvidado la contraseña?
¿Has perdido tu contraseña? Por favor, introduce tu nombre de usuario o dirección de correo electrónico. Recibirás por correo electrónico un enlace para crear una nueva contraseña.
body::-webkit-scrollbar { width: 7px; } body::-webkit-scrollbar-track { border-radius: 10px; background: #f0f0f0; } body::-webkit-scrollbar-thumb { border-radius: 50px; background: #dfdbdb }