Estadística descriptiva sobre el dataset de diabetes
Fundamentos para Inteligencia Artificial · Semana 2
25 de enero de 2026 ≈ · NRC-197 ·
5 entregables
De qué iba
Con el equipo 10 armamos el primer script del curso sobre el dataset de diabetes de la NCSU. Lo cargué con pandas directo desde la URL, sin descargar nada: 442 filas, 11 columnas y ni un valor nulo. De ahí salieron media, mediana y moda de la edad y del índice de masa corporal, después las medidas de dispersión, y cerramos con un groupby por sexo y una tabla resumen. La portada, el enlace al Colab y las referencias los entregué aparte en Word.
Cargué diabetes.tab.txt de la NCSU con pandas desde la URL y confirmé 442 filas por 11 columnas, todas sin nulos
Calculé para AGE media 48.52, mediana 50 y moda 53 años; para BMI, 26.38, 25.70 y 23.5
Saqué la dispersión de la edad: mínimo 19, máximo 79, rango 60, desviación estándar 13.11 y varianza 171.85
Agrupé por sexo con groupby, grafiqué el histograma de las 11 variables y consolidé todo en un DataFrame resumen
Qué pedían
El enunciado y la rúbrica, tal cual los publicaron.