Estadística descriptiva sobre el dataset de diabetes

Fundamentos para Inteligencia Artificial · Semana 2

25 de enero de 2026 · NRC-197 · 5 entregables

De qué iba

Con el equipo 10 armamos el primer script del curso sobre el dataset de diabetes de la NCSU. Lo cargué con pandas directo desde la URL, sin descargar nada: 442 filas, 11 columnas y ni un valor nulo. De ahí salieron media, mediana y moda de la edad y del índice de masa corporal, después las medidas de dispersión, y cerramos con un groupby por sexo y una tabla resumen. La portada, el enlace al Colab y las referencias los entregué aparte en Word.

  • Cargué diabetes.tab.txt de la NCSU con pandas desde la URL y confirmé 442 filas por 11 columnas, todas sin nulos
  • Calculé para AGE media 48.52, mediana 50 y moda 53 años; para BMI, 26.38, 25.70 y 23.5
  • Saqué la dispersión de la edad: mínimo 19, máximo 79, rango 60, desviación estándar 13.11 y varianza 171.85
  • Agrupé por sexo con groupby, grafiqué el histograma de las 11 variables y consolidé todo en un DataFrame resumen

Qué pedían

El enunciado y la rúbrica, tal cual los publicaron.

FIA_Actividad_S2.pdfdocumento · 355,2 KB

Qué entregué

Lo que salió de esa semana.

FIA_Semana2_Script_Equipo10.ipynbcuaderno · 120,1 KB · 29 celdas
OviedoFadul_Alexander_Actividad_Sem_2_FIA_Equipo10.docxinforme · 17,8 KB · 189 palabras
OviedoFadul_Alexander_Actividad_Sem_2_FIA_Equipo10.ipynbcuaderno · 137,3 KB · 29 celdas
OviedoFadul_Alexander_Actividad_Sem_2_FIA_Equipo10.pdfdocumento · 271,4 KB
OviedoFadul_Alexander_Script_Equipo10.docxinforme · 38,2 KB · 605 palabras

Lo que usé por el camino

Notas sueltas, datos y código de apoyo.

generar_docx.pyscript · 8,2 KB

Seguir leyendo

Esa misma semana, en las otras materias: