La información contenida en una base de datos es muy importante, sin ella prácticamente las consultas y transacciones con clientes sería demasiado complicada y, por ende, cobra relevancia su organización lógica, ya que debe ser fácil de recuperar, modificar y mantener con el fin de ser utilizada de la mejor manera posible. Lo anterior se logra a través del uso de estructuras de datos apropiadas, así como con la implementación de reglas de integridad y sus respectivas restricciones.
Imagina la cantidad de productos que hay en una tienda de dispositivos electrónicos; existe una variedad muy grande de opciones de compra para los clientes. La información almacenada para cada uno de estos dispositivos debe estar correctamente almacenada, así como sus datos de procedencia, número de existencias, lotes, garantías, etc. Se vuelve necesario que la información esté organizada de forma lógica y con normas que garanticen la consistencia correcta de los datos. Por ejemplo, el precio de un producto determinado no debe ser menor que el costo de compra del mismo o las características internas deben estar bien catalogadas e impresas para que el cliente identifique las características generales sin ningún problema. Esto le da una mayor relevancia a las bases de datos en cuanto al nivel de organización y cuidado de la información de la misma, elementos que aprenderás en este tema.
Normalización y sus fases
Revisa las siguientes definiciones de normalización:
La transformación de las vistas de usuario complejas y del almacén de datos a un juego de estructuras de datos más pequeñas y estables. Además de ser más simples y estables, las estructuras de datos son más fáciles de mantener que otras estructuras de datos. (Kendall, 2005)
La normalización en una base de datos tiene diferentes objetivos, principalmente enfocados a reducir la redundancia de los datos y también a reducir las dependencias entre columnas, aplicándose de manera acumulativa; existen en total seis formas normales o reglas de normalización, pero las más destacadas son las tres primeras, por lo que, tomando en cuenta lo anterior, se traduce en que la segunda forma normal incluye a la primera, la tercera a la segunda y así sucesivamente. Por lo que podemos deducir que una base de datos que está en la segunda forma normal, cumple con las dos primeras reglas de normalización. (Pacheco, 2018)
Primera forma normal 1FN
Tiene las siguientes indicaciones generales:
Ejemplo. En una tabla se designa una columna para almacenar la información de los clientes, por lo que se tendrían datos como nombre de la calle, número interior, número exterior, colonia, código postal, municipio, estado, etc.
Figura 2.1. Ejemplo de aplicación de la 1FN.
Tablas con esta estructura presentan muchos problemas al momento de acceder a la información porque, por ejemplo, si se requiere conocer la información por código postal u obtener las colonias específicas para un reporte, al tener una secuencia de caracteres en formato libre, no sería posible. Con esta forma normal, aunque existan más columnas, se contará con la información relevante para realizar operaciones o consultas correctas.
Segunda forma normal 2FN
Además de cumplir con los puntos de la primera forma normal, en esta no existen dependencias funcionales parciales, es decir, todos los valores de las columnas de una fila dependen solamente de la clave primaria de la fila (son los valores de todas las columnas que la formen, si es que es más de una). Si ya existe una tabla con la primera forma normal aplicada con una clave primaria única, entonces ya cumpliría con la segunda forma normal; por lo tanto, esta segunda forma normal aplica para las tablas que tienen valores correspondientes a dos o más columnas.
Figura 2.2. Ejemplo de aplicación de la 2FN.
Tercera forma normal 3FN
La tercera forma normal especifica que no deben existir dependencias transitivas entre las columnas de una tabla, en otras palabras, si hay columnas que no forman parte de la clave primaria, deberán depender solo de la clave. En el ejemplo, implicaría la separación de la tabla de direcciones para cumplir con esta regla.
Figura 2.3. Ejemplo de aplicación de la 3FN.
Integridad de la información
La integridad de la información se ha convertido en un tema de gran relevancia hoy en día, ya que se debe contar con la información más actual y, al mismo tiempo, que esta sea confidencial y cuente con disponibilidad. Según Grupo Atico34 (2023), la integridad de la información establece que los datos deben ser exactos y fiables y que no se hayan modificado accidentalmente o de manera intencionada por terceras personas cuando están en uso, en reposo o movimiento. Su objetivo principal radica en garantizar que los datos no sean alterados, manipulados o corrompidos para considerarlos exactos y confiables.
De acuerdo con Grupo Atico34 (2023), los tres principios de la integridad de la información son la confidencialidad, la integridad y la disponibilidad y los tres deben estar presentes en todo momento, ya que, si alguno falla, no se puede garantizar la exactitud de la información. Al no cumplir con lo anterior, los datos se considerarían corrompidos y serían inútiles para la empresa, lo que se puede traducir en pérdidas económicas, sobre todo si no se cuenta con herramientas que permitan su recuperación, implicando nuevas inversiones de tiempo y recursos para restablecerla de alguna manera.
De esta forma, los principales riesgos y amenazas para la integridad de la información son:
Los tipos de integridad de datos, según Naeem (2024), son:
Figura 2.4. Tipos de integridad de datos.
Historia del lenguaje
En la década de los setenta, IBM desarrolló un lenguaje para los sistemas de gestión de bases de datos relacionales basado en el trabajo de Codd y le puso por nombre Structured English Query Language (SEQUEL). Posteriormente, en la década de los ochenta, creó productos comerciales como SQL/DS y DB2; también se dio el surgimiento de otros lenguajes como Sybase, Ingres y Oracle (SmartData, 2023).
De acuerdo con SmartData (2023), actualmente Structured Query Language (SQL) es el lenguaje estándar utilizado para la gestión de las bases de datos porque, por su potencia y versatilidad, puede ser usado para realizar diversas tareas, desde la consulta de datos hasta la creación de informes.
Descripción y diferenciación de sus componentes: DDL, DML, DCL y TCL y sus sentencias
Al ser SQL un lenguaje cuyo enfoque depende de lo que quiere el usuario, facilita enormemente la recuperación, actualización, eliminación y modificación de datos que se encuentran grabados en una base de datos y, adicionalmente, permite la adición de nuevas tablas y de las relaciones entre ellas para lograr una mejor estructura de la base de datos relacionada.
Sus componentes principales son (Gulo, 2023):
En este tema, has visto que no basta tener una base de datos que gestione toda la información de una empresa, sino que también el uso de las formas normales ayuda a que dicha información se procese de la mejor manera posible, cuidando que no existan redundancias de información o duplicidades que podrían poner en riesgo la toma de decisiones de una organización.
Igualmente, cuidar el tema de la integridad de los datos ayudará a tener una mejor organización en las tablas, pudiendo, a través de los diferentes componentes de la estructura de bases, contar con consultas específicas que aprovechen al máximo la información en el momento que sea requerida por los miembros de una empresa.
Asegúrate de:
Tecmilenio no guarda relación alguna con las marcas mencionadas como ejemplo. Las marcas son propiedad de sus titulares conforme a la legislación aplicable, estas se utilizan con fines académicos y didácticos, por lo que no existen fines de lucro, relación publicitaria o de patrocinio.
Los siguientes enlaces son externos a la Universidad Tecmilenio, al acceder a ellos considera que debes apegarte a sus términos y condiciones.
Lecturas
Videos
Tecmilenio no guarda relación alguna con las marcas mencionadas como ejemplo. Las marcas son propiedad de sus titulares conforme a la legislación aplicable, estas se utilizan con fines académicos y didácticos, por lo que no existen fines de lucro, relación publicitaria o de patrocinio.
La obra presentada es propiedad de ENSEÑANZA E INVESTIGACIÓN SUPERIOR A.C. (UNIVERSIDAD TECMILENIO), protegida por la Ley Federal de Derecho de Autor; la alteración o deformación de una obra, así como su reproducción, exhibición o ejecución pública sin el consentimiento de su autor y titular de los derechos correspondientes es constitutivo de un delito tipificado en la Ley Federal de Derechos de Autor, así como en las Leyes Internacionales de Derecho de Autor.
El uso de imágenes, fragmentos de videos, fragmentos de eventos culturales, programas y demás material que sea objeto de protección de los derechos de autor, es exclusivamente para fines educativos e informativos, y cualquier uso distinto como el lucro, reproducción, edición o modificación, será perseguido y sancionado por UNIVERSIDAD TECMILENIO.
Queda prohibido copiar, reproducir, distribuir, publicar, transmitir, difundir, o en cualquier modo explotar cualquier parte de esta obra sin la autorización previa por escrito de UNIVERSIDAD TECMILENIO. Sin embargo, usted podrá bajar material a su computadora personal para uso exclusivamente personal o educacional y no comercial limitado a una copia por página. No se podrá remover o alterar de la copia ninguna leyenda de Derechos de Autor o la que manifieste la autoría del material.