You are on page 1of 5

BASE DE DATOS

Una base de datos es el conjunto de datos informativos organizados en un mismo contexto para su
uso y vinculación.
Se le llama base de datos a los bancos de información que contienen datos relativos a diversas
temáticas y categorizados de distinta manera, pero que comparten entre sí algún tipo de vínculo o
relación que busca ordenarlos y clasificarlos en conjunto.
Una base de datos puede ser de diverso tipo, desde un pequeño fichero casero para ordenar libros y
revistas por clasificación alfabética hasta una compleja base que contenga datos de índole
gubernamental en un Estado u organismo internacional. Recientemente, el término base de datos
comenzó a utilizarse casi exclusivamente en referencia a bases construidas a partir de software
informático, que permiten una más fácil y rápida organización de los datos. Las bases de datos
informáticas pueden crearse a partir de software o incluso de forma online usando Internet.
CARACTERISTICAS
 Independencia de los Datos. Es decir, que los datos no dependen del programa y por tanto
cualquier aplicación puede hacer uso de los datos.
 Reducción de la Redundancia. Llamamos redundancia a la existencia de duplicación de los datos,
al reducir ésta al máximo conseguimos un mayor aprovechamiento del espacio y además evitamos
que existan inconsistencias entre los datos. Las inconsistencias se dan cuando nos encontramos
con datos contradictorios.
 Seguridad. Un SBD debe permitir que tengamos un control sobre la seguridad de los datos.
 Se visualiza normalmente como una tabla de una hoja de cálculo, en la que los registros son las
filas y las columnas son los campos, o como un formulario.
 Permite realizar un listado de la base de datos.
 Permiten la programación a usuarios avanzados.
 Acceso concurrente por parte de múltiples usuarios.
 Integridad de los datos.
 Consultas complejas optimizadas.
 Seguridad de acceso y auditoría.
 Respaldo y recuperación.
 Acceso a través de lenguajes de programación estándar.
VENTAJAS
 Control sobre la redundancia de datos:
Los sistemas de ficheros almacenan varias copias de los mismos datos en ficheros distintos. Esto hace
que se desperdicie espacio de almacenamiento, además de provocar la falta de consistencia de datos.
En los sistemas de bases de datos todos estos ficheros están integrados, por lo que no se almacenan
varias copias de los mismos datos. Sin embargo, en una base de datos no se puede eliminar la
redundancia completamente, ya que en ocasiones es necesaria para modelar las relaciones entre los
datos.
 Consistencia de datos:
Eliminando o controlando las redundancias de datos se reduce en gran medida el riesgo de que haya
inconsistencias. Si un dato está almacenado una sola vez, cualquier actualización se debe realizar
sólo una vez, y está disponible para todos los usuarios inmediatamente. Si un dato está duplicado y el
sistema conoce esta redundancia, el propio sistema puede encargarse de garantizar que todas las
copias se mantienen consistentes.
 Compartir datos:
En los sistemas de ficheros, los ficheros pertenecen a las personas o a los departamentos que los
utilizan. Pero en los sistemas de bases de datos, la base de datos pertenece a la empresa y puede
ser compartida por todos los usuarios que estén autorizados.
 Mantenimiento de estándares:
Gracias a la integración es más fácil respetar los estándares necesarios, tanto los establecidos a nivel
de la empresa como los nacionales e internacionales. Estos estándares pueden establecerse sobre el
formato de los datos para facilitar su intercambio, pueden ser estándares de documentación,
procedimientos de actualización y también reglas de acceso.
 Mejora en la integridad de datos:
La integridad de la base de datos se refiere a la validez y la consistencia de los datos almacenados.
Normalmente, la integridad se expresa mediante restricciones o reglas que no se pueden violar. Estas
restricciones se pueden aplicar tanto a los datos, como a sus relaciones, y es el SGBD quien se debe
encargar de mantenerlas.
 Mejora en la seguridad:
La seguridad de la base de datos es la protección de la base de datos frente a usuarios no autorizados.
Sin unas buenas medidas de seguridad, la integración de datos en los sistemas de bases de datos
hace que éstos sean más vulnerables que en los sistemas de ficheros.
 Mejora en la accesibilidad a los datos:
Muchos SGBD proporcionan lenguajes de consultas o generadores de informes que permiten al
usuario hacer cualquier tipo de consulta sobre los datos, sin que sea necesario que un programador
escriba una aplicación que realice tal tarea.
 Mejora en la productividad:
El SGBD proporciona muchas de las funciones estándar que el programador necesita escribir en un
sistema de ficheros. A nivel básico, el SGBD proporciona todas las rutinas de manejo de ficheros
típicas de los programas de aplicación.
El hecho de disponer de estas funciones permite al programador centrarse mejor en la función
específica requerida por los usuarios, sin tener que preocuparse de los detalles de implementación de
bajo nivel.
 Mejora en el mantenimiento:
En los sistemas de ficheros, las descripciones de los datos se encuentran inmersas en los programas
de aplicación que los manejan.
Esto hace que los programas sean dependientes de los datos, de modo que un cambio en su
estructura, o un cambio en el modo en que se almacena en disco, requiere cambios importantes en
los programas cuyos datos se ven afectados.
Sin embargo, los SGBD separan las descripciones de los datos de las aplicaciones. Esto es lo que se
conoce como independencia de datos, gracias a la cual se simplifica el mantenimiento de las
aplicaciones que acceden a la base de datos.
 Aumento de la concurrencia:
En algunos sistemas de ficheros, si hay varios usuarios que pueden acceder simultáneamente a un
mismo fichero, es posible que el acceso interfiera entre ellos de modo que se pierda información o se
pierda la integridad. La mayoría de los SGBD gestionan el acceso concurrente a la base de datos y
garantizan que no ocurran problemas de este tipo.
 Mejora en los servicios de copias de seguridad:
Muchos sistemas de ficheros dejan que sea el usuario quien proporcione las medidas necesarias para
proteger los datos ante fallos en el sistema o en las aplicaciones. Los usuarios tienen que hacer copias
de seguridad cada día, y si se produce algún fallo, utilizar estas copias para restaurarlos.
En este caso, todo el trabajo realizado sobre los datos desde que se hizo la última copia de seguridad
se pierde y se tiene que volver a realizar. Sin embargo, los SGBD actuales funcionan de modo que se
minimiza la cantidad de trabajo perdido cuando se produce un fallo.
DESVENTAJAS
 Complejidad:
Los SGBD son conjuntos de programas que pueden llegar a ser complejos con una gran
funcionalidad. Es preciso comprender muy bien esta funcionalidad para poder realizar un buen uso
de ellos.
 Coste del equipamiento adicional:
Tanto el SGBD, como la propia base de datos, pueden hacer que sea necesario adquirir más
espacio de almacenamiento. Además, para alcanzar las prestaciones deseadas, es posible que sea
necesario adquirir una máquina más grande o una máquina que se dedique solamente al SGBD.
Todo esto hará que la implantación de un sistema de bases de datos sea más cara.
 Vulnerable a los fallos:
El hecho de que todo esté centralizado en el SGBD hace que el sistema sea más vulnerable ante los
fallos que puedan producirse. Es por ello que deben tenerse copias de seguridad (Backup).
TIPOS
 Bases de datos columnares
Estas son las bases de datos NoSQL más parecidas a las convencionales bases de datos relacionales.
Almacenan datos estructurados en columnas individuales (en lugar de tablas).
Estas bases de datos utilizan grupos de columnas. Funcionan bien para datos generados por
máquinas, fuentes de datos estructuradas demasiado grandes para ser manejadas por un solo
ordenador, y para consultas rápidas de datos.
Si estás pensando en análisis rápido y de precisión de datos-máquina, estas pueden ser los tipos de
base de datos ideales. Apache Cassandra y Apache HBase son algunas de ellas.
 Bases de datos documentales
Estos tipos de bases de datos se basan en el almacenamiento de documentos en lugar de datos
estructurados. Son buenas para datos no estructurados, como texto abierto de una carta o de un correo
electrónico, y para datos semi-estructurados como documentos académicos.
Tendrás que fijarte en ellas si estas pensando en análisis de texto de documentos demasiado grandes
para las bases de datos convencionales. Algunas de las más conocidas son MongoDB y Apache
Couch DB.
 Bases de datos gráficas
Estos tipos de bases de datos utilizan una estructura gráfica que es esencialmente un diagrama de las
relaciones dentro de los datos, en lugar de tablas.
Son buenos motores de bases de datos para impulsar aplicaciones web que deban proporcionar
información muy rápidamente, como las que se utilizan para las compras online y las plataformas de
redes sociales.
Necesitarás mirar estos tipos de bases de datos si tu interés principal es una aplicación rápida, y
puedes vivir con algunas aproximaciones en análisis. Algunas de las más conocidas son Neo4J de
Neo Technology’s y Microsoft Horton.
 Key-Value
Estas están diseñadas para desarrollo simple y fácil de aplicaciones. Son buenas para situaciones
donde necesitas trabajar con aplicaciones que se puedan desarrollar rápidamente y donde todas las
demás consideraciones son secundarias. Algunas de las más conocidas son Basho Technologies’
Riak y Redis.
 XML
Estos tipos de bases de datos utilizan el lenguaje XML, el cual es el lenguaje subyacente de la Web y
de otros muchos sistemas de intercambio de información, para definir la estructura de datos.
Son buenas para la gestión de datos que no se puede obtener con cualquier otro tipo de bases de
datos, y un buen partido cuando se tiene una gran cantidad de datos en formatos no tradicionales,
como vídeo y audio.
Tendrás que mirar este tipos de bases de datos cuando necesites profundizar en el análisis de datos
no estructurados como analíticas de voz o de vídeo. Algunos grandes nombres en estos tipos de bases
de datos son Mark Logic y Sedna.
MODELO ENTIDAD RELACION
Un diagrama entidad-relación, también conocido como modelo entidad relación o ERD, es un tipo de
diagrama de flujo que ilustra cómo las "entidades", como personas, objetos o conceptos, se relacionan
entre sí dentro de un sistema. Los diagramas ER se usan a menudo para diseñar o depurar bases de
datos relacionales en los campos de ingeniería de software, sistemas de información empresarial,
educación e investigación. También conocidos como los ERD o modelos ER, emplean un conjunto
definido de símbolos, tales como rectángulos, diamantes, óvalos y líneas de conexión para representar
la interconexión de entidades, relaciones y sus atributos. Son un reflejo de la estructura gramatical y
emplean entidades como sustantivos y relaciones como verbos.
Los diagramas ER se componen de entidades, relaciones y atributos. También representan la
cardinalidad, que define las relaciones en términos de números. Puedes ver un glosario a continuación:
Entidad
Algo que se puede definir, como una persona, objeto, concepto u evento, que puede tener datos
almacenados acerca de este. Piensa en las entidades como si fueran sustantivos. Por ejemplo: un
cliente, estudiante, auto o producto. Por lo general se muestran como un rectángulo.
Relación
Cómo las entidades interactúan o se asocian entre sí. Piensa en las relaciones como si fueran verbos.
Por ejemplo, el estudiante mencionado podría inscribirse en un curso. Las dos entidades serían el
estudiante y el curso, y la relación representada es el acto de inscribirse, que conecta ambas entidades
de ese modo. Las relaciones se muestran, por lo general, como diamantes o etiquetas directamente
en las líneas de conexión.
CARDINALIDAD DE LAS RELACIONES
Define los atributos numéricos de la relación entre dos entidades o conjuntos de entidades. Las tres
relaciones cardinales principales son uno a uno, uno a muchos y muchos a muchos. Un ejemplo de
uno a uno sería un estudiante asociado a una dirección de correo electrónico. Un ejemplo de uno a
muchos (o muchos a uno, en función de la dirección de la relación) sería un estudiante que se
inscribe en muchos cursos, y todos esos cursos se asocian a ese estudiante en particular. Un ejemplo
de muchos a muchos sería los estudiantes en grupo están asociados a múltiples miembros de la
facultad y a su vez los miembros de la facultad están asociados a múltiples estudiantes.
Se pueden distinguir tres tipos de relaciones:
Relación Uno a Uno: Cuando un registro de una tabla sólo puede estar relacionado con un único
registro de la otra tabla y viceversa.
Por ejemplo: tenemos dos tablas una con los datos de diferentes poblaciones y otra con una lista de
Alcaldes, una población sólo puede tener un alcalde, y un alcalde lo será únicamente de una población.
Relación Uno a Varios: Cuando un registro de una tabla (tabla secundaria)sólo puede estar
relacionado con un único registro de la otra tabla (tabla principal) y un registro de la otra
tabla (tabla principal) puede tener más de un registro relacionado en la primera tabla (tabla
secundaria).
Por ejemplo: tenemos dos tablas una con los datos de diferentes poblaciones y otra con los habitantes,
una población puede tener más de un habitante, pero un habitante pertenecerá (estará empadronado)
en una única población.
Relación Varios a Varios: Cuando un registro de una tabla puede estar relacionado con más de
un registro de la otra tabla y viceversa.
Por ejemplo: tenemos dos tablas una con los datos de clientes y otra con los artículos que se venden
en la empresa, una cliente podrá realizar un pedido con varios artículos, y un artículo podrá ser vendido
a más de un cliente.
Las relaciones varios a varios se suelen representar definiendo una tabla intermedia entre las dos
tablas. Siguiendo el ejemplo anterior sería definir una tabla líneas de pedido relacionada con clientes
y con artículos.

You might also like