Banco de Dados para Concursos
Compartilhado por um usuário do Flashcards.gg · gerado com IA · Denunciar este conjunto
Conceitos fundamentais de banco de dados e big data para concursos públicos e exames de TI.
Toque no cartão para virar
Cartões · 40
- SGBD (Sistema de Gerenciamento de Banco de Dados)
- Software que gerencia o armazenamento, manipulação e recuperação segura de dados, isolando o usuário da complexidade física.
- Chave Primária (Primary Key)
- Atributo ou conjunto de atributos que identifica unicamente cada registro em uma tabela, garantindo que não haja duplicatas ou valores nulos.
- Chave Estrangeira (Foreign Key)
- Campo que estabelece um vínculo referencial com a chave primária de outra tabela, garantindo a integridade referencial dos dados.
- Integridade Referencial
- Regra que impede a existência de valores em chaves estrangeiras sem uma chave primária correspondente na tabela de origem.
- Propriedade ACID - Atomicidade
- Garante que todas as operações de uma transação sejam executadas com sucesso ou revertidas por completo em caso de falha.
- Propriedade ACID - Consistência
- Garante que a transação leve o banco de um estado válido a outro, respeitando todas as regras de integridade predefinidas.
- Propriedade ACID - Isolamento
- Garante que transações simultâneas não interfiram umas nas outras antes de serem concluídas.
- Propriedade ACID - Durabilidade
- Garante que o resultado de uma transação confirmada (commit) persista permanentemente no banco, mesmo em caso de falha de sistema.
- Primeira Forma Normal (1FN)
- Elimina atributos multivalorados e compostos, exigindo que todos os valores dos atributos sejam atômicos e indivisíveis.
- Segunda Forma Normal (2FN)
- Exige que a tabela esteja na 1FN e que nenhum atributo não-chave dependa parcialmente de uma chave primária composta.
- Terceira Forma Normal (3FN)
- Exige que a tabela esteja na 2FN e que nenhum atributo não-chave dependa transitivamente de outro atributo não-chave.
- DDL (Data Definition Language)
- Subconjunto de comandos SQL (como CREATE, ALTER, DROP) usado para definir e modificar a estrutura dos esquemas do banco de dados.
- DML (Data Manipulation Language)
- Subconjunto de comandos SQL (como INSERT, UPDATE, DELETE) utilizado para manipular e alterar os dados armazenados nas tabelas.
- DQL (Data Query Language)
- Subconjunto de comandos SQL (destacando o comando SELECT) cuja finalidade exclusiva é consultar e recuperar dados das tabelas.
- DCL (Data Control Language)
- Subconjunto de comandos SQL (como GRANT e REVOKE) utilizado para controlar permissões e privilégios de acesso aos usuários.
- TCL (Transaction Control Language)
- Subconjunto de comandos SQL (como COMMIT, ROLLBACK e SAVEPOINT) utilizado para gerenciar a execução de transações.
- Índice (Index)
- Estrutura auxiliar criada para acelerar a busca e recuperação de registros em tabelas, otimizando o desempenho de consultas.
- Visão (View)
- Tabela virtual baseada no resultado de uma consulta SQL, utilizada para simplificar queries complexas e restringir o acesso a dados.
- Trigger (Gatilho)
- Procedimento armazenado executado automaticamente em resposta a determinados eventos (INSERT, UPDATE, DELETE) em uma tabela.
- Stored Procedure
- Bloco de código SQL compilado e armazenado no servidor, usado para reutilizar rotinas lógicas complexas e reduzir tráfego de rede.
- Modelo Entidade-Relacionamento (MER)
- Modelo conceitual que representa a estrutura lógica de um banco por meio de entidades, atributos e seus relacionamentos.
- Normalização de Dados
- Processo sistemático de organização das tabelas para minimizar a redundância de dados e evitar anomalias de inserção e exclusão.
- NoSQL (Not Only SQL)
- Categoria de bancos de dados não relacionais projetados para alta escalabilidade horizontal e flexibilidade com dados não estruturados.
- Teorema CAP
- Princípio que afirma ser impossível um sistema distribuído garantir simultaneamente Consistência, Disponibilidade e Tolerância a Partições.
- Bancos Chave-Valor (Key-Value)
- Banco NoSQL que armazena dados como pares simples de chave e valor, focado em altíssimo desempenho e buscas diretas (ex: Redis).
- Bancos Orientados a Documentos
- Banco NoSQL que organiza dados em documentos semiestruturados (como JSON ou BSON) com esquemas flexíveis (ex: MongoDB).
- Bancos Orientados a Colunas (Wide-Column)
- Banco NoSQL que armazena dados em famílias de colunas, otimizado para consultas analíticas em grandes volumes (ex: Cassandra).
- Bancos em Grafo
- Banco NoSQL focado em nós e arestas, projetado para armazenar e consultar relações complexas e interconectadas (ex: Neo4j).
- Os 5 Vs do Big Data
- Características fundamentais do Big Data: Volume, Velocidade, Variedade, Veracidade e Valor.
- Data Warehouse (DW)
- Repositório centralizado de dados históricos e estruturados, otimizado para análise e suporte à tomada de decisões (OLAP).
- Data Lake
- Repositório de armazenamento centralizado que guarda dados em seu formato bruto (estruturados, semiestruturados ou não estruturados).
- Data Mart
- Subconjunto de um Data Warehouse focado em um departamento, linha de negócio ou área temática específica da organização.
- ETL (Extract, Transform, Load)
- Processo de extrair dados de fontes operacionais, transformá-los conforme regras de negócio e carregá-los em um Data Warehouse.
- OLTP (Online Transaction Processing)
- Sistemas operacionais voltados para processar transações cotidianas rápidas, com foco em integridade e alta concorrência.
- OLAP (Online Analytical Processing)
- Tecnologia voltada para a análise multidimensional de grandes volumes de dados históricos para fins de inteligência de negócios.
- Apache Hadoop
- Framework de código aberto para armazenamento e processamento distribuído de grandes conjuntos de dados em clusters de hardware comum.
- HDFS (Hadoop Distributed File System)
- Sistema de arquivos distribuído do ecossistema Hadoop, projetado para armazenar arquivos gigantescos com alta tolerância a falhas.
- MapReduce
- Modelo de programação do Hadoop para processamento paralelo e distribuído de grandes massas de dados em duas fases: Map e Reduce.
- Apache Spark
- Motor analítico de processamento em memória ultrarrápido para computação em larga escala e análise de fluxos contínuos de dados.
- Esquema Estrela (Star Schema)
- Modelo dimensional em que uma tabela fato centralizada conecta-se diretamente a tabelas de dimensões não normalizadas.