Particionamento e Bucketing
Pré-visualização indisponível
Você precisa fazer login ou se inscrever para ver esta lição.
Entrar
Inscrever-se
Formação Completa Apache Spark: Datalakes e Iceberg 2026
Comprar agora
Saiba mais
1. Introdução
Apresentação
Introdução ao Spark
Arquitetura e Componentes
Context e Session
Formatos de Big Data
Material para Download
2. Instalação e Primeiros Passos
Ambiente do Curso
Instalando Docker
Materiais do Curso
Criando Container e Rodando
3. DataFrames e RDDs
RDD, Dataset e Dataframe
Iniciando o Ambiente
Operações Básicas em RDDs
Operações em Conjuntos com RDDs
Dataframes
Criando Dataframes
Criando Dataframes Importando Dados
Persistindo e Carregando Dados
Actions e Outras Funções
Dados em Parquets
Criando Joins
4. Spark SQL
Spark SQL
Criando Tabelas Gerenciadas
Tabelas Gerenciadas e não Gerenciadas
Views
Dataframes Versus Spark SQL
Joins
Joins com SQL e Dataframes
Atividades
Criando Banco de Dados e Tabelas Gerenciadas
Joins com Itens de Vendas
5. Outras Fontes de Dados
Conheça a NovaDrive Motors
Conectando ao Postgres
Criando Função Ler Tabelas
Usando SQL para Consultas
Obtendo dados com SQL
6. Criando Aplicações Spark
Aplicações Pyspark
Aplicação de Transformação
Aplicação Parametrizada
Conversor de Formato de Arquivos
Gravando Tabela de Banco de Dados em Disco
7. Machine Learning Nativo com Spark
Fundamentos de Machine Learning
Machine Learning no Spark
Dados para Regressão Linear
Criando Modelos de Regressão Linear
Comparando Modelos de Regressão
Classificação Binária e Balanceamento de Classe
Treinando e Testando Classificadores
Classificador Multi Classe
8. Streaming Estruturado
O que é Streaming
Spark Structured Streaming
Caso Prático
Criando App Streaming
Gerando Arquivos Automaticamente
9. Otimização e Performance
Particionamento e Bucketing
Particionamento
Buckets
2
Planos de Execução
Planos de Execução no Spark
Transformação Narrow e Wide, Suffle e Gestão de Cache
3
Cache e Persist
3
Cache e Persist no Spark
2
Repartition e Coalesce
2
Repartition e Coalesce no Spark
Broadcast Join
Boardcast Join no Spark
Data Skew e Salting
10. Configurações e UI
Conhecendo Spark UI
Spark UI na Prática
Configurações do Spark
Configurações do Spark na Prática
11. Apache Iceberg
Apresentação do Apache Iceberg
Iceberg Catalog e Metadados
ACID
Time Travel e Snapshots
Particionamento
Outras Características
Compatibilidade
12. Apache com Iceberg na Prática
Criando Container com Iceberg
Criando Catalogo e Tabela
Snapshots
ACID
ACID
Time Travel
Particionamento
Evolução de Schema
13. Criando um DataLake
Data Lake
Criando um Data Lake
Consultas
Snapshots, Time travel e Rollback