continuous learning company
Trilha de aprendizado

Trilha de Engenharia de Dados

Entenda o que é Engenharia de Dados, aprenda os fundamentos de pipelines e modelagem e avance para Spark, Kafka e arquiteturas de dados.

  1. Fundamentos 10 conteúdos
  2. Spark 3 conteúdos
  3. Kafka 1 conteúdo
  4. Arquitetura 5 conteúdos

Seu progresso

0% concluído · 0 de 19 conteúdos concluídos

O progresso fica salvo apenas neste navegador, sem login e sem sincronização com outros dispositivos.

Continue de onde parou

Comece pelo primeiro conteúdo

dados são a nova água

Você ainda não concluiu nenhum conteúdo desta trilha.

Começar trilha →

Fundamentos

Entenda o papel da Engenharia de Dados, como um pipeline funciona e como os dados são carregados e modelados para análise.

  1. → Próximo Conteúdo 1 de 19Engenharia de DadosPor Necy Vieira

    dados são a nova água

    Entenda por que a Engenharia de Dados é a base que sustenta análises, inteligência artificial e a transformação digital nas empresas.

    Estudar conteúdo →
  2. ○ A fazer Conteúdo 2 de 19Engenharia de DadosPor Necy Vieira

    Engenharia de Dados ≠ Ciência de Dados.

    Descubra as principais diferenças entre Engenharia de Dados e Ciência de Dados e entenda como essas áreas trabalham juntas para transformar dados em decisões…

    Estudar conteúdo →
  3. ○ A fazer Conteúdo 3 de 19Engenharia de DadosPor Ana Clara Castro

    Afinal, o Que É um Pipeline?

    Entenda de forma simples o que é um pipeline na tecnologia, com exemplos de pipeline de dados e de desenvolvimento explicados a partir de uma receita de bolo.

    Estudar conteúdo →
  4. ○ A fazer Conteúdo 5 de 19Engenharia de DadosPor Necy Vieira

    ETL vs ELT

    Entenda por que ETL e ELT são conceitos fundamentais para Engenharia de Dados, Analytics e arquiteturas modernas em cloud

    Estudar conteúdo →
  5. ○ A fazer Conteúdo 9 de 19Bancos de DadosPor Rafael Nogueira

    Modelo Star Schema

    Simples, elegante e poderoso. O modelo Star Schema, criado por Ralph Kimball, é a base de soluções analíticas que entregam performance e clareza para tomada de…

    Estudar conteúdo →

Spark

Veja por que o processamento distribuído é necessário e conheça a base e a arquitetura do Apache Spark.

  1. ○ A fazer Conteúdo 11 de 19Engenharia de DadosPor Rafael Nogueira

    Pandas ou PySpark?

    As duas ferramentas são fundamentais no ecossistema de dados, mas cada uma resolve problemas diferentes.

    Estudar conteúdo →

Kafka

Combine ingestão de eventos e processamento em tempo real com Apache Kafka e Spark Streaming.

Arquitetura

Entenda como batch, streaming e armazenamento se combinam em arquiteturas de dados completas.

  1. ○ A fazer Conteúdo 17 de 19Engenharia de DadosPor Rafael Nogueira

    Data Lake ou Data Swamp?

    Armazenar dados não é suficiente. Entenda por que organização, contexto e governança definem se o seu ambiente de dados gera valor ou se transforma em um…

    Estudar conteúdo →
  2. ○ A fazer Conteúdo 18 de 19Engenharia de DadosPor Rafael Nogueira

    O Que é um Data Hub

    Entenda o que é um Data Hub, como ele se diferencia de Data Lakes e Warehouses, e como essa arquitetura conecta fontes, aplica governança e viabiliza análises…

    Estudar conteúdo →
  3. ○ A fazer Conteúdo 19 de 19Engenharia de DadosPor Rafael Nogueira

    Data Fabric

    Entenda como a arquitetura Data Fabric integra ecossistemas fragmentados, conectando fontes, tecnologias e domínios em uma camada unificada e governada.

    Estudar conteúdo →

Para se orientar

Leitura complementar para começar com Spark. Ela não faz parte da sequência nem do progresso.