Turma Comunidade DSSBR + GUBigData · Curso em andamento · Entre quando quiser

Construa um Pipeline Lakehouse completo — do zero ao dashboard, módulo a módulo.

Curso online 100% prática, com metodologia ativa (sala invertida). Aulas gravadas que você segue módulo a módulo, no seu ritmo — mais encontros temáticos ao vivo e mentorias 1:1 agendáveis pra destravar dúvidas. Como usamos sala invertida, você entra a qualquer momento: começa recebendo os materiais na sequência de estudo e acompanha o curso módulo a módulo, com a stack que o mercado contrata em 2026:

MinIO
Apache Iceberg
Apache Spark
Apache Airflow
Apache Superset
Garantir minha vaga →

O pipeline começa do zero — você, não. Aqui é preciso ter Python intermediário, SQL e Docker antes do módulo 1. Veja se é a sua hora →

Diagnóstico · clique nos que aplicam

Marque quantos se aplicam a você:

Leu sobre Lakehouse, viu webinars, assistiu cursos. Nunca subiu um pipeline real do começo ao fim.
Tem certificação de Spark no LinkedIn. Nunca rodou um spark-submit num caso de verdade.
Time pede experiência prática em Airflow. Você só tem a teoria.
Quer migrar pra Engenharia de Dados. Stack moderno não tá no seu portfólio.
Sabe Medallion no slide. Não sabe configurar um catálogo Iceberg.
Marcou 2 ou mais? É exatamente essa distância que o curso fecha — módulo a módulo, no seu ritmo. Uma ressalva honesta: o curso fecha a distância entre teoria e prática, não a distância entre zero e Python. Se Python, SQL e Docker ainda não são rotina pra você, leia isto antes.
O cenário do curso

Olakehouse — marketplace brasileiro fictício pra mexer de verdade

9
Tabelas relacionadas
~100MB
Dados sintéticos
pt-BR
CPF · CEP · UF · categorias reais
5
Módulos, mesmo cenário
As 9 tabelas que você vai mexer
pedidos clientes itens produtos pagamentos avaliações sellers geolocalização categorias
Sujeira pedagógica controlada. O dataset vem com nulos, duplicados, encoding misto e timestamps em fuso errado — tudo intencional. Você vai limpar isso na camada Silver com PySpark. Igual à vida real, sem o "Hello World" idealizado.
A stack do curso

5 ferramentas open source — todas em vagas reais de Eng. de Dados em 2026

Object Storage
MinIO
Data Lake S3-compatível rodando local. Onde os dados vivem.
Table Format
Apache Iceberg
Tabelas com ACID, time travel e schema evolution sobre o Lake.
Processing
Apache Spark
Motor distribuído pra limpar, juntar e modelar dados em PySpark.
Orchestration
Apache Airflow
DAG diária com retry, sensors e observabilidade do pipeline.
BI · Dashboards
Apache Superset
Dashboards interativos conectados via Spark Thrift às tabelas Gold.

Todas rodam em Docker, na sua máquina. Você sai do curso dominando as cinco.

Como o curso se desenrola

Da matrícula ao dashboard, 5 módulos estruturados

Você começa com 9 CSVs do Olakehouse · ~100MB · dados brasileiros sintéticos
1
Módulo 1

Sobe a stack

MinIO
Iceberg
Spark
Airflow
Superset

Docker compose, Medallion Architecture na prática. Sobe as 5 ferramentas e valida acesso aos UIs.

Stack rodando + screenshots dos UIs
2
Módulo 2

Carrega os dados

MinIO
Iceberg

9 CSVs viram tabelas Iceberg versionadas no MinIO. Demo de ACID e time travel passo a passo.

9 tabelas Bronze consultáveis
3
Módulo 3

Modela com Spark

Spark

Limpeza, joins e modelagem dimensional em PySpark. Sai com fato_vendas + 4 dimensões em estrela.

Modelo Silver + Gold pronto
4
Módulo 4

Automatiza no Airflow

Airflow

DAG diária com retry, sensors e observabilidade. Orquestra o pipeline inteiro (M2 → M3) — agora roda sozinho.

Pipeline agendado e observável
5
Módulo 5

Publica o dashboard

Superset

Superset conecta nas tabelas Iceberg via Spark Thrift. Dashboard de negócio publicado e apresentado num encontro temático ao vivo.

Dashboard + repo GitHub público
Você termina com Pipeline público no GitHub · Dashboard publicado · Certificado de conclusão
Por que aqui

Por que este curso e não outro:

01

Metodologia ativa — sala invertida.

Você recebe os materiais na sequência de estudo e constrói o pipeline no seu ambiente, módulo a módulo. Aulas gravadas pra rever quantas vezes quiser, encontros temáticos ao vivo pra aprofundar e mentorias 1:1 agendáveis pra destravar dúvidas. Não é vídeo passivo: tem pré-aula, desafios práticos e entregável em cada módulo. Seu cérebro percorre o caminho inteiro, não só o olho.

02

Cenário brasileiro real.

9 tabelas, ~100MB, sujeira proposital pra limpar. Você resolve problemas reais de modelagem, qualidade e performance — não brinca com SELECT 1.

03

Stack que o mercado contrata em 2026.

Nada de Hadoop morto, nada de tutorial de 2018. Mesma stack que aparece em job descriptions de Engenheiro de Dados Sênior hoje.

04

Você sai com portfólio público.

Pipeline + dashboard no GitHub. Recrutador testa em 5 minutos e vê que é seu de verdade. Sem firula, é evidência.

Fit do aluno

Pra quem é — e pra quem ainda não é.

Vamos ser honestos: montar pipeline de dados exige uma pilha de conhecimento prévio, e a gente sabe disso. Python, SQL, linha de comando, Docker — cada um desses é um curso inteiro por si só. Este curso não tem como partir do zero. Ele parte do dia em que você já tem o Docker rodando e escreve um JOIN sem consultar, e leva você daí até um pipeline Lakehouse completo em produção.

Se essa base ainda não é sua, isso não é um defeito seu — é só uma questão de ordem. Entrar agora seria pagar pra assistir uma aula em um idioma que você ainda não fala. Segura um pouco: estamos montando o curso preparatório exatamente pra essa lacuna — Python, SQL e Docker até o ponto em que este curso começa a fazer sentido. Ainda não tem data, mas quem reservar entra na lista de aviso e leva um desconto de fundador quando abrir.

Quero reserva no preparatório →

É a sua hora se…

  • É analista de dados querendo subir pra Engenharia de Dados
  • É dev backend curioso sobre o stack analítico moderno
  • É engenheiro junior e precisa de stack contemporâneo no portfólio
  • É DBA migrando de SQL Server/Oracle pro mundo Big Data

Ainda não é a sua hora se…

  • Python ainda não é rotina — aqui ele é ferramenta, não conteúdo. O preparatório começa exatamente aí.
  • Nunca subiu um docker compose up — no módulo 1 você já sobe cinco serviços. Também é preparatório.
  • SQL só de SELECT * — sem JOIN e GROUP BY, o módulo 3 vira parede. Preparatório de novo.

Nada disso é permanente — é só a ordem dos fatores. Reserve o preparatório e a gente te avisa.

E tem um caso que nenhum curso resolve: se você quer assistir vídeo passivamente, sem pôr a mão na massa, aqui tem entregável em cada módulo — vai ser dinheiro jogado fora. E se você precisa de diploma reconhecido pelo MEC, não somos instituição de ensino: nosso certificado vale pelo que você constrói, não pelo carimbo.

Checklist técnico · marque o que já é rotina

Você está pronto pra este curso?

Seis itens. Ninguém está olhando, e não tem resposta certa — só a sua. Marque com honestidade e o placar te diz onde você está.

Python intermediário Escrevo loops e funções e instalo pacote com pip sem procurar tutorial.
SQL básico-intermediário SELECT, JOIN, GROUP BY e subquery saem sem consultar.
Linha de comando Linux Navego, edito arquivo e rodo comando no terminal sem travar.
Docker Já rodei docker compose up e sei o que aconteceu depois.
Máquina 16GB de RAM e 50GB livres em disco.
Tempo Consigo ~5h por semana, no ritmo que eu definir.
Marque os itens acima pra ver onde você está.
Tudo que vem junto

Além do curso, você leva:

★ Acesso vitalício

Às aulas gravadas. Revise quantas vezes quiser.

★ Encontros ao vivo

Sessões temáticas pra aprofundar e tirar dúvidas em grupo.

★ Mentorias 1:1

Agende sessões individuais com o professor pra destravar.

★ Discord da turma

Comunidade exclusiva — você, colegas e professor.

★ Cheat sheets

PySpark, SQL Iceberg e operators do Airflow.

★ Docker templates

Pra acelerar setups futuros no seu trabalho.

★ Certificado

De conclusão, após o projeto final aprovado.

O investimento — Turma 1 Comunidade

Preço de comunidade + referência de mercado

Membros GU / DSSBR
R$550
Restam 7 vagas
  • Curso completo (20h)
  • Ingresso DSSBR 2026 (R$ 520)
  • Discord vitalício + cheat sheets
  • Certificado de conclusão
  • Acesso à comunidade DSSBR/GUBigData
Garantir vaga (membro) →
Cartão em até 5x (1x à vista, 2-5x com juros) · Pix à vista com 5% off
Não-membros
R$750
Não-membros · 20 vagas
  • Curso completo (20h)
  • Ingresso DSSBR 2026 (R$ 520)
  • Discord vitalício + cheat sheets
  • Certificado de conclusão
Garantir minha vaga →
Cartão em até 5x (1x à vista, 2-5x com juros) · Pix à vista com 5% off
Mercado · Turma 2
R$1.197
Próxima turma · set/2026
  • Curso completo (20h)
  • Sem ingresso DSSBR
  • Discord vitalício
  • Certificado de conclusão
Indisponível agora · sem preço de comunidade
Preço de comunidade (R$ 550): exclusivo para membros do GU BigData IA e ex-participantes do DSSBR. Não é membro? O investimento é R$ 750.
Ainda não é membro? O GU BigData & IA é um grupo de usuários que existe desde antes do curso — encontros, conteúdo e comunidade. Quem participa tem preço de comunidade aqui. Conhecer o GU BigData →

Bônus exclusivo da Turma 1: todo aluno recebe ingresso completo pro Data Science Summit Brasil 2026 (27-29 out, IEP Curitiba) — valor pré-venda R$ 520. Este bônus não existe nas próximas turmas.

Empresas e times de dados: consulte condições especiais para grupos de desenvolvedores, turmas fechadas e venda corporativa. Montamos turma dedicada com nota fiscal e ementa ajustada ao seu stack. Falar com a Azuris no WhatsApp →
Formato & acesso

Curso em andamento — entre quando quiser

  • Entre a qualquer momento: você começa recebendo os materiais na sequência de estudo e avança módulo a módulo, no seu ritmo
  • Aulas 100% gravadas — reveja quantas vezes precisar, quando precisar
  • Encontros temáticos ao vivo pra aprofundar (agenda divulgada na comunidade)
  • Mentorias 1:1 agendáveis pra tirar dúvidas direto com o professor
  • Metodologia ativa (sala invertida): pré-aula, prática e entregável em cada módulo
  • Bônus: ingresso DSSBR 2026 incluso
Dúvidas comuns

Perguntas frequentes

Preciso saber Spark ou Airflow antes?
Não. O curso ensina os dois do zero. Assumimos só Python intermediário e SQL básico.
Funciona em Mac, Linux e Windows?
Sim. Toda a stack roda em Docker — testado nos três sistemas operacionais.
O curso já começou — ainda dá pra entrar?
Dá sim. O curso é em andamento e usa sala invertida: você entra a qualquer momento, começa a receber os materiais na sequência de estudo e acompanha módulo a módulo, no seu ritmo.
As aulas são ao vivo ou gravadas?
As aulas são gravadas e você segue no seu ritmo, módulo a módulo. Além delas, há encontros temáticos ao vivo pra aprofundar e mentorias 1:1 que você agenda pra tirar dúvidas direto com o professor.
É curso oficial Apache, MEC ou tem pós-graduação?
Não. É curso livre comercial, foco 100% em prática profissional. Você sai com portfólio público, não com certificado de pós.
O curso garante uma vaga depois?
Não. Garantimos que você sai com um pipeline funcional no GitHub — recrutadores podem validar sozinhos. O resto é com você (mas a evidência prática vale ouro em entrevista).
Quantos alunos por turma?
Máximo 40 na Turma 1 (Comunidade). A partir da Turma 2 (Mercado), reduzimos pra 30 alunos por turma — limite real pra manter o acompanhamento individualizado.
Quem tem direito ao preço de comunidade (R$ 550)?
O preço de R$ 550 é exclusivo para membros do GU BigData IA e ex-participantes do DSSBR — pessoas que já participam dos eventos e do grupo de usuários. Estamos retribuindo a comunidade que sustenta nosso trabalho. Não é membro? O investimento é R$ 750, com o mesmo conteúdo e o mesmo bônus DSSBR. A partir da Turma 2, o preço sobe pro valor de mercado (R$ 1.197 e depois R$ 1.497).
O bônus DSSBR vale pra todas as turmas?
Não. Só Turma 1. A partir de setembro/2026 (Turma 2), as inscrições não incluem o ingresso DSSBR — é benefício exclusivo de quem entrar agora, na turma de lançamento.
Como funciona a entrega?
Aulas gravadas no portal do aluno, comunidade no Discord, encontros temáticos ao vivo e mentorias 1:1 via Zoom (agendadas). Após a compra você recebe acesso por e-mail em até 24h e já começa pelo Módulo 1.
Posso parcelar?
Sim, em até 5x no cartão. 1x é à vista sem juros; de 2x a 5x os juros do cartão ficam por sua conta. No Pix você paga à vista com 5% de desconto.

Pronto pra parar de só falar de Lakehouse —
e começar a construir um?

Garantir minha vaga no Lote 1 →
Curso em andamento · entre quando quiser · Bônus DSSBR exclusivo