Analytics Engineer Sênior

🏢 Caju · all Caju jobs
📍 Brazil
📅 Posted 2026-08-14 · via Himalayas
🏷 Analytics-Engineering,Data-Engineering,Analytics-Engineer,Data-Infrastructure,Senior-Data-Analytics-Engineer,Analista-De-Dados-Sênior,Analista-De-Datos-Senior
Apply on original site ↗

A Caju é uma empresa brasileira de tecnologia , que busca dar mais sabor à vida profissional, transformando a relação entre empresas e colaboradores por meio de soluções mais inovadoras e seguras como o Cartão Multi Benefícios, Solução em Despesas Corporativas, Premiações e Caju Ciclos.

Aqui na Caju , aprendemos sempre , e nos tornamos cada vez melhores em um ambiente colaborativo e divertido!

São muito bem-vindas candidaturas de pessoas negras/pretas, mulheres, indígenas, LGBTQIA+, ou outros grupos minorizados.

Inscreva-se e conheça mais sobre nosso time 🧡

- Construir e manter modelagens de dados robustas utilizando DBT, aplicando boas práticas de desenvolvimento como testes, documentação e versionamento de modelos.

- Desenvolver tabelas fato, dimensão e data marts orientados às necessidades das áreas de negócio, seguindo padrões de modelagem dimensional (Star Schema/Snowflake Schema).

- Atuar como elo entre as equipes de negócio e a engenharia de dados, realizando levantamento de requisitos, interpretando regras de negócio e traduzindo demandas analíticas em soluções de dados confiáveis e escaláveis.

- Documentar os modelos desenvolvidos, incluindo definições de métricas, regras de negócio aplicadas, glossário de dados e lineage, garantindo rastreabilidade e entendimento por toda a organização.

- Implementar e manter pipelines de orquestração no Databricks e Airflow, assegurando a confiabilidade e o monitoramento dos fluxos de dados.

- Desenvolver soluções em Python e SQL para transformação, tratamento e agregação de dados no ambiente Databricks.

- Implementar testes de qualidade de dados nos modelos DBT e camadas analíticas, garantindo consistência, completude e acurácia das informações entregues às áreas de negócio.

- Estruturar monitorias e alertas sobre os pipelines e modelos de dados, atuando proativamente na identificação e resolução de inconsistências.

- Conduzir projetos complexos de modelagem de ponta a ponta, desde o entendimento da dor do negócio até a entrega das camadas analíticas em produção.

- Aplicar estratégias de particionamento, clustering e materialização adequadas para garantir performance e eficiência de custo no processamento dos dados.

- Colaborar com squads de produto e negócio para garantir que as soluções de dados suportem decisões estratégicas e operacionais da empresa.

- Utilizar GitHub para versionamento de código, revisão de pull requests e manutenção de boas práticas de engenharia no time.

Modelagem e Arquitetura de Dados

- Domínio em modelagem de dados analíticos: Star Schema, Snowflake e OBT (One Big Table)

- Conhecimento sólido em arquiteturas de camadas como Medallion Architecture (Bronze, Silver, Gold).

- Capacidade de definir e aplicar contratos de dados entre camadas, garantindo consistência e previsibilidade para os consumidores.

Performance e Otimização

- Experiência com estratégias de materialização no DBT (tables, views, incremental models e snapshots), sabendo escolher a abordagem mais adequada para cada camada e volume de dados.

- Conhecimento em particionamento de dados por colunas de data ou outras chaves de alta cardinalidade, reduzindo o volume lido nas queries e otimizando custo e desempenho no Databricks.

- Familiaridade com técnicas de clustering e Z-Ordering no Databricks/Delta Lake para otimização de leitura em tabelas de grande volume.

- Capacidade de identificar e corrigir gargalos de performance em queries SQL, como evitar full table scans, uso eficiente de joins, agregações e window functions.

- Capacidade de estimar e gerenciar o impacto de modelos complexos no custo de processamento em cloud, propondo soluções que equilibrem performance e eficiência operacional.

Ferramentas e Tecnologias

- Domínio de DBT (dbt Core ou dbt Cloud), incluindo criação de modelos, testes, macros e documentação.

- Experiência com Databricks e Delta Lake, incluindo funcionalidades como Time Travel, VACUUM e OPTIMIZE.

- Habilidades avançadas em SQL para constr

← All remote jobs