ESPECIALISTA SRE
Nós somos a Quality Digital ! Saiba mais sobre a gente:
-
Uma frase que nos define - Somos especialistas em soluções de TI e apaixonados por inovação! 🚀
-
Ao infinito e além - Somos #semfronteiras . Nosso time está espalhado pelo Brasil e pelo mundo 🌎
-
Nossa cultura - Mesmo distantes, estamos juntos 🧡 Temos cerimônias para estarmos mais próximos, compartilhar conhecimento e ficar por dentro das novidades da nossa empresa!
-
Somos diversos - Um dos nossos compromissos é fazer da companhia um ambiente cada vez mais diverso, inclusivo e respeitoso, valorizando e promovendo a pluralidade. Por isso, aqui temos espaço para todas as pessoas, independente de raça, gênero, idade, orientação sexual, crença religiosa ou deficiência. 🏳️🌈👩🏾🦽
-
Nosso objetivo - Potencializar os negócios dos nossos clientes através de soluções inovadoras e sustentáveis. Topa vir com a gente nessa? 🎯
O que buscamos?
Buscamos um profissional de Site Reliability Engineering com forte especialização em Observabilidade , capaz de atuar de forma transversal entre diferentes áreas de tecnologia para mapear, compreender e monitorar a cadeia completa dos serviços e sistemas da organização.
O principal desafio desta posição será construir uma visão ponta a ponta dos serviços , identificando como aplicações, integrações, APIs, bancos de dados, componentes de infraestrutura, redes, mensageria e serviços de terceiros se relacionam para entregar cada serviço de negócio.
Forte capacidade de investigação técnica e visão sistêmica , que tenha facilidade para conversar com especialistas de diferentes disciplinas e transformar informações fragmentadas em uma visão integrada do ambiente.
Principais responsabilidades:
- Atuar junto aos times de Infraestrutura, Redes, Banco de Dados, Cloud, Segurança, Desenvolvimento, Arquitetura, Integração, Middleware, APIs e Sistemas , conduzindo levantamentos técnicos e workshops de descoberta.
- Mapear a arquitetura e a cadeia de dependências dos principais sistemas da empresa, identificando todos os componentes envolvidos na entrega de cada serviço.
- Construir o Service Mapping ponta a ponta , contemplando infraestrutura, aplicações, integrações, APIs, bancos de dados, filas, serviços externos e demais dependências.
- Identificar os diferentes caminhos utilizados pelas integrações entre sistemas e compreender como cada componente impacta a disponibilidade do serviço.
- Relacionar componentes técnicos com os respectivos serviços de negócio , permitindo maior entendimento do impacto de falhas.
- Identificar lacunas de monitoração e observabilidade existentes nos ambientes.
- Definir e implementar uma estratégia de observabilidade para os serviços mapeados, contemplando métricas, logs, traces, eventos, experiência digital e disponibilidade .
- Criar monitoração orientada a serviço, deixando de observar apenas componentes isolados e passando a acompanhar o fluxo completo das transações e integrações .
- Definir indicadores de confiabilidade como SLI, SLO e disponibilidade de serviços .
- Construir dashboards, alertas, correlações e mecanismos de diagnóstico que permitam identificar rapidamente onde ocorreu uma degradação ou interrupção.
- Trabalhar na redução de MTTD e MTTR , utilizando observabilidade para acelerar a identificação da causa raiz.
- Participar de projetos corporativos desde suas fases iniciais, garantindo que novos sistemas e integrações já nasçam com requisitos adequados de observabilidade.
- Apoiar a evolução da cultura de observabilidade dentro da organização, promovendo boas práticas entre os diferentes times técnicos.
- Necessário Ensino Superior completo;
- Arquitetura de aplicações e sistemas distribuídos
- Infraestrutura de servidores e sistemas operacionais
- Redes e protocolos de comunicação
- Bancos de dados
- APIs REST e integrações entre sistemas
- Microserviços
- Containers e Kubernetes
- Cloud e ambientes híbridos
- Filas e mensageria
- Balanceadores, proxies e gate