Analista de SRE Pleno | RD Station (Remoto)
Quer fazer parte de um time que cria oportunidades e potencializa a evolução?
Como alcançamos tudo isso?
Através de um ecossistema de mais de 12 mil pessoas inconformadas que, juntas, oferecem soluções, produtos e educam o mercado. Atuamos como uma Única TOTVS, integrando diferentes soluções e expertises para educar o mercado e simplificar o mundo dos negócios. Para nós, a evolução é constante e acontece de gente para gente: usamos nossa inquietude para antecipar tendências e transformar o crescimento real da tecnologia.
Nosso jeito de ser:
🤖IH + IA (Inteligência Humana + Inteligência Artificial): Acreditamos que a tecnologia potencializa, mas as pessoas direcionam. Aqui, a IA nos dá escala e eficiência, enquanto a nossa Inteligência Humana traz a estratégia, o contexto e o cuidado. É essa combinação que nos permite criar soluções inovadoras com um propósito real.
🚀Protagonismo e Evolução: Somos movidos pelo aprendizado contínuo e pela coragem de assumir o comando da própria carreira. Aqui, incentivamos a inquietude e oferecemos o ambiente fértil para quem quer crescer, criar e se transformar.
Resultado Responsável: Valorizamos a liberdade para agir e a responsabilidade com o todo. Aqui, você tem voz para desafiar o status quo e autonomia para buscar resultados que gerem valor real para nossos clientes e para a sociedade.
🧘🏼♀️ Bem-Estar Integral: Cuidamos de quem faz a evolução acontecer. Buscamos o bem-estar integral de cada pessoa colaboradora, por meio de ações e benefícios que viabilizam recursos de autocuidado através de 5 pilares: Emocional, Financeiro, Físico, Ocupacional e Social.
🫂Pluralidade e Pertencimento: A diversidade é o que nos torna potentes. Promovemos a inclusão e o pertencimento de forma ativa, garantindo que a TOTVS seja um lugar onde você pode ser quem você é. Nossa expertise é humana e viva: acolhemos as diferenças para empoderar negócios dentro e fora da empresa.
Seu desafio no time:
Você fará parte do time de Site Reliability Engineering (SRE) e atuará na evolução das práticas de confiabilidade, padronização e automação da infraestrutura da RD Station . Seu principal desafio será reduzir a complexidade e aumentar a produtividade dos times de engenharia, atuando ao lado de engenheiros experientes em um ambiente focado em aprendizado e crescimento rápido.
Suas principais entregas:
- Apoiar e aprender a operar e provisionar workloads críticos (Redis, Elasticsearch, filas, bancos, etc.) em ambientes de larga escala;
- Contribuir na implementação e melhoria de automação e Infraestrutura como Código (IaC), fazendo updates supervisionados em projetos de infraestrutura (ex: TF Projects);
- Colaborar na observabilidade dos sistemas, aprendendo a usar ferramentas (como Datadog) para criar dashboards, configurar alertas e analisar logs, métricas e tracing;
- Participar ativamente de atividades de troubleshooting, gestão de incidentes e análise de causa raiz, promovendo a confiabilidade dos produtos;
- Aprender e aplicar padrões de engenharia, SLOs, SLIs e boas práticas de SRE para tornar a infraestrutura mais simples, rápida e segura.
Perfil que buscamos:
- Experiência com ambientes Linux;
- Experiência com Git;
- Experiência avançada com provedores Cloud (GCP e AWS obrigatoriamente; Azure recomendável);
- Experiência com orquestração de containers (Kubernetes);
- Entendimento intermediário de pipelines de CI/CD;
- Capacidade de leitura e entendimento de código para compreender lógica de scripts e aplicações;
- Conhecimento dos conceitos de observabilidade, automação, monitoração e engenharia de software;
- Perfil analítico e pró-ativo para aperfeiçoar habilidades técnicas e acompanhar engenheiros JR;
- Conhecimento de ferramentas de Infraestrutura como Código (IaC).
Será considerado um diferencial:
- Certificações AWS, GCP, LPI;
- Noções de linguagens de programação e/ou scripting;
- Conhecimento em ferramentas e métricas de observabilidade;
- Experiência com monitoramento d