Analista de SRE Pleno | RD Station (Remoto)

🏢 RD Station · all 19 jobs
📍 Brazil
📅 Posted Aug 23, 2026 · via Himalayas
🏷 Site Reliability Engineering, DevOps Engineer, Infrastructure Engineering, Cloud Engineer, SRE, Analista De SRE
Apply on original site ↗

Quer fazer parte de um time que cria oportunidades e potencializa a evolução?

Como alcançamos tudo isso?

Através de um ecossistema de mais de 12 mil pessoas inconformadas que, juntas, oferecem soluções, produtos e educam o mercado. Atuamos como uma Única TOTVS, integrando diferentes soluções e expertises para educar o mercado e simplificar o mundo dos negócios. Para nós, a evolução é constante e acontece de gente para gente: usamos nossa inquietude para antecipar tendências e transformar o crescimento real da tecnologia.

Nosso jeito de ser:

🤖IH + IA (Inteligência Humana + Inteligência Artificial): Acreditamos que a tecnologia potencializa, mas as pessoas direcionam. Aqui, a IA nos dá escala e eficiência, enquanto a nossa Inteligência Humana traz a estratégia, o contexto e o cuidado. É essa combinação que nos permite criar soluções inovadoras com um propósito real.

🚀Protagonismo e Evolução: Somos movidos pelo aprendizado contínuo e pela coragem de assumir o comando da própria carreira. Aqui, incentivamos a inquietude e oferecemos o ambiente fértil para quem quer crescer, criar e se transformar.

Resultado Responsável: Valorizamos a liberdade para agir e a responsabilidade com o todo. Aqui, você tem voz para desafiar o status quo e autonomia para buscar resultados que gerem valor real para nossos clientes e para a sociedade.

🧘🏼‍♀️ Bem-Estar Integral: Cuidamos de quem faz a evolução acontecer. Buscamos o bem-estar integral de cada pessoa colaboradora, por meio de ações e benefícios que viabilizam recursos de autocuidado através de 5 pilares: Emocional, Financeiro, Físico, Ocupacional e Social.

🫂Pluralidade e Pertencimento: A diversidade é o que nos torna potentes. Promovemos a inclusão e o pertencimento de forma ativa, garantindo que a TOTVS seja um lugar onde você pode ser quem você é. Nossa expertise é humana e viva: acolhemos as diferenças para empoderar negócios dentro e fora da empresa.

Seu desafio no time:

Você fará parte do time de Site Reliability Engineering (SRE) e atuará na evolução das práticas de confiabilidade, padronização e automação da infraestrutura da RD Station . Seu principal desafio será reduzir a complexidade e aumentar a produtividade dos times de engenharia, atuando ao lado de engenheiros experientes em um ambiente focado em aprendizado e crescimento rápido.
Suas principais entregas:

- Apoiar e aprender a operar e provisionar workloads críticos (Redis, Elasticsearch, filas, bancos, etc.) em ambientes de larga escala;

- Contribuir na implementação e melhoria de automação e Infraestrutura como Código (IaC), fazendo updates supervisionados em projetos de infraestrutura (ex: TF Projects);

- Colaborar na observabilidade dos sistemas, aprendendo a usar ferramentas (como Datadog) para criar dashboards, configurar alertas e analisar logs, métricas e tracing;

- Participar ativamente de atividades de troubleshooting, gestão de incidentes e análise de causa raiz, promovendo a confiabilidade dos produtos;

- Aprender e aplicar padrões de engenharia, SLOs, SLIs e boas práticas de SRE para tornar a infraestrutura mais simples, rápida e segura.

Perfil que buscamos:

- Experiência com ambientes Linux;

- Experiência com Git;

- Experiência avançada com provedores Cloud (GCP e AWS obrigatoriamente; Azure recomendável);

- Experiência com orquestração de containers (Kubernetes);

- Entendimento intermediário de pipelines de CI/CD;

- Capacidade de leitura e entendimento de código para compreender lógica de scripts e aplicações;

- Conhecimento dos conceitos de observabilidade, automação, monitoração e engenharia de software;

- Perfil analítico e pró-ativo para aperfeiçoar habilidades técnicas e acompanhar engenheiros JR;

- Conhecimento de ferramentas de Infraestrutura como Código (IaC).

Será considerado um diferencial:

- Certificações AWS, GCP, LPI;

- Noções de linguagens de programação e/ou scripting;

- Conhecimento em ferramentas e métricas de observabilidade;

- Experiência com monitoramento de sistemas, especialmente com Datadog ou similares;

- Conhecimento intermediário de redes (TCP/IP, DNS, load balancing, VPC);

- Vivência ou participação prévia em resolução de incidentes.

Etapas do processo seletivo:

-
Aplicação - Envio da inscrição;

-
Mindsight – Teste de estilo de trabalho;

-
Talent Acquisition - Entrevista por competência com o time de recrutamento;

-
Desafio Técnico – Teste de avaliação de habilidades técnicas;

-
Entrevista Final - Conversa final com a gerência para alinhamento;

-
Offer - Fase de conclusão do processo seletivo, com a apresentação da proposta de trabalho.

Obs: Podem ter etapas complementares e/ou alterações, de acordo com a necessidade do processo.

🔒 Nos comprometemos com a segurança dos seus dados! Em nosso Aviso de Privacidade, descrevemos quais dados coletamos, como são consumidos e armazenados, em conformidade com a LGPD.

Se você é uma pessoa movida por desafios, criatividade e impacto genuíno, avance conosco nessa jornada de evolução!

Faça parte do nosso time!

Originally posted on Himalayas

Flights + hotels

This role requires you to be in Brazil. If that means relocating or flying in, it is worth checking fares before you commit to a start date.

Compare flights and hotels →

← All remote jobs

Comparing Site Reliability Engineer pay and openings — the live median is $129k?All remote Site Reliability Engineer jobs →Site Reliability Engineer salary data →
Want more like this? Browse every live remote developer role.All remote developer jobs →
Get new developer jobs by email
Daily email, only when there's something new. One click to stop.

Get remote developer jobs like this by email

10 hand-picked jobs, one email a day. No spam, unsubscribe anytime.

Similar for you