Analista de Infraestrutura - Page Diversity

🏢 Michael Page | Enterprise Solutions
📍 Brazil
📅 Posted Sep 13, 2026 · via Himalayas
🏷 Infrastructure Analyst, Cloud Infrastructure, SRE, DevOps, Cloud Operations, Analista De Infraestrutura
Apply on original site ↗
✓ Re-crawled against the original posting daily — dead and stale listings expire automatically.

Estamos buscando uma pessoa que goste de tecnologia, automação e confiabilidade de ambientes para atuar como Analista de Infraestrutura .

Se você gosta de resolver problemas complexos, antecipar riscos, automatizar processos e trabalhar em um ambiente que valoriza melhoria contínua, esta pode ser uma excelente oportunidade para a sua carreira.

Você fará parte de um time responsável por garantir a estabilidade e a performance de produtos em nuvem, contribuindo diretamente para a experiência dos usuários e para a evolução da nossa operação.

Com principal a missão de garantir a disponibilidade, a confiabilidade e a eficiência dos ambientes em nuvem, atuando de forma proativa no monitoramento, na prevenção de incidentes e na automação de processos.
Além disso, você terá um papel importante na transformação de atividades operacionais recorrentes em soluções automatizadas e escaláveis, reduzindo esforços manuais e aumentando a eficiência do time.

As principais responsabilidades desta posição, são:

- Evoluir processos de monitoramento e observabilidade dos ambientes de produção;

- Atuar de forma preventiva na identificação e mitigação de riscos operacionais;

- Definir métricas e indicadores que reflitam a experiência real dos usuários;

- Melhorar continuamente a qualidade dos alertas, reduzindo falsos positivos e ruídos operacionais;

- Criar e manter dashboards que apoiem análises e decisões técnicas;

- Automatizar atividades manuais e repetitivas, promovendo ganho de eficiência para a operação;

- Evoluir a infraestrutura como código utilizando ferramentas como Terraform e Helm;

- Desenvolver scripts e automações utilizando Python e Shell Script;

- Atuar na triagem, mitigação e resolução de incidentes em ambientes produtivos;

- Participar de análises de causa raiz e implementação de ações preventivas;

- Acompanhar indicadores de utilização e custos de infraestrutura;

- Automatizar processos de provisionamento e desprovisionamento de ambientes e acessos.

Requisitos Obrigatórios

- Experiência com Kubernetes em ambientes produtivos;

- Conhecimento em Cloud Computing, preferencialmente AWS;

- Experiência com Infraestrutura como Código (IaC), utilizando Terraform e Helm;

- Conhecimento em observabilidade e monitoramento com Prometheus e Grafana;

- Vivência com troubleshooting em ambientes Linux;

- Experiência com automações utilizando Python e/ou Shell Script;

- Experiência em resposta a incidentes em ambientes de produção;

- Conhecimentos de redes, DNS, TLS, VPN e ferramentas de diagnóstico e debug.

Informações adicionais

Será um diferencial se você tiver

- Experiência com APIs REST e API Gateway;

- Conhecimento em ferramentas de gerenciamento de logs como Elasticsearch, OpenSearch ou Loki;

- Vivência na construção e manutenção de pipelines CI/CD;

- Conhecimento de práticas de confiabilidade como SLI, SLO e Error Budget;

- Experiência com Ansible ou ferramentas semelhantes;

- Inglês para leitura e consulta de documentações técnicas.

Originally posted on Himalayas

← All remote jobs

Get remote jobs like this by email

10 hand-picked jobs, one email a day. No spam, unsubscribe anytime.

Similar for you