Especialista de SRE II
- Full-time
- Employee Status: Regular
- Role Type: Home
- Department: Technology
- Schedule: Full Time
Company Description
A Experian é uma empresa global de dados e tecnologia que impulsiona oportunidades para pessoas e empresas ao redor do mundo. Atuamos em diversos mercados, como serviços financeiros, saúde, automotivo, agronegócio, seguros, entre outros. A Experian investe em pessoas e em novas tecnologias avançadas para liberar o poder dos dados. Contamos com uma equipe incrível de 25.200 colaboradores em 32 países.
Nossa singularidade é valorizar a sua. A cultura da Experian, centrada nas pessoas, inclusiva e orientada por propósito, é reconhecida por diversos prêmios — incluindo World’s Best Workplaces™ 2025 (Top 25 global da Fortune) e Great Place To Work™ em 26 países, entre outros. Confira o Experian Life nas redes sociais ou explore nosso site de carreiras para entender o porquê. A Experian também se orgulha de ser uma empregadora que promove igualdade de oportunidades e ação afirmativa.
Job Description
Descrição do trabalho
Estamos à procura de um Principal Site Reliability Engineer para liderar tecnicamente a disciplina de Engenharia de Confiabilidade de um produto crítico da companhia.
Esse profissional será responsável por definir a estratégia técnica de SRE, evoluir padrões de engenharia, confiabilidade, observabilidade e automação, além de atuar como referência técnica para o time e gestor das pessoas que compõem a equipe.
Esperamos um profissional com forte capacidade de liderança, visão sistêmica, excelente tomada de decisão e habilidade para influenciar diferentes áreas de tecnologia e negócio, garantindo alta disponibilidade, resiliência e eficiência operacional dos serviços.
Responsabilidades Diárias
Liderar técnica e gerencialmente o time de SRE, promovendo desenvolvimento técnico e de carreira dos engenheiros;
Definir e evoluir a estratégia de confiabilidade, observabilidade e excelência operacional dos produtos;
Atuar como principal referência técnica em incidentes críticos, coordenando respostas e análises de causa raiz;
Trabalhar em conjunto com Arquitetura, Desenvolvimento, Segurança e Produto na evolução das plataformas;
Conduzir rituais de operação, revisão de incidentes, capacity planning e gestão de riscos;
Promover cultura de automação e melhoria contínua;
Garantir adoção de boas práticas de SRE, DevOps e Engenharia de Plataforma;
Apoiar a priorização de débitos técnicos e iniciativas de confiabilidade junto às áreas de negócio.
Principais Entregas
Evolução dos indicadores de disponibilidade, confiabilidade e performance dos produtos;
Definição e acompanhamento de SLIs, SLOs e Error Budgets;
Evolução da plataforma de observabilidade (Logs, Métricas, Traces e APM);
Automação de processos operacionais reduzindo atividades manuais;
Redução do MTTR e aumento da capacidade de prevenção de incidentes;
Estruturação de Post Mortems sem culpabilização (Blameless);
Implantação de práticas de Chaos Engineering, Disaster Recovery e Capacity Planning;
Definição de padrões técnicos para infraestrutura, monitoramento e operação;
Desenvolvimento técnico da equipe através de mentoring, feedbacks, dojos e comunidades técnicas.
O que estamos buscando em você
Liderança
Experiência comprovada liderando equipes técnicas de SRE, DevOps ou Plataforma;
Experiência como gestor de pessoas;
Capacidade de influenciar diferentes áreas sem autoridade direta;
Excelente comunicação executiva e técnica;
Experiência na gestão de incidentes críticos e crises;
Forte capacidade analítica e tomada de decisão baseada em dados.
Qualifications
Qualificações
Conhecimentos Técnicos
Kubernetes (EKS/OpenShift)
Docker
AWS
Terraform
GitHub Actions, Jenkins ou outras ferramentas CI/CD
Observabilidade (Dynatrace, Datadog, Grafana, Prometheus, ELK, OpenTelemetry)
Linux
Redes, DNS, HTTP, TLS e balanceadores
Automação utilizando Python, Go ou Shell Script
Infraestrutura como Código (IaC)
Engenharia de Performance
Resiliência e Alta Disponibilidade
Gestão de Capacidade
Disaster Recovery
Chaos Engineering
Gestão de Vulnerabilidades
Práticas DevSecOps
Será um diferencial
Certificações AWS Professional ou Specialty;
Certificação Kubernetes (CKA/CKS);
Experiência com Service Mesh (Istio);
Experiência com Backstage ou Platform Engineering;
Conhecimento em FinOps;
Experiência em ambientes regulados e produtos de missão crítica;
Vivência com arquitetura orientada a eventos (Kafka, RabbitMQ).
Additional Information
A Serasa Experian é muito mais do que você imagina. Com o propósito de criar um futuro melhor, ampliando oportunidades para pessoas e empresas, no Brasil somos mais de 4 mil pessoas que atuam em diversos times e especialidades. Aqui, cada conhecimento e diversidade se complementa e você pode trabalhar no que mais ama, estamos comprometidos a construir uma cultura inclusiva e um ambiente no qual pessoas possam equilibrar a carreira com seus compromissos e interesses pessoais, prezando pelo bem-estar.
A gente se dedica muito em ser uma das melhores e mais inovadoras empresas para se trabalhar do país, possibilitando experiências e carreiras incríveis para nossas pessoas. Nossa forte abordagem de pessoas em primeiro lugar é reconhecida externamente por meio de diversas certificações de mercado: fomos premiados pelo Great Place To Work™ em 24 países e pela certificação internacional Top Employers, além de sermos reconhecidos como uma das melhores empresas para jovens profissionais e contarmos com uma avaliação de 4,6 no Glassdoor. Cada reconhecimento nos indica que estamos no caminho certo, proporcionando um ambiente de trabalho cada vez melhor para nossos talentos.
Experian Careers - Creating a better tomorrow together
Find out what its like to work for Experian by clicking here
By clicking the link above or any third-party link within this posting, you are leaving this site and going to a third-party website where the third-party website's terms and privacy policy apply