JobConnect

Especialista SRE

  • Porto
  • São Paulo, Brazil
  • BRL 180,000 – BRL 264,000

Estamos construindo uma operação digital cada vez mais centrada na experiência do cliente no setor de seguros e buscamos um(a) Site Reliability Engineer (SRE) para atuar em um ecossistema de alta complexidade, onde sistemas modernos e legados coexistem na sustentação de jornadas críticas. Mais do que garantir disponibilidade e resiliência, você será responsável por transformar dados de observabilidade em insights acionáveis, conectando a performance das aplicações à experiência do usuário e aos resultados de negócio.

Esperamos que você identifique padrões em cenários heterogêneos e comunique diagnósticos com clareza, transitando com facilidade entre times de engenharia e lideranças não técnicas. Você atuará em uma das maiores operações de seguros do país, ajudando a consolidar uma cultura de confiabilidade e influenciando diretamente a evolução de nossos produtos digitais.

  • Atuar nas jornadas digitais críticas, garantindo confiabilidade, performance e disponibilidade dos serviços.

  • Evoluir a estratégia de observabilidade da companhia utilizando métricas, logs, traces e APM.

  • Investigar incidentes complexos e conduzir análises de causa raiz.

  • Criar e aprimorar dashboards, alertas e indicadores de saúde dos produtos.

  • Trabalhar em parceria com times de Infraestrutura, Engenharia, Produto, Arquitetura e Negócio.

  • Liderar post-mortems e processos de aprendizado contínuo.

  • Traduzir dados técnicos em recomendações compreensíveis para stakeholders executivos e de negócio.

  • Definir e acompanhar SLIs, SLOs e métricas relacionadas à experiência do usuário.

  • Experiência Profissional: Sólida trajetória como SRE, Production Engineer, Platform Engineer ou papéis correlatos, com vivência prática em arquiteturas distribuídas e ambientes modernos.

  • Domínio em Observabilidade: Conhecimento profundo em métricas, telemetria, logs centralizados, APM e distributed tracing.

  • Stack Tecnológica: Experiência com ferramentas de mercado, como Datadog, Dynatrace, AppDynamics, Prometheus, Grafana e OpenTelemetry.

  • Cloud & Confiabilidade: Conhecimento em provedores de Cloud (AWS, Azure ou GCP) e domínio das melhores práticas de confiabilidade, monitoração e gestão de incidentes.

  • Vale Alimentação e Refeição Flexíveis;

  • Plano de Saúde;

  • Plano Odontológico;

  • Wellhub e TotalPass;

  • Academia Bio Ritmo exclusiva para Colaboradores: no Complexo Matriz;

  • Participação nos Lucros - PLR;

  • Programa de Ações: Porto em Ação: complementar à PLR até 2025;

  • Quadras de Areia e Poliesportiva: no Complexo Matriz;

  • Vale-Transporte;

  • Serviços de Transporte de Vans; disponibilizadas nas principais estações de acesso à Porto (Luz, Barra Funda, Santa Cecília e Júlio Prestes);

  • Licença Parental Estendida: até 40 dias para todas as configurações familiares;

  • Licença Maternidade Estendida de 6 meses.;

  • Ambulatório Médico com Especialidades: no Complexo Matriz e Barra Funda;

  • Auxílio creche ou babá;

  • Seguro de Vida;

  • Previdência Privada - PortoPrev;

  • Desconto em Produtos e Serviços;

  • Bolsa de estudos: Reembolso para graduação, pós ou MBA;

  • Corridas mensais: subsídio para as principais corridas de ruas de São Paulo

  • Reembolso para idiomas (inglês ou espanhol);

  • Teatro Porto: sessões exclusivas para Colaboradores;

  • Biblioteca;

  • Sala de descanso: no completo Matriz

  • Salão de jogos: no complexo Matriz

  • Serviços de massagem e podologia: no completo Matriz

  • Local de trabalho: Local (Atuamos com modelos híbridos, que serão explorados no processo seletivo);

Skills

  • Site Reliability Engineering
  • Observability
  • APM
  • Incident Management
  • Root Cause Analysis
  • Dashboarding
  • Stakeholder Communication

Related jobs

PortoApply for this job