DEVOPS/SRE

DEVOPS/SRE

Descrição da Empresa

A Olisipo é uma das principais e mais sólidas referências nacionais como talent recruiter, talent builder e talent care na área das tecnologias de informação. A nossa missão é encontrar o melhor projeto para cada pessoa e, para cada empresa, o melhor talento na área das tecnologias de informação.   #ConnectingITPeople

Descrição da Função

Perfil: - Experiência mínima de 5 anos em funções de Cloud Engineer, Site Reliability Engineer (SRE), Platform Engineer ou similares; - Experiência sólida em pelo menos uma plataforma Cloud: AWS, Azure ou Google Cloud Platform (GCP); - Conhecimentos sólidos de networking, segurança, Identity and Access Management (IAM), alta disponibilidade e otimização de custos em ambientes Cloud; - Experiência na implementação e gestão de soluções de monitorização, alerting, logging, tracing e telemetry; - Conhecimentos na definição e gestão de SLIs (Service Level Indicators) e SLOs (Service Level Objectives); - Capacidade para transformar métricas de observabilidade em ações concretas de melhoria da fiabilidade e desempenho dos serviços; - Experiência em troubleshooting de incidentes complexos e resolução de problemas em ambientes críticos; - Experiência em Incident Response, Root Cause Analysis (RCA) e realização de post-mortems; - Experiência na redução do Time to Recovery (TTR) e implementação de iniciativas de melhoria contínua da fiabilidade; - Forte capacidade analítica, autonomia e orientação para a resolução de problemas; - Excelentes competências de comunicação e colaboração em equipas multidisciplinares; - Domínio da língua inglesa (nível C2). Responsabilidades: - Administrar e otimizar infraestruturas Cloud em AWS, Azure ou GCP, garantindo elevados níveis de disponibilidade, segurança e desempenho; - Implementar e manter soluções de observabilidade, incluindo monitorização, alerting, logging, tracing e telemetry; - Definir, acompanhar e melhorar indicadores de fiabilidade, nomeadamente SLIs e SLOs; - Analisar métricas operacionais e implementar ações que aumentem a disponibilidade e resiliência dos serviços; - Diagnosticar e resolver incidentes complexos em ambientes Cloud; - Liderar processos de Incident Response, Root Cause Analysis (RCA) e elaboração de post-mortems; - Desenvolver iniciativas para reduzir o Time to Recovery (TTR) e aumentar a estabilidade das plataformas; - Implementar boas práticas de networking, segurança, IAM, alta disponibilidade e otimização de custos; - Colaborar com equipas de Desenvolvimento, Operações e Infraestruturas na melhoria contínua da plataforma; - Promover a automação de processos e a adoção de boas práticas de fiabilidade, observabilidade e operação em ambientes Cloud. Oferecemos: - Seguro de Saúde; - Formação online gratuita, através da plataforma Udemy; - Formação Presencial e Remota no Learning Center da Olisipo; - Certificações Gratuitas (mediante aprovação em exame); - Descontos em Parceiros Olisipo (áreas de saúde e bem-estar, fitness, viagens, entre outros); - Consultas psicológicas gratuitas; - Possibilidade de adiantamento de salário, sem comissões.

Localização

  • Lisboa, Portugal
Contactar empresa