Regras de âmbito
O que testamos controla que URLs pertencem a um ou . Essas regras são a principal forma, visível para os clientes, de definir o rastreio antes e durante a descoberta.
Permitidas, negadas e forçadas
- As regras permitidas descrevem os padrões de URL que a Silktide pode incluir. Se definir regras permitidas, apenas as URLs correspondentes (e as páginas forçadas) ficam no âmbito.
- As regras negadas removem do âmbito permitido as URLs correspondentes. As regras negadas têm sempre prioridade sobre as permitidas.
- As páginas forçadas indicam à Silktide que deve incluir URLs importantes específicas, mesmo quando não são descobertas através de ligações normais. Ainda assim, têm de estar acessíveis quando o teste for executado.
As regras suportam vários tipos de correspondência, incluindo inícios e finais de URL, correspondências de texto, expressões regulares e condições de comprimento de URL. Mantenha as regras tão específicas quanto possível, sem deixar de representar corretamente o site. Depois de as alterar, execute um novo teste e reveja a Cobertura do inventário.
Por que razão todo o website funciona apenas com URLs
O website como um todo (a vista raiz de "todas as páginas") só pode utilizar regras de URL. A Silktide tem de decidir se vale a pena obter uma URL antes de descarregar a página. Nesse momento, a única informação fiável é a própria URL.
As são diferentes. Uma secção é uma parte definida do website que apresenta resultados como se fosse um site próprio. Depois de uma página já ter sido descarregada para o website, a Silktide também pode aplicar regras baseadas no conteúdo a uma secção — regras que analisam o que está na página, e não apenas a URL. Essas regras podem colocar uma página numa secção ou mantê-la fora dela, com base em elementos como texto ou outro conteúdo da página.
É por isso que as regras avançadas baseadas no conteúdo estão disponíveis para as secções, mas não para o website como um todo: a decisão ao nível do website tem de continuar a ser determinável apenas a partir da URL, caso contrário a descoberta teria de descarregar primeiro todas as páginas candidatas.
Se o âmbito do website dependesse do conteúdo das páginas, a Silktide teria de obter uma página antes de saber se a sua obtenção era permitida. Num site grande, isso significaria descarregar muito mais conteúdo do que pretende testar e depois eliminar a maior parte — tornando o processo mais lento, mais dispendioso e mais suscetível de atingir limites de taxa. As regras de URL mantêm o limite exterior barato de avaliar. As secções refinam a pertença posteriormente, quando o conteúdo da página já está disponível.
Como isto se integra com o restante âmbito
As regras de URL e de secção são apenas uma parte do âmbito dos testes. A autenticação, a possibilidade de rastreio, os redirecionamentos, o robots.txt (não aplicado por predefinição), as definições avançadas do rastreador e a também afetam o que é encontrado.
Configure as regras do dia a dia em O que testamos. Utilize este artigo quando precisar de compreender o modelo subjacente a esses controlos.