Come esegue il crawling Silktide
Silktide non esegue il crawling come un bot tradizionale che analizza solo l'HTML. Carica ogni pagina in un vero browser, Chrome headless, così vede più o meno ciò che vede una persona dopo l'esecuzione degli script, il ridisposizionamento dei layout e il caricamento delle risorse.
Per questo Silktide può testare siti moderni che fanno ampio uso di JavaScript e che i crawler che analizzano solo il codice sorgente non rilevano; per lo stesso motivo, i risultati possono includere layout, contrasto, screenshot e l'HTML finale dopo che la pagina si è stabilizzata.
Cosa fa un crawling
Una tipica esecuzione del test:
- Inizia dalla home page del sito (e da tutte le pagine obbligatorie che hai configurato).
- Carica ogni pagina inclusa nell'ambito nel browser su desktop e, quando abilitato, su dispositivi mobili.
- Scopre altri URL dai link e spesso anche dalle sitemap.
- Continua finché tutto ciò che rientra nell'ambito non è stato analizzato oppure finché non viene raggiunta la dal sito.
Puoi controllare quali URL rientrano in tale ambito con Cosa testiamo. Le impostazioni avanzate del crawler modificano il livello di accuratezza con cui Silktide scopre e carica questi URL: consulta Caricamento di una pagina.
Pagine e file
Non tutto ciò che Silktide trova viene caricato nello stesso modo:
- Le pagine HTML vengono aperte nel browser. JavaScript viene eseguito, la pagina può essere fatta scorrere e Silktide può fare clic su un controllo configurato (ad esempio per chiudere un banner dei cookie) prima di acquisire i risultati.
- I PDF e molti altri documenti vengono individuati durante il crawling, di solito come link nelle pagine, e scaricati come file anziché essere visualizzati come pagine complete nel browser. Concorrono comunque alla capacità per i documenti e devono comunque essere raggiungibili.
Se un URL di un PDF non sembra essere un PDF (ad esempio non presenta l'estensione .pdf), Silktide potrebbe classificarlo come una pagina e utilizzare invece la quantità di pagine consentita. Consulta Perché i limiti di pagine possono impedire il test dei PDF?.
Perché è importante
Poiché Silktide utilizza un vero browser:
- Analizza i contenuti renderizzati dal client, non solo la risposta HTML grezza
- Può interagire con le pagine: chiudere banner, eseguire flussi utente o completare l'autenticazione configurata
- Può acquisire screenshot e misurare caratteristiche visive come contrasto e layout
- Le richieste provengono comunque dall'infrastruttura di Silktide (o da un proxy), quindi firewall e sistemi di difesa dai bot possono comunque interferire
Per una risposta più breve alla domanda «Silktide vede ciò che vedo io?», consulta Come vede i siti web Silktide?.