コンテンツに移動
Silktideヘルプ

Silktideのクロール方法

Silktideは、従来のHTML専用ボットのようにはクロールしません。各ページを実際のブラウザー(ヘッドレスChrome)で読み込むため、スクリプトの実行、レイアウトの再配置、リソースの読み込みが完了した後に、人が見るものにおおむね近い状態を確認できます。

そのため、Silktideはソースのみを対象とするクローラーでは見逃される、最新のJavaScriptを多用したサイトをテストできます。また、結果にはレイアウト、コントラスト、スクリーンショット、ページの読み込みが安定した後の最終的なHTMLなどを含めることができます。

クロールで行われること

通常のテスト実行では、次の処理が行われます。

  1. ウェブサイトのホームページ(および設定した強制ページ)から開始します。
  2. 対象範囲内の各ページを、デスクトップで、また有効にしている場合はモバイルでも、ブラウザーで読み込みます。
  3. リンクからさらにURLを検出し、多くの場合はサイトマップからも検出します。
  4. 対象範囲内のすべてがカバーされるか、ウェブサイトのに達するまで続行します。

テスト対象で、どのURLをその対象範囲に含めるかを管理できます。高度なクローラー設定では、SilktideがそれらのURLを検出して読み込む積極性を変更できます。詳しくはページの読み込みをご覧ください。

ページとファイルの違い

Silktideが見つけたすべてのものが、同じ方法で読み込まれるわけではありません。

  • HTMLページはブラウザーで開かれます。JavaScriptが実行され、ページをスクロールでき、結果を取得する前に、Silktideが設定されたコントロール(たとえばCookieバナーを閉じるボタン)をクリックできます。
  • PDFやその他多くの文書は、クロール中に(通常はページからのリンクとして)検出され、完全なブラウザーページとしてレンダリングされるのではなく、ファイルとしてダウンロードされます。これらは引き続きドキュメント容量にカウントされ、到達可能である必要もあります。

PDFのURLがPDFのように見えない場合(たとえば、.pdf拡張子がない場合)、SilktideはそのURLをページとして分類し、代わりにページ許容量を消費することがあります。詳しくはページ制限によってPDFのテストが妨げられるのはなぜですか?をご覧ください。

これが重要な理由

Silktideは実際のブラウザーを使用するため、次のことが可能です。

  • 生のHTMLレスポンスだけでなく、クライアント側でレンダリングされたコンテンツを確認できます
  • ページを操作できます。バナーを閉じたり、ユーザーフローを実行したり、設定された認証を完了したりできます
  • スクリーンショットを取得し、コントラストやレイアウトなどの視覚的な特性を測定できます
  • リクエストは引き続きSilktideのインフラストラクチャ(またはプロキシ)から送信されるため、ファイアウォールやボット対策によって妨げられる可能性があります

「Silktideには自分が見ているものが見えていますか?」への簡潔な回答については、Silktideはどのようにウェブサイトを認識しますか?をご覧ください。

最終更新

このページは役に立ちましたか?