コンテンツに移動
Silktideヘルプ

スコープルール

テスト対象では、またはに含める URL を制御します。これらのルールは、検出の前および検出中にクロール対象を調整するための、主な顧客向けの方法です。

許可、拒否、強制

  • 許可ルールは、Silktide が含める URL パターンを指定します。許可ルールを 1 つでも設定すると、一致する URL(および強制ページ)のみがスコープに含まれます。
  • 拒否ルールは、許可されたスコープから一致する URL を除外します。拒否ルールは常に許可ルールより優先されます。
  • 強制ページは、通常のリンク経由では検出されない場合でも、特に重要な特定の URL を Silktide に含めるよう指定します。ただし、テスト実行時に到達可能である必要があります。

ルールでは、URL の先頭や末尾、テキストの一致、正規表現、URL の長さの条件など、複数の一致タイプを利用できます。サイトを正確に表現できる範囲で、ルールはできるだけ限定的にしてください。変更後は新しいテストを実行し、インベントリのカバレッジを確認してください。

ウェブサイト全体が URL のみに基づく理由

ウェブサイト全体(ルートの「すべてのページ」ビュー)では、URL ルールのみを使用できます。Silktide は、ページをダウンロードする前に、その URL を取得する価値があるかどうかを判断する必要があります。その時点で信頼できる情報は、URL 自体だけです。

は異なります。セクションとは、独立したサイトであるかのようにレポートされる、ウェブサイト内の定義済みの部分です。ウェブサイトのためにページがすでにダウンロードされていれば、Silktide はセクションにコンテンツベースのルールも適用できます。これは URL だけでなく、ページに何が含まれているかを確認するルールです。テキストやその他のページコンテンツなどに基づいて、ページをセクションに含めたり、除外したりできます。

このため、高度なコンテンツベースのルールはセクションでは利用できますが、ウェブサイト全体では利用できません。ウェブサイトレベルの判断は URL だけから決定できる状態を維持する必要があり、そうでなければ、検出時に候補となるすべてのページを先にダウンロードしなければならないからです。

サイト全体で先にダウンロードする方法が機能しない理由

ウェブサイトのスコープがページのコンテンツに依存する場合、Silktide は許可されているかどうかを判断する前にページを取得する必要があります。大規模なサイトでは、テスト対象として意図した範囲を大幅に超えてダウンロードし、その大部分を破棄することになります。これにより、処理が遅くなり、コストが増え、レート制限に抵触する可能性も高くなります。URL ルールを使えば、外側の境界を低コストで評価できます。セクションでは、ページコンテンツがすでに利用可能になった後で、所属範囲をさらに絞り込めます。

他のスコープ設定との関係

URL ルールとセクションルールは、テストスコープの一部にすぎません。認証、クロール可能性、リダイレクト、robots.txt(デフォルトでは適用されません)、高度なクローラー設定、も、検出される対象に影響します。

日常的なルールは、テスト対象で設定してください。このページは、これらの設定の背後にある仕組みを確認する必要がある場合に使用します。

最終更新

このページは役に立ちましたか?

スコープルール | Silktide ヘルプ