スコープルール
テスト対象では、またはに含める URL を制御します。これらのルールは、検出の前および検出中にクロール対象を調整するための、主な顧客向けの方法です。
許可、拒否、強制
- 許可ルールは、Silktide が含める URL パターンを指定します。許可ルールを 1 つでも設定すると、一致する URL(および強制ページ)のみがスコープに含まれます。
- 拒否ルールは、許可されたスコープから一致する URL を除外します。拒否ルールは常に許可ルールより優先されます。
- 強制ページは、通常のリンク経由では検出されない場合でも、特に重要な特定の URL を Silktide に含めるよう指定します。ただし、テスト実行時に到達可能である必要があります。
ルールでは、URL の先頭や末尾、テキストの一致、正規表現、URL の長さの条件など、複数の一致タイプを利用できます。サイトを正確に表現できる範囲で、ルールはできるだけ限定的にしてください。変更後は新しいテストを実行し、インベントリのカバレッジを確認してください。
ウェブサイト全体が URL のみに基づく理由
ウェブサイト全体(ルートの「すべてのページ」ビュー)では、URL ルールのみを使用できます。Silktide は、ページをダウンロードする前に、その URL を取得する価値があるかどうかを判断する必要があります。その時点で信頼できる情報は、URL 自体だけです。
は異なります。セクションとは、独立したサイトであるかのようにレポートされる、ウェブサイト内の定義済みの部分です。ウェブサイトのためにページがすでにダウンロードされていれば、Silktide はセクションにコンテンツベースのルールも適用できます。これは URL だけでなく、ページに何が含まれているかを確認するルールです。テキストやその他のページコンテンツなどに基づいて、ページをセクションに含めたり、除外したりできます。
このため、高度なコンテンツベースのルールはセクションでは利用できますが、ウェブサイト全体では利用できません。ウェブサイトレベルの判断は URL だけから決定できる状態を維持する必要があり、そうでなければ、検出時に候補となるすべてのページを先にダウンロードしなければならないからです。
他のスコープ設定との関係
URL ルールとセクションルールは、テストスコープの一部にすぎません。認証、クロール可能性、リダイレクト、robots.txt(デフォルトでは適用されません)、高度なクローラー設定、も、検出される対象に影響します。
日常的なルールは、テスト対象で設定してください。このページは、これらの設定の背後にある仕組みを確認する必要がある場合に使用します。