1. Search user guide

インデックスの設定

日本語翻訳に関する免責事項

このページの翻訳はAIによって自動的に行われました。可能な限り正確な翻訳を心掛けていますが、原文と異なる表現や解釈が含まれる場合があります。正確で公式な情報については、必ず英語の原文をご参照ください。

Sitecore Searchでは、使いたい インデックス方式の種類を選 んだ後、各タイプごとにソースを設定する必要があります。

このトピックでは、特定のコンテンツタイプ(ウェブクローラー、APIウェブクローラー、APIプッシュ、PDF、ローカライズドクローラー、ローカライズドAPIプッシュソース)など、さまざまなソースタイプの設定方法を説明するウォークスルーを紹介しリンクします。

!ヒントSitecore Searchでソースの設定方法についてのビデオ概要をご覧ください。

詳細や複雑さは異なりますが、すべての資料には以下の大まかな構成要素が含まれています。

  • インデックスするコンテンツトリガーと呼ばれます。この設定を使って、Searchにどのコンテンツをインデックスしたいか正確に伝えましょう。例えば、Searchにサイトマップ上のすべてのリンクをインデックスさせるか、指定されたURLから始めてハイパーリンクをたどるように指示できます。
  • コンテンツのインデックス付け方法 - ドキュメントエクストラクタと呼ばれます。この設定を使って、元のコンテンツから情報の一部を抽出し、それらを属性値として割り当てる方法を伝えSearch。例えば、抽象属性の値は、クラスabstractを持つ要素の子孫である最初の

    の値を抽出するためにXPath式//*contains(@class, "abstract")//pをSearchに指示できます。

  • インデックスされたコンテンツの更新方法 - クローラースケジュールを設定し て、インデックスドキュメントが元のコンテンツの最新バージョンを反映するようにできます。さらに、インデックスドキュメントに段階的な変更を加えたい場合は、 インクリメンタル更新を有効にすることができます。これにより、開発者は Ingestion API を使ってインデックスドキュメントを更新できます。
  • その他の設定 - これらはビジネスの要件に応じたオプションの設定です。

!注ソースのためには、以下の設定が必要です:

  • インデックス作業を開始するトリガーです。

  • インデックスが最新であることを保証するためのクローラーのスケジュール。

  • ドキュメント抽出器でメタデータを解析できます。

以下は、あなたのビジネス要件に応じたオプション設定です:

  • General Crawler設定 - 例えば、クロール可能なドメイン、回避すべきURL、使用するユーザーエージェントなどを含む 一連の設定 です。Sitecore Searchはほとんどの初期設定で十分なデフォルト値を提供しますが、必要に応じて変更することも可能です。

    例えば、クロールできる最大URL数を1000から3000に変更できます。

  • Locale-related settings - 複数のロケールにまたがるコンテンツをインデックス する必要がある場合は、このソースの 利用可能なロケール を定義する必要があります。また、Searchに各URLからローカーを取得する方法を伝える構成である ローコールエクストラクタも定義する必要があります。これは重要な点で、各インデックス文書にはロケールを紐付ける必要があります。

    例えば、ja-JPfr-FRを利用可能なロケートとして追加し、これらのロケーションをコンテンツから抽出する方法を設定できます。

  • Authentication-related settings - コンテンツにアクセスする前に認証が必要な場合は、クローラー認証 設定を設定する必要があります。

    例えば、コンテンツにアクセスする前にユーザー名とパスワードが必要な場合は、ブラウザ 認証を設定しましょう。

  • Tags - カスタム タグの作成機能

    、インデックスドキュメントのセットにどの属性を付けたいかを正確に指定できます。デフォルトでは、Sitecore Searchエンティティごとに1つのタグを作成します。さらにタグを作成できます。

    例えば、内部と外部のブログコンテンツの両方を持つウェブサイトを管理する場合、Blogエンティティの下に各タイプごとに別々のタグを作成できます

  • インデックス化する追加コンテンツ - トリガー がインデックスしたいすべての項目をカバーしていない場合は、リクエストエクストラクタを定義できます。これはSearchに追加URLをクロールするための生成方法を伝える設定です。

    例えば、トリガーがJSONを返すAPIクローラーを使う場合、返JSONを使ってAPIエンドポイント(URL)を生成する リクエストエクストラクタを定義 できます。

!重要インデックス方法を選ぶ際はクローラータイプの詳細な仕様を参照してください。

検索可能なコンテンツを成功裏にインデックスするために、これらの ベストインデックス方法 に従ってください。

この記事を改善するための提案がある場合は、 お知らせください!