1. Search user guide

索引項目

日本語翻訳に関する免責事項

このページの翻訳はAIによって自動的に行われました。可能な限り正確な翻訳を心掛けていますが、原文と異なる表現や解釈が含まれる場合があります。正確で公式な情報については、必ず英語の原文をご参照ください。

インデックスとは、特定のソースに関連付けられた検索可能なアイテムを表すデータ構造です^UUID-48c6b92f-d97a-3d5b-9006-85685f9183f0_N6762bd56030ee。アイテムの例としては、製品、URL、文書PDF、JSONオブジェクトなどがあります。インデックス文書は、実装中の単一のアイテムをJSONオブジェクトとして表現します。例えば、1,000語のHTMLページは1つのインデックスドキュメントに、10ページのPDFは別のインデックスドキュメントにマッピングされます。

インデックス作成はSitecore Searchにおいて重要です。なぜなら、訪問者が検索クエリを行ったとき、AI/MLエンジンがインデックスからそのクエリに合致するコンテンツを特定するからです。同様に、recommendationsもインデックスに基づいています。

このセクションのトピックでは、索引文書と索引作成のニーズに使えるソースの種類について説明します。

!重要ソースを設定する際には、エンティティや属性、意図する 検索体験 を考慮してください。なぜなら、その構成は以下の通りだからです:

  • どのコンテンツが検索されるかを特定して結果を返します。

  • コンテンツの種類、所在地、アクセシビリティ、範囲に関する情報を含めてください。

索引文書

インデックス文書には、システム属性など結果生成に重要な情報や、アイテムのエンティティタイプの属性に一致するJSONオブジェクトを含むrfk_source配列が含まれています。

以下のコードブロックは、企業のAbout usウェブページのインデックス文書を示しています。

{ "_index": "sampleindexnumber12345", "_id": "internalID123", "_version": 1, "_seq_no": 10, "_primary_term": 1, "found": true, "rfk_source": "content": { "id": "id83723bBnjh9321", "url": "https://www.sitecore.com/company", "image_url": "https://wwwsitecorecom.db.net/images/3d-scene05-violet.png?", "content_type": "others", "title": "About us", "description": "We’re growing at a historic rate. 2,200 employees...", "subtitle": "Welcome to Sitecore. We help brands create human connections...", "last_modified": "2023-09-13 `17

`
" }, "_entity": "content" , "questions_and_answers": {...}, "rfk_stats": {...}, ... } //sample index document for illustration only

!注インデックスされたすべてのアイテムはContent Collectionページで閲覧できます。それらはエンティティごとに異なるコレクションに分類され、エンティティの 属性や機能設定に準拠しています。

インデックス作成が成功した後、アイテムがコレクションに表示または更新されるまでに数分かかります。

資料の種類

ソースとは、Searchが訪問者のために検索可能なアイテムをインデックス化するために使用する仕組みです。一般的な実装では、HTMLページ、PDF、JSONオブジェクトなど、異なる場所やフォーマットで複数のソースにアクセスできる仕組みがあります。

Sitecore Searchはコンテンツインデックスの2種類の仕組みを提供しています。 プルソースプッシュソースです。 選択するソースの種類 は、アイテムへのアクセス方法、変更頻度、そしてどれだけ変わるかによって異なります。

プルソース

プルソースの場合、Sitecore Searchクローラーでコンテンツをスキャンしてインデックス化しますが、どのコンテンツをインデックス化し、属性をどう抽出するかを決めるルールを定義します。プルソースを使ったコンテンツのインデックス作成は、あなたとユーザー Searchの共同作業と考えることができます。

!注プルソースを使って増分的な更新を行うには、開発者がIngestion APIを使用できます。

Searchは以下のプルソースを提供しています:

  • ウェブクローラー - ある地点からハイパーリンクをたどったり、サイトマップをたどったりしてコンテンツをクロールする基本的なクローラーです。ウェブクローラーはシンプルで設定が簡単で、コーディングも不要です。
  • アドバンストウェブクローラー - 認証要件の処理、ローカライズされたコンテンツの処理、JavaScriptによる属性値抽出などの複雑なユースケースをサポートする、強力で高度にカスタマイズ可能なクローラーです。
  • APIクローラー - JSONを返すAPIエンドポイント専用に設計されたクローラーです。認証要件の処理、ローカライズされたコンテンツの処理、JSONPathやJavaScriptによる属性値抽出などの複雑なユースケースをサポートします。

プッシュソース

Searchはプッシュソースの一種、すなわちAPIプッシュソースを提供しており、インデックス文書を受け取るためのインデックスを作成します。

!注プッシュソースで増分更新を行うには、開発者はAPIプッシュコネクタを介してIngestion APIを使用する必要があります。

^UUID-48c6b92f-d97a-3d5b-9006-85685f9183f0_N6762bd56030ee

、ドキュメント、リポジトリからアイテムを取得し、検索可能にインデックス化するコネクターです。ソースは例えばウェブクローラー、APIクローラー、またはAPIプッシュなどです。

この記事を改善するための提案がある場合は、 お知らせください!