フィードクローラーの設定
このページの翻訳はAIによって自動的に行われました。可能な限り正確な翻訳を心掛けていますが、原文と異なる表現や解釈が含まれる場合があります。正確で公式な情報については、必ず英語の原文をご参照ください。
Sitecore Searchでは、フィードクローラーは以下のような文書からデータをインデックス化するために使われます。
- 区切り符を含むテキストファイル。
- CSVファイルです。
- JSON文字列ファイル。
これらのファイルから体系的にデータを抽出し、Sitecore Search内で検索可能なコンテンツに変換します。このプロセスには、フィードクローラーソースの作成、ドキュメントエクストラクタの設定、データを処理するトランスフォーマーの設定が含まれます。
!注セールスフィードクローラーコネクタタイプを選択すると、特定の セールスフィードクローラー構成 が存在する必要があります。
!重要CSVファイルはアップロード前に正しくフォーマットされている必要があります。無効な引用、1行あたりのフィールド数の不一致、ヘッダー行の誤りなどのエラーはクローラーの失敗を引き起こします。
このウォークスルーでは、以下の方法を説明します:
- フィードクローラーソースを作成する
- 場所の選択
- タグの定義
- ドキュメントエクストラクタを作成する
- ドキュメントとカラムのトランスフォーマーを追加
- インクリメンタルアップデートを設定しましょう
- 出典を公開してください:::
!注始める前にドキュメントはSecure File Transfer Protocol(SFTP)を介してのみフィードクローラーにアップロードできます。SFTP認証情報を受け取りたい方は、Sitecoreサポートにお問い合わせください。
フィードクローラーソースを作成する
最初のステップはソースを作成することです。これは指定されたウェブサイト、ドキュメント、リポジトリからアイテムを取得し、検索可能にインデックス化するコネクターです。
ソースを作成するには:
- メニューバーで **「SOURCES」**をクリックしてください。
- Click ソースを追加する
ソースを追加する。 - SOURCE NAMEフィールドにソースの名前を入力します。
- DESCRIPTION欄で、設定したいソースを数行入力してください。
- CONNECTORドロップダウンリストで「Feed Crawler」をクリックします。
- Click Save。エラーがなければ、Searchは新しいソースを作成します。
場所の選択
ローカは 、データが関連する地理的および言語的地域を指定します。サーチは、フィードクローラーでインデックスされたデータがターゲットオーディエンスの言語や地域設定に適していることを確認し、訪問者をローカリー固有のページへ誘導し、あらゆる種類のウィジェットに対してローカ別ルールを作成するためにローカリー値を用います。
情報源の場所を選ぶには:
- メニューバーで 「Sources」をクリックし、フィードクローラーのソースを選択します。
- Source Settingsメニューで「Available Locales」をクリックします。
- Localesドロップダウンリストで、ドメイン用に設定済みのロケールを選択します。
- Click Save。
タグの定義
タグ は特定のエンティティの検索体験を作成するために使われます。ソースを設定する際、タグ定義 ウィンドウでそのソースによって更新されるエンティティを指定します。
このソースで特定のエンティティを更新するためにタグを使用する方法:
- メニューバーで 「Sources」をクリックし、フィードクローラーのソースを選択します。
- Source Settingsメニューで**「Tags Definition**」をクリックします。
- エンティティのドロップダウンリストで、このソースによって更新されるエンティティを選択します。
- 基本的なタグを設定するには、「From」ドロップダウンリストで**「タグ」**をクリックします。
- タグ欄にタグの名前を入力してください。
- Click Save。
ドキュメントエクストラクタを作成する
ドキュメントエクストラクターはフィードクローラーにアップロードされたファイルからデータを処理・抽出し、Searchでインデックス化可能な構造化形式に変換します。ドキュメントエクストラクタにはこの変換を行うためのデフォルトのJavaScriptロジックが付属していますが、必要に応じて必要に応じてこのロジックを編集することも可能です。
ドキュメントエクストラクタを作成するには:
-
メニューバーで「 Sources 」をクリックし、フィードクローラーのソースを選択します。
-
左のペインで**「ドキュメント抽出器**」をクリックし、次に**「文書抽出器」セクションで「
編集**」をクリックします。 -
エクストラクタを作成するには、「ドキュメントエクストラクター」ページで「エクストラクタを追加」
をクリックし、次に**「ドキュメントエクストラクター**」ページで以下の手順を下してください。- Basepathフィールドに、/upload/ に付加されたファイルのベースパスを入力します。例えば、ファイルを入力します。
- ファイル名欄にファイル名を入力します。例えば、filename.jsonと入力します。
- ファイルタイプドロップダウンメニューで、CSVまたはJSONを選択します。
- ファイルがGZip形式なら、 isGzip スイッチをオンにしてください。
SFTPを使って文書をアップロードすると、自動的にソースがトリガーされます。
-
タグ付けセクションで
タグ付けを追加をクリックします。その後、タグエディターでタグのドロップダウンリストからタグを選択します。例えば、コンテンツを選択します。!注ドキュメントエクストラクタでは、それぞれがユニークなタグにリンクされた複数のタグガーを作成できます。このようにして、各タグ付け者は以下の通りになります:
-
索引文書のセットを生成します。
-
複数のルールを持つことができ、それぞれのルールが1つの属性の抽出ロジックを定義します。
例えば、5つのルールを持つタグ付け器は、それぞれ5つの属性を持つ1つの文書セットを生成します。
3つのタグ付け器でそれぞれ1つのルールを持つと、それぞれ1つの属性を持つ3つの文書セットが得られます。
-
-
抽出タイプフィールドで、抽出ロジックのドロップダウンリストからBaseまたはJavaScriptのいずれかを選択します。
- アップロード済み文書の既存の列ヘッダーをインデックス付き属性名として使用するには、ドロップダウンリストから Base を選択し、 IDフィールド にID列ヘッダーを入力し、CSVファイルで使われている区切り文を区 切り 欄に入力してください。
- Searchのデフォルトのエクストラクタロジックを変更するには、ドロップダウンリストから Javascript を選択し、 JS Source ウィンドウで関数を編集してください。
// Sample extractor function. Change the function to suit your individual needs function extract(headerSegments, lineSegments) { response = {} for (i = 0; i < lineSegments.length; i++) { responseheaderSegmentsi = lineSegmentsi } return response }
!注関数 名 フィールド内の関数名とJSソース ウィンドウが一致しない場合、エクストラクタが起動された際にエラーが発生します。
-
タグエディターで「 保存」をクリックします。
-
(オプション)別のタグの属性を抽出するには、タグ付け
追加をクリックし、タグのドロップダウンリストでタグをクリックして6から10までの手順を繰り返します。 -
(任意)別のドキュメントエクストラクタを追加するには、ステップ4から6まで繰り返します。
-
ドキュメント抽出器のページで、保存をクリックします。
ドキュメントとカラムのトランスフォーマーを追加
フィードクローラーを設定すると、SearchはCSVやJSONなどの構造化文書をインデックスするためにトランスフォーマーを使っています。インデックス作成前にさらにデータを変更するために、追加のトランスフォーマーを追加・設定することも可能です 。
ドキュメントとカラムのトランスフォーマーを追加するには:
- 左側のペインで「Transformers」をクリックし、Transformersセクションで「
Edit」をクリックします。 - Transformersページの左側ペインで**「Document Transformers**」をクリックします。
- ドキュメント トランスフォーマー のパネルでドキュメント トランスフォーマーを追加します。
- ドキュメントトランスフォーマーを追加するには、ステップ3を繰り返します。
- 左側のペイン、 Column Transformersの横で「
Column Transformer」をクリックします。 - 列 トランスフォーマー のペインで、 列トランスフォーマーを追加します。
- もう一つの列トランスを追加するには、ステップ6を繰り返します。
- Click Save。
インクリメンタルアップデートを設定しましょう
SFTP経由でファイルをアップロードするとソースがトリガーされますが、PatchやPutsなどのAPI更新でソースへの更新も可能です。APIリクエストでソースを更新するには、インクリメンタルアップデートを有効にしてください。
ソースの段階的な更新を有効にするには:
- メニューバーで「 Sources 」をクリックし、フィードクローラーのソースを選択します。
- Source Settingsメニューで「Incremental Updates」をクリックします。
- 「 Enable Incremental Updates 」スイッチをClickで機能を有効にし、その後「 保存」をクリックします。
ソースを公開する
最初のスキャンとインデックスを始めるには、必ずソースを公開してください。
出典を公開するには:
- ソースページの右上にある「 ソース公開 」ダイアログを開くには、「 公開」をクリックしてください。