1. PaaS 1.0の災害復旧

DR PaaS 1.0向け基本コールドスタンバイ

Version:
日本語翻訳に関する免責事項

このページの翻訳はAIによって自動的に行われました。可能な限り正確な翻訳を心掛けていますが、原文と異なる表現や解釈が含まれる場合があります。正確で公式な情報については、必ず英語の原文をご参照ください。

このトピックでは、PaaS 1.0の災害復旧について説明します。

Sitecore DRベーシックコールドスタンバイを用いることで、Sitecore Managed Cloud災害復旧サービスは障害発生時にプロセスを開始します。プライマリリージョンで障害が発生した場合、セカンダリデータセンターで新しいSitecore本番環境が作成されます。セカンダリ環境の作成中は、サイトが一時的にダウンしていることを顧客に知らせる簡単な障害ページが表示されます。新しい環境はセカンダリデータセンターで作成する必要があるため、この復旧オプションはRTOが長くなりますが、コストが安い選択肢です。

HADR_Basic.PNG

セットアップ

セットアップ手順は以下の通りです:

  • 制御リソースグループおよびDR状態を監視する関連する基盤リソースやサービスをプロビジョニングします。
  • SQLサーバー用のレプリケーションを設定してください。
  • プロビジョニングバックアップ自動化(ウェブアプリのバックアップをカバーし、フェイルオーバーグループ内のSQLサーバーデータベースの同期)。
  • 障害ページの設定。
  • トラフィックマネージャーを設定し、トラフィックをリダイレクトし、プライマリCDと障害ページ間の切り替えを行います。
  • 可用性テストが失敗した際にManaged Cloud運用チームに通知するメールアラートを設定しましょう。

フェイルオーバーの開始

Sitecore Managed Cloudプライマリージョン環境の健康状態を継続的にチェックします。5つのデータセンターのうち3つが問題を報告した場合、Sitecore Managed Cloud運用チームはプライマリデータセンターのSitecore環境を調査し、正当な問題か誤検知かを確認します。運用チームはプライマリーデータセンターで以下の検証チェックを行います:

  • Sitecoreサイトで使用されているAzureリソースによるアラートを確認しましょう。
  • トラフィックマネージャーが劣化したエンドポイントを報告しているか確認してください。
  • 既知のデータセンターの問題については Azureステータスサイト を確認してください。

クラウドオペレーションチームがプライマリデータセンターの基盤インフラの一部または全部に回復不能な問題があると判断した場合、フェイルオーバー確認プロセスが開始され、顧客に連絡が行われます。

フェイルオーバー/リカバリー確認

顧客が確認すると、Sitecoreは以下の手順で回復手続きを開始します。

  1. セカンダリーリージョンに新しいSitecore環境を展開します。
  2. 最後のバックアップからWebAppを復元してください。
  3. GeoReplicationでのSQLサーバーの切り替え。
  4. プライマリインスタンスの認証情報で接続文字列を更新します。
  5. コンテンツとxDBインデックスの再インデックス。
  6. トラフィックマネージャーをセカンダリのSitecoreインスタンスに切り替えます。

フェイルバック

Sitecoreがフェイルオーバープロセスを完了し、災害の原因が解決した後、顧客とManaged Cloud Operationsチームはプライマリージョン環境に戻るタイミングについて合意します。プライマリデータセンターのデータが更新されたため、フェイルオーバー手順をセカンダリからプライマリへ繰り返してデータを最新の状態にする必要があります。

この記事を改善するための提案がある場合は、 お知らせください!