1. Managed Cloudの設定

Monitoring Managed Cloud Standard

Version:
日本語翻訳に関する免責事項

このページの翻訳はAIによって自動的に行われました。可能な限り正確な翻訳を心掛けていますが、原文と異なる表現や解釈が含まれる場合があります。正確で公式な情報については、必ず英語の原文をご参照ください。

内蔵のモニタリングサービスを利用すれば、Managed Cloudソリューションのパフォーマンスと可用性を常に把握できます:

  • メトリクスエクスポーター - サービスやインフラから既存のPrometheusサーバーへメトリクスをエクスポートするのに役立つライブラリ。
  • Prometheus - サービスからメトリクスをスクレイピングし、データを集約・保存し、Grafanaのような他のサービスがこれらのメトリクスを収集できるようにします。
  • グラファナ - プロメテウスから指標を集め、それを可視化します。
Monitoring services in Managed Cloud containers overview.

グラファナでの認証

GrafanaはActive Directory Azure統合されており、Basic Authenticationは無効です。したがって、Sign in with Microsoft認証オプションを選択し、Microsoftの職場アカウントを使う必要があります。

Login to Grafana with Microsoft account

ダッシュボード

ダッシュボード名で検索したり、1つ(または複数)タグで絞り込んだり、星付きステータスで絞り込んだりできます。ダッシュボードの上部ナビゲーションエリアにあるダッシュボードピッカーからアクセスできます。ショートカットFを使ってダッシュボード検索を開くこともできます。

Dashboard search in Grafana

以下のデフォルトダッシュボードが利用可能です:

ダッシュボード

概要

コンテナ概要

すべてのコンテナとその名前空間およびポッドを一覧表示します。各コンテナの状態と、健康/不健康および停止中のコンテナの総数を提供します。

ホストディスク概要(Linuxのみ)

ノードのファイルシステムやディスクのI/O指標、例えば読み書き時間、ファイルシステムの空き容量などを公開します。

ホストディスク概要(Windowsのみ)

ファイルシステムの利用可能な空き容量を示します。

入口概要

各SitecoreロールとGrafanaのIngressメトリクスを提供します。

Kubernetesクラスター

Kubernetesクラスターの概要を提供します。

Kubernetesポッド概要

システムを含むすべての名前空間に対して、ポッドごとのメモリおよびCPUリクエスト、制限、利用率を公開します。ライブログを提供します。

Linuxノード概要

各Linuxノードのメモリ/CPU/ディスク利用率に関する詳細な情報を提供します。

MsSQL エラスティックプール

MsSQLエラスティックプール利用に関する詳細な情報を提供します。

Redis サーバー概要

一般的なRedisの指標を公開します。ネイティブのRedisの「INFO」コマンドに似ています。

Windows ノード概要

各Windowsノードのメモリ/CPU/ディスク利用率に関する詳細な情報を提供します。

警報

アラートは、Managed Cloudソリューションに問題が見つかった際に積極的に通知します。これにより、システムのユーザーが気づく前に問題を特定し対処することが可能です。以下の表は利用可能なアラートの一覧です:

概要

状態

リソース

以上

ノード統計量

メモリパーセンテージは>95%です

ノードメモリ使用率は95%を超えています。

Kubernetesノード

10分

CPUパーセンテージは>95%です

CPU負荷率は95%以上です。

Kubernetesノード

10分

インフラ

ポッドは30mで準備できていません

ポッドの状態!= 準備完了

Kubernetes pod

30分

クベレットが倒れました

kubeletの仕事は最後の15分間は止まっている。

Kubernetes job

15分

ポッドが頻繁に再起動しています

ポッドは少なくとも5分ごとに1回再起動されます。

Kubernetes pod

1時間

展開生成のミスマッチ

展開は失敗しましたが、後退はしていません。

Kubernetesのデプロイメント

15分

デプロイレプリカの不一致

展開は1時間以上、期待されたレプリカ数に合致していません。

Kubernetesのデプロイメント

1時間

DaemonSetポッドが準備できていません

すべての希望のポッドがスケジュールされて準備が整っているわけではありません。

Kubernetes daemonset

15分

DaemonSetポッドのスケジュールがありません

希望するポッドがすべてスケジュールされているわけではありません。

Kubernetes daemonset

10分

DaemonSetポッドの誤スケッチ

デーモンセットのポッドが本来走ってはいけない場所で走っている。

Kubernetes daemonset

1時間

CPUのスロットリングが大きいです

ポッドのCPUスロットリング率は25%以上です。

Kubernetes pod

15分

警告事象が発生した

名前空間ではタイプ Warning のイベントが1つ以上発生しました。

Kubernetes名前空間

1時間

ノードはまだ準備ができていません

ノードはまだ準備できていません。

Kubernetesノード

1時間

Kubernetesバージョンの不一致

Kubernetesコンポーネントにはさまざまな意味的バージョンが動作しています。

Kubernetes

1時間

Kubernetes APIサーバークライアントがエラーが発生しています

Kubernetes APIサーバーでエラーが複数あります。

Kubernetes

5分

ノードのポッド容量が限界です

ノードポッドの容量は95%以上です。

Kubernetesノード

15分

ディスクスペースは>90%で使用されます

ノードディスク空間は90%以上を占めています。

Kubernetesノード

1時間

Sitecoreの役割

HTTPリクエストは5xx >10

5xxのHTTP応答は10以上です。

nginx_ingress_controller

10分

平均ページ応答時間>1秒

平均応答時間は1秒以上です。

nginx_ingress_controller

30分

平均ページ応答時間>30秒

平均応答時間は30秒以上です。

nginx_ingress_controller

5分

可用性テストが行われています /sitecore/service/keepalive.aspx

/sitecore/service/keepalive.aspxの利用可能性テストは失敗しました。

Sitecoreポッド

5分

Redis キャッシュ

接続されたクライアントの割合は>80%です。

接続された顧客数は redis_config_maxclientsに比べて80%以上です。

Redis キャッシュ

30分

サーバー負荷は>95%です

過去30分間でRedisのプロセッサ負荷率は95%を超えています。

Redis キャッシュ

30分

MSSQLエラスティックプール

データベーススループットユニット(DTU)は>95%です。

平均スループット単位(DTU)は95%以上です。

30分

ストレージの割合は>75%です

平均ストレージ率は75%以上です。

5分

CPUは>95%です。

平均CPU使用率は95%以上です。

5分

SQL データベースのデッドロック

データベースがデッドロック中です。

データ輸入率は>95%です。

平均的なデータ輸入率は95%以上です。

5分

ログのIOパーセンテージは>95%です

平均的なLog IOパーセンテージは95%以上です。

5分

労働者の割合は>95%です

最大労働者の割合は95%を超えています。

5分

DB層でサポートされる同時セッション数は>95%です

DBティアでサポートされる最大同時セッション数は95%以上です。

5分

失敗したデータベース接続数>5

データベースでは過去5分間で5回の接続障害が発生しました。

5分

平均メモリ内OLTPストレージ>95%

平均的なインメモリOLTPストレージは95%以上です。

30分

この記事を改善するための提案がある場合は、 お知らせください!