📣
TiDB Cloud Premium はパブリックプレビュー中です。エンタープライズワークロード向けの無制限のスケーリング、即時の弾力性、高度なセキュリティを提供します。このページは自動翻訳されたものです。原文はこちらからご覧ください。

主要な指標



TiUPを使用してTiDBクラスターをデプロイする場合、監視システム(PrometheusとGrafana)も同時にデプロイされます。詳細については、 TiDB 監視フレームワークの概要を参照してください。

Grafanaダッシュボードは、Overview、PD、TiDB、TiKV、Node_exporter、Disk Performance、Performance_overviewといった一連のサブダッシュボードに分かれています。診断に役立つ多くの指標が用意されています。

日常的な運用では、主要なメトリクスが表示されるOverviewダッシュボードから、コンポーネント(PD、TiDB、TiKV)のステータスとクラスタ全体の概要を確認できます。このドキュメントでは、これらの主要なメトリクスについて詳しく説明します。

主要な指標の説明

概要ダッシュボードに表示される主要な指標を理解するには、次の表を確認してください。

サービスパネル名説明正常範囲
Services Port StatusServices Up各サービスのオンライン ノード数。
PDPD role現在のPDの役割。
PDStorage capacityTiDB クラスターの合計ストレージ容量。
PDCurrent storage sizeTiKV レプリカによって占有されるスペースを含む、TiDB クラスターの占有ストレージ容量。
PDNormal stores正常状態にあるノードの数。
PDAbnormal stores異常状態にあるノードの数。0
PDNumber of Regions現在のクラスター内のリージョンの合計数。リージョンの数はレプリカの数とは関係ありません。
PD99% completed_cmds_duration_secondspd-server リクエストを完了するまでの 99 パーセンタイル期間。5ミリ秒未満
PDHandle_requests_duration_secondsPD リクエストのネットワーク期間。
PDRegion health各リージョンの状態。通常、保留中のピアの数は 100 未満であり、不足しているピアの数は必ずしも0を超えるとは限りません。
PDHot write Region's leader distribution各 TiKV インスタンスの書き込みホットスポットであるリーダーの合計数。
PDHot read Region's leader distribution各 TiKV インスタンス上の読み取りホットスポットであるリーダーの合計数。
PDRegion heartbeat reportインスタンスごとに PD に報告されたハートビートの数。
PD99% Region heartbeat latencyTiKV インスタンスごとのハートビートレイテンシー(P99)。
TiDBStatement OPS1秒あたりに実行される異なるタイプの SQL文の数。SELECT 、 INSERT 、 UPDATEなどの文のタイプに応じてカウントされます。
TiDBDuration実行時間。
1. クライアントのネットワークリクエストがTiDBに送信されてから、TiDBがリクエストを実行した後にクライアントに返されるまでの時間。通常、クライアントリクエストはSQL文の形式で送信されますが、この時間にはCOM_PING 、 COM_SLEEP 、 COM_STMT_FETCH 、 COM_SEND_LONG_DATAなどのコマンドの実行時間も含まれる場合があります。
2. TiDBはマルチクエリをサポートしているため、 select 1; select 1; select 1;ように複数のSQL文を一度に送信できます。この場合、このクエリの合計実行時間には、すべてのSQL文の実行時間が含まれます。
TiDBCPS By Instanceインスタンス別 CPS: コマンド実行結果の成功または失敗に応じて分類された、各 TiDB インスタンスのコマンド統計。
TiDBFailed Query OPM各TiDBインスタンスにおける1秒あたりのSQL文実行時に発生したエラー数に基づく、エラーの種類(構文エラーや主キーの競合など)の統計情報。エラーが発生したモジュールとエラーコードが含まれます。
TiDBConnection Count各 TiDB インスタンスの接続数。
TiDBMemory Usage各 TiDB インスタンスのメモリ使用量統計。プロセスによって占有されるメモリと、ヒープ上でGolangによって適用されたメモリに分割されます。
TiDBTransaction OPS1秒あたりに実行されるトランザクションの数。
TiDBTransaction Durationトランザクションの実行時間
TiDBKV Cmd OPS実行された KV コマンドの数。
TiDBKV Cmd Duration 99KV コマンドの実行時間。
TiDBPD TSO OPSTiDB が PD に送信する 1秒あたりの gRPC リクエストの数 (cmd) と TSO リクエストの数 (request)。各 gRPC リクエストには、TSO リクエストのバッチが含まれます。
TiDBPD TSO Wait DurationTiDB が PD から TSO が返されるのを待機する期間。
TiDBTiClient Region Error OPSTiKV によって返されたリージョン関連エラーの数。
TiDBLock Resolve OPSロックを解決したTiDB操作の数。TiDBの読み取りまたは書き込みリクエストがロックに遭遇すると、TiDBはロックを解決しようとします。
TiDBKV Backoff OPSTiKV によって返されたエラーの数。
TiKVleader各 TiKV ノード上のリーダーの数。
TiKVregion各 TiKV ノード上のリージョンの数。
TiKVCPU各 TiKV ノード上の CPU 使用率。
TiKVMemory各 TiKV ノードのメモリ使用量。
TiKVstore size各 TiKV インスタンスによって使用されるストレージスペースのサイズ。
TiKVcf size各カラムファミリー(略して CF) のサイズ。
TiKVchannel full各 TiKV インスタンスでの「チャネルフル」エラーの数。0
TiKVserver report failures各 TiKV インスタンスによって報告されたエラーメッセージの数。0
TiKVscheduler pending commands各 TiKV インスタンス上の保留中のコマンドの数。
TiKVcoprocessor executor countTiKVが1秒あたりに受信したコプロセッサ操作の数。コプロセッサの種類ごとに個別にカウントされます。
TiKVcoprocessor request durationコプロセッサの読み取りリクエストを処理するのに費やされた時間。
TiKVraft store CPUraftstoreスレッドのCPU使用率デフォルトのスレッド数は2( raftstore.store-pool-sizeで設定)です。1つのスレッドの値が80%を超える場合、CPU使用率が非常に高いことを示します。
TiKVCoprocessor CPUコプロセッサ スレッドの CPU 使用率。
System InfoVcoresCPU コアの数。
System InfoMemory合計メモリ。
System InfoCPU UsageCPU使用率、最大100%。
System InfoLoad [1m]1分間の負荷。
System InfoMemory Available使用可能なメモリのサイズ。
System InfoNetwork Trafficネットワークトラフィックの統計。
System InfoTCP RetransTOC 再送信の頻度。
System InfoIO Utilディスク使用率は最大でも 100% ですが、一般的には使用率が 80% ~ 90% までになると新しいノードの追加を検討する必要があります。

概要ダッシュボードのインターフェース

overview

このページは役に立ちましたか?