From b3344ca081aa319a53023d27b445ea330e3a5e65 Mon Sep 17 00:00:00 2001 From: AdamDang Date: Thu, 6 Dec 2018 22:42:29 +0800 Subject: [PATCH] zx-trans: add controller-metrics.md (#11509) zx-trans: add controller-metrics.md --- .../controller-metrics.md | 84 +++++++++++++++++++ 1 file changed, 84 insertions(+) create mode 100644 content/zh/docs/concepts/cluster-administration/controller-metrics.md diff --git a/content/zh/docs/concepts/cluster-administration/controller-metrics.md b/content/zh/docs/concepts/cluster-administration/controller-metrics.md new file mode 100644 index 0000000000..462bbdffa3 --- /dev/null +++ b/content/zh/docs/concepts/cluster-administration/controller-metrics.md @@ -0,0 +1,84 @@ +--- +title: 控制器管理器指标 +content_template: templates/concept +weight: 100 +--- + + + +{{% capture overview %}} + + + +控制器管理器指标为控制器管理器的性能和健康提供了重要的观测手段。 + +{{% /capture %}} + +{{% capture body %}} + + + +## 什么是控制器管理器度量 + +控制器管理器指标为控制器管理器的性能和健康提供了重要的观测手段。 +这些度量包括常见的 Go 语言运行时度量,比如 go_routine 计数,以及控制器特定的度量,比如 etcd 请求延迟或 云提供商(AWS、GCE、OpenStack)的 API 延迟,这些参数可以用来测量集群的健康状况。 + +从 Kubernetes 1.7 版本开始,详细的云提供商指标可用于 GCE、AWS、Vsphere 和 OpenStack 的存储操作。 +这些度量可用于监视持久卷操作的健康状况。 + +例如,在 GCE 中这些指标叫做: + +``` +cloudprovider_gce_api_request_duration_seconds { request = "instance_list"} +cloudprovider_gce_api_request_duration_seconds { request = "disk_insert"} +cloudprovider_gce_api_request_duration_seconds { request = "disk_delete"} +cloudprovider_gce_api_request_duration_seconds { request = "attach_disk"} +cloudprovider_gce_api_request_duration_seconds { request = "detach_disk"} +cloudprovider_gce_api_request_duration_seconds { request = "list_disk"} +``` + + + +## 配置 + +在集群中,控制器管理器指标可从它所在的主机上的 `http://localhost:10252/metrics` 中获得。 + +这些指标是以 [prometheus 格式](https://prometheus.io/docs/instrumenting/exposition_formats/) 发出的,是人类可读的。 + +在生产环境中,您可能想配置 prometheus 或其他一些指标收集工具,以定期收集这些指标数据,并将它们应用到某种时间序列数据库中。 + +{{% /capture %}} + +