Prometheus Operator 与 kube-prometheus 之一-简介

east4ming 2023-03-28 原文

简介

Prometheus Operator

Prometheus Operator: 在 Kubernetes 上管理 Prometheus 集群。该项目的目的是简化和自动化基于 Prometheus 的 Kubernetes 集群监控堆栈的配置。

kube-prometheus

最简单的方法是将 Prometheus Operator 作为 kube-prometheus 的一部分进行部署。kube-prometheus 部署了 Prometheus Operator，并且已经安排了一个名为 prometheus-k8s 的 prometheus，默认带有警报和规则，并且带有其他 prometheus 需要的组件，如：

Grafana
kube-state-metrics
prometheus adapter
node exporter
...

Prometheus Operator vs. kube-prometheus vs. community helm chart

Prometheus Operator

Prometheus Operator 使用 Kubernetes 自定义资源，简化了 Prometheus、Alertmanager 和相关监控组件的部署和配置。

kube-prometheus

kube-prometheus 提供了一个基于 Prometheus 和 Prometheus Operator 的完整集群监控堆栈的示例配置。这包括部署多个 Prometheus 和 Alertmanager 实例、用于收集节点指标的指标导出器（如 node_exporters)、将 Prometheus 链接到各种指标端点的目标配置，以及用于通知集群中潜在问题的示例警报规则。

helm chart

prometheus-community/kube-prometheus-stack helm chart 提供了与 kube-prometheus 相似的特性集。这张 chart 是由 prometheus 社区维护的。

Prometheus Operator 功能

CRD

Prometheus Operator 的一个核心特性是 watch Kubernetes API 服务器对特定对象的更改，并确保当前 Prometheus 部署与这些对象匹配。Operator 对以下自定义资源定义 (crd) 进行操作：

monitoring.coreos.com/v1:

Prometheus: 它定义了 Prometheus 期望的部署。
Alertmanager: 它定义了 AlertManager 期望的部署。
ThanosRuler: 它定义了 ThanosRuler 期望的部署；如果有多个 Prometheus 实例，则通过 ThanosRuler 进行告警规则的统一管理。
ServiceMonitor: Prometheus Operator 通过 PodMonitor 和 ServiceMonitor 实现对资源的监控，ServiceMonitor 用于通过 Service 对 K8S 中的任何资源进行监控，推荐首选 ServiceMonitor. 它声明性地指定了 Kubernetes service 应该如何被监控。Operator 根据 API 服务器中对象的当前状态自动生成 Prometheus 刮擦配置。
PodMonitor: Prometheus Operator 通过 PodMonitor 和 ServiceMonitor 实现对资源的监控，PodMonitor 用于对 Pod 进行监控，推荐首选 ServiceMonitor. PodMonitor 声明性地指定了应该如何监视一组 pod。Operator 根据 API 服务器中对象的当前状态自动生成 Prometheus 刮擦配置。
Probe: 它声明性地指定了应该如何监视 ingress 或静态目标组。Operator 根据定义自动生成 Prometheus 刮擦配置。
PrometheusRule: 用于管理 Prometheus 告警规则；它定义了一套所需的 Prometheus 警报和/或记录规则。Prometheus 生成一个规则文件，可以被 Prometheus 实例使用。
AlertmanagerConfig: 用于管理 AlertManager 配置文件，主要是告警发给谁；它声明性地指定 Alertmanager 配置的子部分，允许将警报路由到自定义接收器，并设置禁止规则。

Prometheus Operator 自动检测 Kubernetes API 服务器对上述任何对象的更改，并确保匹配的部署和配置保持同步。

简化的部署配置

配置 Prometheus 的基础知识，如版本、持久性、保留策略和来自本机 Kubernetes 资源的副本。最简的持久化的 Prometheus 的部署，只需要创建如下 yaml 即可：

apiVersion: monitoring.coreos.com/v1
kind: Prometheus
metadata:
  name: persisted
spec:
  storage:
    volumeClaimTemplate:
      spec:
        storageClassName: ssd
        resources:
          requests:
            storage: 40Gi

Prometheus 目标配置

根据熟悉的 Kubernetes 标签查询自动生成监控目标配置；无需学习普罗米修斯特定的配置语言。

大厂案例

哪些大厂在用 Prometheus Operator 或 kube-prometheus?

RedHat

从 Prometheus Operator 的 API 也能看出来，这个 Operator 最早是由 CoreOS 开发并开源的，而现在 CoreOS 已经被 RedHat 收购，所以 RedHat 的 OpenShift 4 完全是采用 Prometheus Operator 作为它的 Metrics 解决方案的。典型的架构如下图：

可以看到 Prometheus 和 AlertManager 都是通过 Prometheus Operator 来进行管理的。

Rancher

Rancher 2 以后的 rancher-monitoring 也是基于 kube-prometheus 做了进一步的改进而来的，这是通过 rancher-monitoring helm chart 部署后的关系图，可以看到部署的组件还是非常多的：

Grafana
Prometheus CRD
Prometheus Operator
Prometheus
AlertManager
kube-state-metrics
prometheus adapter
node exporter
...

我为什么推荐你用 Prometheus Operator 或 kube-prometheus 而非原生 prometheus?

理由如下：

众多大厂的选择；
极大简化了 Prometheus 的配置复杂度；
开箱即用的大量：
1. 监控对象，如：K8S 组件 - coredns, kubelet, controller manager, apiserver, etcd, scheduler, kube proxy; 监控组件自监控 - grafana, AlertManager, prometheus 等；
2. 仪表板，自带 24 个仪表板，非常实用，涵盖：集群/组件/网络/存储/Node/Pod 等等维度；
3. 告警规则，自带了 100 多个告警规则，涵盖 K8S 的方方面面；
流行的开源产品，很多也默认会带有对 Prometheus Operator 的支持，如 Loki 就有相关的 ServiceMonitor;
通过 ServiceMonitor 等，其实反而相比添加 Prometheus Annotation 有更大的灵活性；如下面的例子
高可用的支持，如：
1. 多个 Prometheus 的 shards
2. 多个 AlertManager
3. ThanosRuler
RBAC: 如默认可以创建 3 个 monitoring 的角色：admin/edit/viewer, 可以分别对应监控的管理员，维护人员和只读用户；

示例，灵活性：

spec:
  endpoints:
    - honorLabels: true
      params:
        _scheme:
          - https
      port: metrics
      proxyUrl: http://pushprox-k3s-server-proxy.cattle-monitoring-system.svc:8080
      relabelings:
        - sourceLabels:
            - __metrics_path__
          targetLabel: metrics_path
  jobLabel: component
  namespaceSelector:
    matchNames:
      - cattle-monitoring-system
  podTargetLabels:
    - component
    - pushprox-exporter
  selector:
    matchLabels:
      component: k3s-server
      k8s-app: pushprox-k3s-server-client
      provider: kubernetes
      release: rancher-monitoring

?️ 参考文档

以上

EOF

三人行, 必有我师; 知识共享, 天下为公. 本文由东风微鸣技术博客 EWhisper.cn 编写.

有关Prometheus Operator 与 kube-prometheus 之一-简介的更多相关文章

HBase Region 简介和建议数量&大小 - 2
Region是HBase数据管理的基本单位,region有一点像关系型数据的分区。region中存储这用户的真实数据，而为了管理这些数据，HBase使用了RegionSever来管理region。Region的结构hbaseregion的大小设置默认情况下，每个Table起初只有一个Region，随着数据的不断写入，Region会自动进行拆分。刚拆分时，两个子Region都位于当前的RegionServer，但处于负载均衡的考虑，HMaster有可能会将某个Region转移给其他的RegionServer。RegionSplit时机：当1个region中的某个Store下所有StoreFile
ruby - 如何检查一个字符串是否是几个不同值之一？ - 2
我有一个字符串变量，它只能包含6个不同的值。我想检查它是否包含前4个值之一或2个第二值之一。有没有比这更优雅的方式:ifstring.eql?'val1'||string.eql?'val2'||string.eql?'val3'||string.eql?'val4'...elsifstring.eql?'val5'||string.eql?'val6'...end可能类似于ifstringisin['val1','val2','val3','val4']? 最佳答案您可以使用include?:if['val1','val2','
IDEA 2023.1 正式发布，新特性简介 - 2
昨晚看到IDEA官推宣布IntelliJIDEA2023.1正式发布了。简单看了一下，发现这次的新版本包含了许多改进，进一步优化了用户体验，提高了便捷性。至于是否升级最新版本完全是个人意愿，如果觉得新版本没有让自己感兴趣的改进，完全就不用升级，影响不大。软件的版本迭代非常正常，正确看待即可，不持续改进就会慢慢被淘汰！根据官方介绍：IntelliJIDEA2023.1针对新的用户界面进行了大量重构，这些改进都是基于收到的宝贵反馈而实现的。官方还实施了性能增强措施，使得Maven导入更快，并且在打开项目时IDE功能更早地可用。由于后台提交检查，新版本提供了简化的提交流程。IntelliJIDEA
ruby - rspec - 选择之一的匹配器 - 2
我有从预定义数组返回随机值的方法(即:['value1','value2'])。我应该如何使用rspec进行测试？我想做这样的事情:expect(FooClass.new.value).tobe_in['value1','value2']有什么办法吗？谢谢。最佳答案使用这个expect(['value1','value2']).toinclude(FooClass.new.value)或者一个简单的bool匹配expect(['value1','value2'].include?FooClass.new.value).tobet
pytest简介 - 2
介绍pytest是一个非常成熟的全功能的Python测试框架，主要有以下几个特点：简单灵活，容易上手支持参数化能够支持简单的单元测试和复杂的功能测试，还可以用来做selenium/appnium等自动化测试、接口自动化测试（pytest+requests）pytest具有很多第三方插件，并且可以自定义扩展，比较好用的如pytest-selenium（集成selenium）、pytest-html（完美html测试报告生成）、pytest-rerunfailures（失败case重复执行）、pytest-xdist（多CPU分发）等测试用例的skip和xfail处理可以很好的和jenkins集成
SpringCloud入门实战（七）-Hystrix入门简介 - 2
📝学技术、更要掌握学习的方法，一起学习，让进步发生👩🏻作者：一只IT攻城狮。💐学习建议：1、养成习惯，学习java的任何一个技术，都可以先去官网先看看，更准确、更专业。💐学习建议：2、然后记住每个技术最关键的特性（通常一句话或者几个字），从主线入手，由浅入深学习。❤️《SpringCloud入门实战系列》解锁SpringCloud主流组件入门应用及关键特性。带你了解SpringCloud主流组件,是如何一战解决微服务诸多难题的。项目demo：源码地址👉🏻SpringCloud入门实战系列不迷路👈🏻：SpringCloud入门实战（一）什么是SpringCloud？SpringCloud入门实战
ruby-on-rails - 将 float 舍入到 Ruby 中最近的四分之一 - 2
我在RubyonRails应用程序中使用外部API。我需要向这家公司发送花车，但他们只接受1.0、1.25、1.5、1.75等值,2.0等我的值可能类似于1.34或1.80。理想情况下，我需要将它们四舍五入到最接近的0.25。完成此任务的最佳方法是什么？如果我执行1.34.round(0)，它会给我1.0，这比我需要的要低。谢谢! 最佳答案 (1.27*4).round/4.0#=>1.25如果你打算经常使用它，猴子修补Float类是非常有意义的，以简化使用:classFloatdefround_to_quarter(self*4)
cvc-complex-type.2.4.a: 发现了以元素 ‘base-extension‘ 开头的无效内容。应以 ‘{layoutlib}‘ 之一开头 - 2
常见的1种case记录一下，新电脑安装androidstudio导入公司那些gradle还是5.5左右的工程以后，各种不适应。编译问题出现了。老电脑都是好好的。cvc-complex-type.2.4.a:发现了以元素‘base-extension‘开头的无效内容。应以‘{layoutlib}‘之一开头这样的错误。解决方案：小齿轮->projectstructure->SDKLocation->(JDKlocationwasmovedtoGradleSettings)点击GradleSettings。或者AndroidStudio->Preferences->搜索Gradle->GradleJ
ruby - 四舍五入到最接近的十分之一？ - 2
我需要四舍五入到最接近的十分之一。我需要的是ceil但精确到第一位小数。例子:10.38wouldbe10.410.31wouldbe10.410.4wouldbe10.4因此，如果超过整整十分之一，则应四舍五入。我正在运行Ruby1.8.7。最佳答案这通常有效:ceil(number*10)/10所以在Ruby中应该是这样的:(number*10).ceil/10.0 关于ruby-四舍五入到最接近的十分之一？，我们在StackOverflow上找到一个类似的问题：
最新2023年Kali Purple，紫色的带防御kali，简介和安装（超详细） - 2
文章目录一，什么是kaliPurle（卡利紫）二，如何安装kaliPurple。（有步骤没图片直接是默认）1，复制它的下载链接到迅雷可以让你下镜像变得更快。2，打开你的虚拟机创建新的虚拟机3，点击后面浏览然后找到镜像的所在地选中确定，下一步4，这里默认就可以，因为Ubuntu和这个差不多架构。5，然后，名字自己改一下，然后把他安到你想要装的盘，容量默认。之后一直下一步就可以**6，打开它，然后第一个图形界面安装，直接回车，然后选中文点continue之后没有图片的直接点继续。7，密码想设什么设什么。然后一直继续到我的图片那里改一下就可以了。8，软件默认就行。9，耐心等待。然后点手动配置dvc然

Prometheus Operator 与 kube-prometheus 之一-简介

简介