使用docker部署grafana+prometheus配置-6ren

使用docker部署grafana+prometheus配置

转载作者：qq735679552 更新时间：2022-09-28 22:32:09

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章使用docker部署grafana+prometheus配置由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

docker-compose-monitor.yml 。

 
    ? 
   
         version: '2' 
        
         networks: 
        
         monitor: 
        
         driver: bridge 
        
         services: 
        
         influxdb: 
        
         image: influxdb:latest 
        
         container_name: tig-influxdb 
        
         ports: 
        
         - "18083:8083" 
        
         - "18086:8086" 
        
         - "18090:8090" 
        
         env_file: 
        
         - 'env.influxdb' 
        
         volumes: 
        
         # Data persistency 
        
         # sudo mkdir -p ./influxdb/data 
        
         - ./influxdb/data:/var/lib/influxdb 
        
         # 配置docker里的时间为东八区时间 
        
         - ./timezone:/etc/timezone:ro 
        
         - ./localtime:/etc/localtime:ro 
        
         restart: unless-stopped #停止后自动 
        
         telegraf: 
        
         image: telegraf:latest 
        
         container_name: tig-telegraf 
        
         links: 
        
         - influxdb 
        
         volumes: 
        
         - ./telegraf.conf:/etc/telegraf/telegraf.conf:ro 
        
         - ./timezone:/etc/timezone:ro 
        
         - ./localtime:/etc/localtime:ro 
        
         restart: unless-stopped 
        
         prometheus: 
        
         image: prom/prometheus 
        
         container_name: prometheus 
        
         hostname: prometheus 
        
         restart: always 
        
         volumes: 
        
         - /home/qa/docker/grafana/prometheus.yml:/etc/prometheus/prometheus.yml 
        
         - /home/qa/docker/grafana/node_down.yml:/etc/prometheus/node_down.yml 
        
         ports: 
        
         - '9090:9090' 
        
         networks: 
        
         - monitor 
        
         alertmanager: 
        
         image: prom/alertmanager 
        
         container_name: alertmanager 
        
         hostname: alertmanager 
        
         restart: always 
        
         volumes: 
        
         - /home/qa/docker/grafana/alertmanager.yml:/etc/alertmanager/alertmanager.yml 
        
         ports: 
        
         - '9093:9093' 
        
         networks: 
        
         - monitor 
        
         grafana: 
        
         image: grafana/grafana:6.7.4 
        
         container_name: grafana 
        
         hostname: grafana 
        
         restart: always 
        
         ports: 
        
         - '13000:3000' 
        
         networks: 
        
         - monitor 
        
         node-exporter: 
        
         image: quay.io/prometheus/node-exporter 
        
         container_name: node-exporter 
        
         hostname: node-exporter 
        
         restart: always 
        
         ports: 
        
         - '9100:9100' 
        
         networks: 
        
         - monitor 
        
         cadvisor: 
        
         image: google/cadvisor:latest 
        
         container_name: cadvisor 
        
         hostname: cadvisor 
        
         restart: always 
        
         volumes: 
        
         - /:/rootfs:ro 
        
         - /var/run:/var/run:rw 
        
         - /sys:/sys:ro 
        
         - /var/lib/docker/:/var/lib/docker:ro 
        
         ports: 
        
         - '18080:8080' 
        
         networks: 
        
         - monitor

alertmanager.yml 。

 
    ? 
   
         global: 
        
         resolve_timeout: 5m 
        
         smtp_from: '邮箱' 
        
         smtp_smarthost: 'smtp.exmail.qq.com:25' 
        
         smtp_auth_username: '邮箱' 
        
         smtp_auth_password: '密码' 
        
         smtp_require_tls: false 
        
         smtp_hello: 'qq.com' 
        
         route: 
        
         group_by: ['alertname'] 
        
         group_wait: 5s 
        
         group_interval: 5s 
        
         repeat_interval: 5m 
        
         receiver: 'email' 
        
         receivers: 
        
         - name: 'email' 
        
         email_configs: 
        
         - to: '收件邮箱' 
        
         send_resolved: true 
        
         inhibit_rules: 
        
         - source_match: 
        
         severity: 'critical' 
        
         target_match: 
        
         severity: 'warning' 
        
         equal: ['alertname', 'dev', 'instance']

prometheus.yml 。

 
    ? 
   
         global: 
        
         scrape_interval:     15s # Set the scrape interval to every 15 seconds. Default is every 1 minute. 
        
         evaluation_interval: 15s # Evaluate rules every 15 seconds. The default is every 1 minute. 
        
         # scrape_timeout is set to the global default (10s). 
        
         # Alertmanager configuration 
        
         alerting: 
        
         alertmanagers: 
        
         - static_configs: 
        
         - targets: ['192.168.32.117:9093'] 
        
         # - alertmanager:9093 
        
         # Load rules once and periodically evaluate them according to the global 'evaluation_interval'. 
        
         rule_files: 
        
         - "node_down.yml" 
        
         # - "node-exporter-alert-rules.yml" 
        
         # - "first_rules.yml" 
        
         # - "second_rules.yml" 
        
         # A scrape configuration containing exactly one endpoint to scrape: 
        
         # Here it's Prometheus itself. 
        
         scrape_configs: 
        
         # IO存储节点组 
        
         - job_name: 'io' 
        
         scrape_interval: 8s 
        
         static_configs:　　　　　#端口为node-exporter启动的端口　 
        
         - targets: ['192.168.32.117:9100'] 
        
         - targets: ['192.168.32.196:9100'] 
        
         - targets: ['192.168.32.136:9100'] 
        
         - targets: ['192.168.32.193:9100'] 
        
         - targets: ['192.168.32.153:9100'] 
        
         - targets: ['192.168.32.185:9100'] 
        
         - targets: ['192.168.32.190:19100'] 
        
         - targets: ['192.168.32.192:9100'] 
        
         # The job name is added as a label `job=<job_name>` to any timeseries scraped from this config. 
        
         - job_name: 'cadvisor' 
        
         static_configs:　　　　　#端口为cadvisor启动的端口 
        
         - targets: ['192.168.32.117:18080'] 
        
         - targets: ['192.168.32.193:8080'] 
        
         - targets: ['192.168.32.153:8080'] 
        
         - targets: ['192.168.32.185:8080'] 
        
         - targets: ['192.168.32.190:18080'] 
        
         - targets: ['192.168.32.192:18080']

node_down.yml 。

 
    ? 
   
         groups: 
        
         - name: node_down 
        
         rules: 
        
         - alert: InstanceDown 
        
         expr: up == 0 
        
         for: 1m 
        
         labels: 
        
         user: test 
        
         annotations: 
        
         summary: 'Instance {{ $labels.instance }} down' 
        
         description: '{{ $labels.instance }} of job {{ $labels.job }} has been down for more than 1 minutes.' 
        
         #剩余内存小于10% 
        
         - alert: 剩余内存小于10% 
        
         expr: node_memory_MemAvailable_bytes / node_memory_MemTotal_bytes * 100 < 10 
        
         for: 2m 
        
         labels: 
        
         severity: warning 
        
         annotations: 
        
         summary: Host out of memory (instance {{ $labels.instance }}) 
        
         description: "Node memory is filling up (< 10% left)\n  VALUE = {{ $value }}\n  LABELS = {{ $labels }}" 
        
         #剩余磁盘小于10% 
        
         - alert: 剩余磁盘小于10% 
        
         expr: (node_filesystem_avail_bytes * 100) / node_filesystem_size_bytes < 10 and ON (instance, device, mountpoint) node_filesystem_readonly == 0 
        
         for: 2m 
        
         labels: 
        
         severity: warning 
        
         annotations: 
        
         summary: Host out of disk space (instance {{ $labels.instance }}) 
        
         description: "Disk is almost full (< 10% left)\n  VALUE = {{ $value }}\n  LABELS = {{ $labels }}" 
        
         #cpu负载 > 80% 
        
         - alert: CPU负载 > 80% 
        
         expr: 100 - (avg by(instance) (rate(node_cpu_seconds_total{mode="idle"}[2m])) * 100) > 80 
        
         for: 0m 
        
         labels: 
        
         severity: warning 
        
         annotations: 
        
         summary: Host high CPU load (instance {{ $labels.instance }}) 
        
         description: "CPU load is > 80%\n  VALUE = {{ $value }}\n  LABELS = {{ $labels }}"

告警：https://awesome-prometheus-alerts.grep.to/rules#prometheus-self-monitoring 。

官网仪表盘：https://grafana.com/grafana/dashboards/ 。

到此这篇关于docker部署grafana+prometheus配置的文章就介绍到这了,更多相关docker部署grafana+prometheus内容请搜索我以前的文章或继续浏览下面的相关文章希望大家以后多多支持我！。

原文链接：https://www.cnblogs.com/runzhao/p/15716274.html 。

最后此篇关于使用docker部署grafana+prometheus配置的文章就讲到这里了,如果你想了解更多关于使用docker部署grafana+prometheus配置的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

文章推荐：用Docker搭建nextcloud个人网盘教程

文章推荐： Docker部署Mysql,.Net6,Sqlserver等容器

文章推荐： C语言实现简单的三子棋小游戏

文章推荐： CentOS 7安装Docker

java - 配置 logback 以遵循 Java 配置，也就是 Logback 的纯 Java 配置
我只是不喜欢 Logback 的 XML 或 Groovy 配置，而更喜欢用 Java 进行配置(这也是因为我将在初始化后的不同时间在运行时更改配置)。似乎对 Logback 进行 Java 配置的
yaml - sphinx 配置 ||配置/sphinx.yml
我的 sphinx 配置是: ================================ config/sphinx.yml development: bin_path: "/usr/loc
Sitecore 性能优化 - Sitecore 配置、IIS 配置
我们计划在生产服务器中部署我们的系统。我有兴趣了解更多有关优化网站性能的信息。 Sitecore 有哪些优化建议？ (缓存，网络配置中的其他设置) 我们可以在 IIS 中做哪些优化？找不到关于这些主
python - 根目录上静态站点的 Apache 配置，子位置上的 Django 配置
我有一个 Django 应用程序，可以处理网站的两个(或更多)部分，例如网站的“admin”和“api”部分。我还为网站的其余部分提供了普通的 html 页面，其中不需要 Django。例如，我希望
node.js - 配置 Dockerfile 以设置 AWS 配置
我刚刚开始研究Docker。我有一个 Node 应用程序，可以调整大小和图像，然后在完成后向 aws 发送 SQS 消息。我已成功创建应用程序的 docker 镜像，并从本地计算机复制它，但遇到了无法
ant - 如何在 Hudson 中为 Ant 配置 checkstyle 配置？
如何配置 checkstyle(在 Ant nt Maven 中)任务？我尝试了一点，但没有正确收到报告。这是我的 Ant 脚本。
java - 如何将 xml 配置 bean 转换为 Java 配置 bean？
我正在使用 Quartz 和 Spring 框架重写一个遗留项目。原始配置是 XML 格式，现在我将其转换为 Java Config。 xml 配置使用 jobDetail 设置触发器 bean 的作
mysql - 最佳 Mysql 配置(分区)和索引/Hypertable/RAID 配置(大数据库)
tl;rd: 使用主键对数据库进行分区索引大小问题。数据库大小每天增长约 1-3 GB 突袭设置。您有使用 Hypertable 的经验吗？长版: 我刚刚建立/购买了一个家庭服务器: 至强 E
使用图形 API 配置 GCP 的 Azure AD saml 配置 "Sign on URL"
在安装 gcp 应用程序后，我们尝试使用 GCP 的图形 api 配置 Azure Active Directory saml 配置。我们正在遵循相同的 AWS graph api saml 设置 U
java - 如何使用 Spring-Security 3 和 Hibernate 4 将 spring security xml 配置 hibernate 转换为 java 配置
我刚刚了解了 spring security 并想使用 java hibernate 配置连接到数据库，但我发现的示例或教程很少。我通过使用 xml 配置找到了更多。我在这里使用 Spring 4.0
java - 是否可以通过 jboss-deployment-struction.xml 配置 JPA 2.1，为 Spring 4 和 Hibernate 4.3.10 配置 JBoss EAP 6.4.x？
我们最近切换到 Java 8 以使用 java.time API(LocalDate、LocalDateTime，...)。因此，我们将 Hibernate 依赖项更新到版本 4.3.10。我们编写了
quarkus实战之六：配置
欢迎访问我的GitHub 这里分类和汇总了欣宸的全部原创(含配套源码)：https://github.com/zq2599/blog_demos 本篇概览本文是《quarkus实战》系列的第六篇，咱
NGINX 配置 :
我是 NGINX 的新手，我正在尝试对我们的 ERP 网络服务器进行负载平衡。我有 3 个网络服务器在由 websphere 提供支持的端口 80 上运行，这对我来说是一个黑盒子: * web01.e
Gerrit 配置
我们想使用 gerrit 进行代码审查，但我们在 webview 中缺少一些设置。是否可以禁止提交者审查/验证他们自己的提交？是否有可能两个审稿人给 +1 一个累积它到+2，以便可以提交？谢
AEM 配置
配置根据运行模式应用于 AEM 实例。在多个运行模式和多个配置的情况下，AEM 如何确定要选择的配置文件？假设以下配置在 AEM 项目中可用， /apps /myproject - con
Neo4j 配置
我正在使用 Neo4j 服务器。我遇到了负载相对较低的问题。但是，响应时间相当长。我认为为请求提供服务的线程数太少了。有没有办法调整为 HTTP 请求提供服务的线程池的大小。那可能吗？最佳答案线程
CELERYD_OPTS 配置
我在/etc/default/celeryd 中有以下配置 CELERYD_NODES = "worker1 worker2 worker3" CELERYD_CHDIR = "path to pro
Plone 配置
Plone 在其页面中显示来 self 的母语(巴西葡萄牙语)的特殊字符。但是，当我使用我创建的 spt 页面时，它会显示转义序列，例如: Educa\xc3\xa7\xc3\xa3o 代替 Educ
Emacs 配置
我正在尝试开始使用 Emacs/Clojure。安装 emacs 扩展的正确方法是什么。我正在尝试安装以下插件: https://bitbucket.org/kotarak/vimclojure 我已
CMake 配置
我有一个简单的 C 项目结构: proj/ src/ docs/ build/ tests/ lib/ 尝试编写合适的 CMake 文件。到目前为止我的尝试:http://pas

qq735679552

个人简介

我是一名优秀的程序员,十分优秀！

作者热门文章

滴滴打车优惠券免费领取

全站热门文章

首页

博学

6Ren·AI

商城

使用docker部署grafana+prometheus配置