iT邦幫忙

prometheus相關文章
共有 72 則文章
鐵人賽 Kubernetes DAY 21

技術 Day 20:部署 Grafana,接上 Metrics/Traces/Logs 三個 Datasource

今天的工作 部署 Grafana 把 Prometheus/Tempo/Loki 接進 Grafana 成為 Datasource 今天我們把 Promet...

鐵人賽 Kubernetes DAY 18

技術 Day 17:閘道監控,讓 APISIX 自己開口說話

今天的工作 用 APISIX 原生的 prometheus 插件,在閘道層收集監控數據 驗證這些數據真的送到 Prometheus Day15/16 拿到的...

My Project 如果能在 SQL 编辑器里直接查 Prometheus,你会用吗?

我是开源 SQL IDE LibreDB Studio 的维护者之一。它是 MIT 协议,在浏览器里使用,部署在数据旁边的 Docker 或 Kubernete...

鐵人賽 Kubernetes DAY 25

技術 Day 25:讓一隻 tool-calling agent 讀 Alertmanager,把告警翻成人話

前面二十四天蓋了一套可觀測性系統。今天開始最後一個區塊,做一隻 agent。 先講為什麼——不是因為 AI 很紅。 理由來自我自己:昨天那則 DiscountR...

鐵人賽 Kubernetes DAY 24

技術 Day 24:告警疲勞:分級、去重,以及一次真實誤報的檢討

告警區塊最後一天。前三天講原則、寫設定、算門檻,今天講這些東西上線之後會發生什麼事。 先講結論:它們不會照你想的跑。 我昨天那則記憶體預測告警,今天實際跑一次,...

鐵人賽 Kubernetes DAY 23

技術 Day 23:從 SLO 反推告警:burn rate 告警怎麼設

昨天寫了第一則告警,門檻是「300 毫秒內完成的比例 < 95%,撐 10 分鐘」。今天要拆掉這個設計,因為它有問題,而且問題不小。 今天的故障開關:全部...

鐵人賽 Kubernetes DAY 22

技術 Day 22:Alertmanager 實作:路由、分組、抑制與靜音

昨天講原則,今天寫設定。 今天的故障開關:全部關閉 kubectl set env deploy/pricing BUG_SILENT_DISCOUNT=fal...

鐵人賽 Kubernetes DAY 21

技術 Day 21:好告警的三個條件:可行動、有主人、有上下文

昨天把三大支柱串起來,Day 7 的四句天花板只剩最後一句:只能被動查,不會主動通知。今天開始處理它。 這個區塊我要花四天,比 metrics 和 logs 都...

鐵人賽 Kubernetes DAY 20

技術 Day 20:三大支柱串起來:exemplar 與 trace_id 關聯,反查第二個故障

Day 3 我給自己立了一個判準:從一張圖上的異常點出發,要幾次點擊才能看到造成它的那筆 log?如果答案是「開三個瀏覽器分頁」,那我有的是三個孤島,不是三大支...

鐵人賽 Kubernetes DAY 15

技術 Day 15:用 Loki 收 log,並在 Grafana 裡與指標並排

昨天講完為什麼 log 要寫成結構化的,今天把它們收起來。 要裝兩個東西:Loki(存 log 的資料庫)和 Grafana Alloy(去讀 log 再送進...

鐵人賽 Kubernetes DAY 13

技術 Day 13:自己埋指標與它的代價:counter/histogram、cardinality 與 label 設計

昨天把 pricing 擴成兩份,發現流量全壓在同一個 Pod 上,結論是「聚合會藏東西」。而聚合藏不藏得住,取決於當初把什麼寫進標籤裡。 這是 Metrics...

鐵人賽 Kubernetes DAY 11

技術 Day 11:USE 還是 RED:兩套方法論怎麼選

昨天講了四個黃金訊號,今天要講另外兩套:USE 和 RED。 剛開始看到這三套的時候覺得也太複雜了吧,為什麼差不多東西要出三套,到底要用哪一個?查了之後發現這個...

鐵人賽 Kubernetes DAY 10

技術 Day 10:PromQL 起步:rate、histogram_quantile 與四個黃金訊號

昨天做圖的時候直接貼了兩行查詢沒解釋,今天補上。 PromQL 是 Prometheus 的查詢語言。它跟 SQL 完全不像,因為它處理的東西不一樣:SQL 查...

鐵人賽 Kubernetes DAY 9

技術 Day 9:Grafana 接上來:做一張能回答問題的圖,而不是好看的圖

昨天 Prometheus 開始存資料了,但是它自己的畫面很陽春。今天接上 Grafana,一個把資料畫成圖表的網頁介面,它自己不存任何資料,只負責去問別人要。...

鐵人賽 Kubernetes DAY 8

技術 Day 8:Prometheus Operator 安裝與 ServiceMonitor:第一次抓到指標

昨天的結論是四句話,今天要把第一句劃掉:只有現在,沒有歷史。 也就是裝 Prometheus。但是這篇的重點不是安裝指令,那其實只有兩行,重點是另外兩件事:Op...

鐵人賽 Kubernetes DAY 4

技術 Day 4:這 30 天要裝的工具

昨天講完三本柱,今天我們來列清單,看這 30 天到底要在叢集裡裝哪些東西。 我自己查資料的時候,覺得很多教學太快跳到指令的部分,直接教怎麼安裝和執行,但沒有說明...

技術 k8s prometheus annotations scrape config

prometheus 在 k8s 環境中 利用 kubernetes_sd_config可以自動發現 meta labels 可以用於動態設定 scrape t...

技術 introduction VictoriaMetrics Agent

VictoriaMetrics Agent 由 VictoriaMetrics 製作的 metric collector 由於 VictoriaMetrics...

鐵人賽 DevOps DAY 30

技術 【Day30】Prometheus + Grafana:讓 Kubernetes 無所遁形的監控利器

前情提要 昨天我們看了 Jenkins 的 CI/CD Pipeline,理解了 Jenkins 的強大之處。配合前面學習的 Kubernetes、Kustom...

鐵人賽 DevOps DAY 19

技術 Day19 - LLM 可觀測性實戰:監控延遲、Token 與成本(含工具選型)

🔹 前言 昨天我們完成了 API Gateway,讓前端可以透過一個統一的 Proxy 來存取 LLM。 但在真實運行環境裡,還有一個非常現實的問題: 👉 我的...

鐵人賽 DevOps DAY 15

技術 Day 15:Kong + API monitor in Promethus and Grafana - 3

Prometheus 圖 15-1 Prometheus 筆者之前建置整個架構的經驗中,Prometheus基本上就是預設建立,很少去找過相關的資料,可能也因為...

鐵人賽 DevOps DAY 14

技術 Day 14:Kong + API monitor in Promethus and Grafana - 2

Kong 與 API 在Metrics 的實踐 圖 14-1 雖說同事嫌筆者上面的架構圖太太太複雜了,但筆者還是想要放一下,因為看起來好像有一點點厲害的樣子(謎...

鐵人賽 DevOps DAY 13

技術 Day 13:Kong + API monitor in Promethus and Grafana - 1

Kong v.s API v.s Metrics 昨天將可觀測性的第二隻本柱:trace 完成之後,今天開始準備來實踐最後一根柱子:metrics。筆者在多年前...

鐵人賽 Cloud Native DAY 11

技術 Ch6 - 如何監測 SSO 服務使用狀況?淺談旁車與 APISIX Prometheus Plugin

Keycloak在26.2版本提供了更多的可觀測性能力[^1][^2]。不過當前SSO服務使用的版本還未有此能力,儘管有提供有限的Metrics資訊,不過以那些...

鐵人賽 Cloud Native DAY 19

技術 [Day 19] 叢集的千里眼:Prometheus & Grafana 讓一切被看見

前言 到目前為止,我們已經把 EKS 叢集的基礎設施打通:從 Pod → Service → Ingress → Load Balancer → DNS,都能自...

鐵人賽 Cloud Native DAY 21

技術 【Day 21】 認識叢集的四大監控與觀測工具

前言 有一句話是這麼說的,「懂的就懂」,大概就是拿來形容今天要介紹的東西。 你如果不是負責監管資源的人,可能只聽過這些工具,但不太深入其中的奧義。 你如果是監管...

鐵人賽 DevOps DAY 20

技術 Day 20|Observability 全面監控:Prometheus × Grafana × ELK

●前言 Day 20,代表第一階段的壓軸登場。 前面我們用 Terraform × Helm × CI/CD,已經能自動化建 Infra、部署應用。 但 Dev...

鐵人賽 DevOps DAY 22

技術 Day22 - 使用 Grafana 進行可視化監控

今天,我們將深入探討如何使用 Grafana 對 Prometheus 中收集到的數據進行可視化。雖然 Prometheus 本身已經提供了查詢和簡單的圖表功能...

鐵人賽 DevOps DAY 21

技術 Day21 - 使用 Prometheus 進行基礎監控

在今天的文章中,我們將學習如何在 Kubernetes 叢集中使用 Prometheus 進行基礎的監控。Prometheus 是一個強大的開源監控工具,能夠自...

鐵人賽 DevOps DAY 11
Grafana Zero to Hero 系列 第 11 篇

技術 Grafana Zero to Hero - Data Source:Prometheus

Prometheus 是目前主流的指標收集工具,指標可以透過專用的 PromQL 語法查詢,並且提供 Web UI 與告警機制。Prometheus 起源於 2...