今天的工作 部署 Grafana 把 Prometheus/Tempo/Loki 接進 Grafana 成為 Datasource 今天我們把 Promet...
今天的工作 用 APISIX 原生的 prometheus 插件,在閘道層收集監控數據 驗證這些數據真的送到 Prometheus Day15/16 拿到的...
我是开源 SQL IDE LibreDB Studio 的维护者之一。它是 MIT 协议,在浏览器里使用,部署在数据旁边的 Docker 或 Kubernete...
前面二十四天蓋了一套可觀測性系統。今天開始最後一個區塊,做一隻 agent。 先講為什麼——不是因為 AI 很紅。 理由來自我自己:昨天那則 DiscountR...
告警區塊最後一天。前三天講原則、寫設定、算門檻,今天講這些東西上線之後會發生什麼事。 先講結論:它們不會照你想的跑。 我昨天那則記憶體預測告警,今天實際跑一次,...
昨天寫了第一則告警,門檻是「300 毫秒內完成的比例 < 95%,撐 10 分鐘」。今天要拆掉這個設計,因為它有問題,而且問題不小。 今天的故障開關:全部...
昨天講原則,今天寫設定。 今天的故障開關:全部關閉 kubectl set env deploy/pricing BUG_SILENT_DISCOUNT=fal...
昨天把三大支柱串起來,Day 7 的四句天花板只剩最後一句:只能被動查,不會主動通知。今天開始處理它。 這個區塊我要花四天,比 metrics 和 logs 都...
Day 3 我給自己立了一個判準:從一張圖上的異常點出發,要幾次點擊才能看到造成它的那筆 log?如果答案是「開三個瀏覽器分頁」,那我有的是三個孤島,不是三大支...
昨天講完為什麼 log 要寫成結構化的,今天把它們收起來。 要裝兩個東西:Loki(存 log 的資料庫)和 Grafana Alloy(去讀 log 再送進...
昨天把 pricing 擴成兩份,發現流量全壓在同一個 Pod 上,結論是「聚合會藏東西」。而聚合藏不藏得住,取決於當初把什麼寫進標籤裡。 這是 Metrics...
昨天講了四個黃金訊號,今天要講另外兩套:USE 和 RED。 剛開始看到這三套的時候覺得也太複雜了吧,為什麼差不多東西要出三套,到底要用哪一個?查了之後發現這個...
昨天做圖的時候直接貼了兩行查詢沒解釋,今天補上。 PromQL 是 Prometheus 的查詢語言。它跟 SQL 完全不像,因為它處理的東西不一樣:SQL 查...
昨天 Prometheus 開始存資料了,但是它自己的畫面很陽春。今天接上 Grafana,一個把資料畫成圖表的網頁介面,它自己不存任何資料,只負責去問別人要。...
昨天的結論是四句話,今天要把第一句劃掉:只有現在,沒有歷史。 也就是裝 Prometheus。但是這篇的重點不是安裝指令,那其實只有兩行,重點是另外兩件事:Op...
昨天講完三本柱,今天我們來列清單,看這 30 天到底要在叢集裡裝哪些東西。 我自己查資料的時候,覺得很多教學太快跳到指令的部分,直接教怎麼安裝和執行,但沒有說明...
prometheus 在 k8s 環境中 利用 kubernetes_sd_config可以自動發現 meta labels 可以用於動態設定 scrape t...
VictoriaMetrics Agent 由 VictoriaMetrics 製作的 metric collector 由於 VictoriaMetrics...
前情提要 昨天我們看了 Jenkins 的 CI/CD Pipeline,理解了 Jenkins 的強大之處。配合前面學習的 Kubernetes、Kustom...
🔹 前言 昨天我們完成了 API Gateway,讓前端可以透過一個統一的 Proxy 來存取 LLM。 但在真實運行環境裡,還有一個非常現實的問題: 👉 我的...
Prometheus 圖 15-1 Prometheus 筆者之前建置整個架構的經驗中,Prometheus基本上就是預設建立,很少去找過相關的資料,可能也因為...
Kong 與 API 在Metrics 的實踐 圖 14-1 雖說同事嫌筆者上面的架構圖太太太複雜了,但筆者還是想要放一下,因為看起來好像有一點點厲害的樣子(謎...
Kong v.s API v.s Metrics 昨天將可觀測性的第二隻本柱:trace 完成之後,今天開始準備來實踐最後一根柱子:metrics。筆者在多年前...
Keycloak在26.2版本提供了更多的可觀測性能力[^1][^2]。不過當前SSO服務使用的版本還未有此能力,儘管有提供有限的Metrics資訊,不過以那些...
前言 到目前為止,我們已經把 EKS 叢集的基礎設施打通:從 Pod → Service → Ingress → Load Balancer → DNS,都能自...
前言 有一句話是這麼說的,「懂的就懂」,大概就是拿來形容今天要介紹的東西。 你如果不是負責監管資源的人,可能只聽過這些工具,但不太深入其中的奧義。 你如果是監管...
●前言 Day 20,代表第一階段的壓軸登場。 前面我們用 Terraform × Helm × CI/CD,已經能自動化建 Infra、部署應用。 但 Dev...
今天,我們將深入探討如何使用 Grafana 對 Prometheus 中收集到的數據進行可視化。雖然 Prometheus 本身已經提供了查詢和簡單的圖表功能...
在今天的文章中,我們將學習如何在 Kubernetes 叢集中使用 Prometheus 進行基礎的監控。Prometheus 是一個強大的開源監控工具,能夠自...
Prometheus 是目前主流的指標收集工具,指標可以透過專用的 PromQL 語法查詢,並且提供 Web UI 與告警機制。Prometheus 起源於 2...