iT邦幫忙

observability相關文章
共有 194 則文章
鐵人賽 DevOps DAY 14

技術 【Day 14】探討 LangGraph 的 Deep Research Agent 架構

概述 在當今資訊爆炸的時代,很多複雜問題都需要我們花費大量時間在網路上搜尋、閱讀和整理資訊。如果能有一個 AI 代理幫我們自動完成這些深度研究任務,將大量資料...

鐵人賽 DevOps DAY 13

技術 【Day 13】不再需要 Dashboard?LLM 驅動的可觀測性介面

概述 在可觀測性的世界裡,資料可視化與使用者介面,始終是我們從龐大數據中提煉洞見的最後一哩路。這正是為什麼像 Grafana 這樣的可視化平台,即便歷經多次技...

鐵人賽 DevOps DAY 12

技術 【Day 12】打造企業級 AI Agent:認識 Agent 框架與選用指南

概述 在上一篇文張中,我們透過 Google Agent 白皮書確立了一個核心共識:AI 應用的未來屬於能夠感知、思考、採取行動的智能代理(Agent)。而一...

鐵人賽 DevOps DAY 11

技術 【Day 11】從玩具到工具:了解生產級 LLM Agent 下的冰山

前言 許多開發者初次接觸 AI Agent,會被 ReAct (Reasoning and Acting) 框架的簡潔與強大所吸引,並迅速用幾十行程式碼實現一...

鐵人賽 DevOps DAY 10

技術 【Day 10】LLM 的「工具」思維:用 Function Calling 讓你秒懂 ReAct、MCP 與 A2A

前言 在先前關於 Google Agent 白皮書的探討中,我們觸及了一個核心觀點:一個大型語言模型(LLM)之所以能被稱為「Agent」(代理人),其關鍵區...

鐵人賽 DevOps DAY 9

技術 【Day 9】LLM 應用入門:你的 LLM 應用是 Model-based 還是 Agent-based?

概述 在過去短短兩年裡,大型語言模型(LLM)應用經歷了一場驚人的蛻變。我們從驚嘆於 ChatGPT 能寫詩作對、回答知識性問題的「聊天機器人」時代,迅速躍遷...

鐵人賽 DevOps DAY 8

技術 【Day 8】探討 Prompt 的生命週期:從版控、測試到部署

概述 在上一篇文章中,我們達成了一個重要的共識:Prompt 不僅是與 AI 的對話,它更是需要用工程紀律來嚴謹對待的 API 請求。我們也意識到,由多個 P...

鐵人賽 DevOps DAY 7

技術 【Day 7】探討 Prompt Engineering:LLM 的入門磚

概述 在先前的章節中,我們已經深入探討了大型語言模型(LLM)在可觀測性領域中的定位與重要性。我們認識到:LLM 可觀測性的核心,在於如何評估其輸出的不確定性...

鐵人賽 DevOps DAY 6

技術 【Day 6】OpenTelemetry 對於 LLM 可觀測性的重要性

概述 在上一篇文章中,我們深入探討了 LLM 應用的獨特性。它是一個機率性的、以語義為核心的「黑盒子」。我們意識到,傳統的監控手段已無法應對其在遙測、輸出、成...

鐵人賽 DevOps DAY 5

技術 【Day 5】認識 LLM 可觀測性:迎接挑戰的第一課

概述 在過去幾篇文章中,我們從傳統監控一路聊到「可觀測性 2.0」,並探討了為何像 ClickHouse 這樣的 OLAP 資料庫會成為新時代的基石。這一切的...

鐵人賽 DevOps DAY 4

技術 【Day 4】可觀測性2.0的明日之星 - ClickHouse

概述 在上一篇文章中,我們探討了從傳統監控邁向『可觀測性 2.0』的關鍵轉變,其核心在於能夠應對海量、高基數的遙測資料,並進行即時的探索式分析。這對後端的資料...

鐵人賽 DevOps DAY 3

技術 【Day 3】傳統可觀測性與可觀測性 2.0:只是另一個 Buzzword?

概述 天下分久必合,合久必分。軟體世界從不缺乏閃亮的新名詞,尤其在微服務與雲原生逐漸成為主流的這些年,可觀測性(Observability) 和 分佈式追蹤(...

鐵人賽 DevOps DAY 2

技術 【Day 2】可觀測性與監控是什麼?

概述 多年來,IT 監控以各種方式被應用和部署。其核心目的是收集有關不只是 IT 基礎設施以及雲原生服務的硬體和軟體運作指標,確保所有關鍵功能都能順利運作,進...

鐵人賽 DevOps DAY 1

技術 【Day 1】探索 LLM 可觀測性之旅

前言 2025 年可以說是 LLM 應用真正大放異彩的一年。原因在於,LLM 的使用場景早已不再侷限於像 ChatGPT 這樣的網頁聊天視窗,如今它已經延伸到...

鐵人賽 DevOps DAY 20

技術 Day 20|Observability 全面監控:Prometheus × Grafana × ELK

●前言 Day 20,代表第一階段的壓軸登場。 前面我們用 Terraform × Helm × CI/CD,已經能自動化建 Infra、部署應用。 但 Dev...

技術 Grafana k6 入門實戰

完整內容在此, 幹話王_Grafana k6 入門實戰 將 k6 從設計測試到開發再到 CI pipeline 整個完整寫一篇。 2024年9月,Grafan...

技術 Docker 環境中用 Pumba 進行混沌測試

完整內容在此, 幹話王_Docker 環境中用 Pumba 進行混沌測試 Chaos Engineering 「混沌不是深淵,而是發現系統韌性的鏡子」 混...

技術 k6 也能寫瀏覽器測試 !

完整內容在此, 幹話王_Grafana k6 browser testing 既上一篇的 xk6今天分享 k6 也能寫瀏覽器測試 ! Grafana k6 B...

鐵人賽 DevOps

技術 後 Grafana 時代的第三十一天 - AlertSnitch 告警歷史可視化的利器

前言 在本系列文章中,我著重於如何透過良好的告警事件管理來減輕維運人員的負擔,並降低 MTTR(平均修復時間)等關鍵指標。維運人員常見的告警痛點包括:告警疲勞(...

鐵人賽 DevOps DAY 30
Grafana Zero to Hero 系列 第 30

技術 Grafana Zero to Hero - 總結:Hero's Journey

英雄旅程(Hero's journey)是廣泛應用在各種故事中的戲劇結構,描述主角如何突破困境最後成為英雄。神話學家 Joseph Campbell 在 194...

鐵人賽 DevOps DAY 30

技術 後 Grafana 時代的第三十天 - 一個時代的終結,也是另一個開始

完賽心得 鐵人賽挑戰的最後一天終於到來了。相比於前兩年的參賽經驗,我今年投入了更多的時間和精力,即便提前兩個半月開始準備,依然寫到了最後一天才完成所有內容。...

鐵人賽 DevOps DAY 29

技術 後 Grafana 時代的第二十九天 - 探討 Grafana 告警事件中心架構設計

前言 在前面的章節中,我們已經對告警事件中心有了初步的了解,並介紹了告警處理的核心服務,包括 Prometheus Alertmanager 和 Grafan...

鐵人賽 DevOps DAY 28

技術 後 Grafana 時代的第二十八天 - 探討 Grafana OnCall 告警待命通知管理

前言 在之前探討告警事件中心的章節中,我們已經對 Prometheus AlertManager 和 Grafana Alerting 有了基本的了解。雖然這...

鐵人賽 DevOps DAY 27

技術 後 Grafana 時代的第二十七天 - 探討 Grafana Alerting 告警歷史與列表

前言 在一個複雜的系統中,告警事件的歷史紀錄是非常重要的。它不僅可以幫助我們了解系統的穩定性,還可以幫助我們找出系統的瓶頸和潛在的問題。Grafana Ale...

鐵人賽 DevOps DAY 26

技術 後 Grafana 時代的第二十六天 - 探討 Grafana Alerting 的正確姿勢(二)

前言 在前一章節中,我們已經詳盡地介紹了設定告警規則的各種細節,並深入了解了告警規則在評估過程中所經歷的不同狀態變化及其所代表的意義。經過這一番學習,相信你已...

鐵人賽 DevOps DAY 25

技術 後 Grafana 時代的第二十五天 - 探討 Grafana Alerting 的正確姿勢(一)

前言 在經過了先前對於 Grafana Alerting 與 Prometheus AlertManager 的介紹後,我們對於告警事件系統的觀念已經有了基本...

鐵人賽 DevOps DAY 24

技術 Day 24:GitLab Product Direction - Monitor:Observability

(時間不太夠,所以昨天預告的 Portfolio Management 範例我們改天再聊,今天先用一個比較小的主題讓我再次喘息一下。) 今天我們來看另一個 Gi...

鐵人賽 DevOps DAY 24

技術 後 Grafana 時代的第二十四天 - 探討 Grafana Alerting 有趣的部分

前言 在現代可觀測性世界中,告警事件管理是確保服務穩定運行的關鍵,無論是雲端、地端以及各種分佈式系統中,精準即時的告警能夠幫助我們快速發相問題,接著進行故障排...

鐵人賽 DevOps DAY 22

技術 後 Grafana 時代的第二十二天 - 探討 Prometheus AlertManager 的正確姿勢(一)

前言 現代化系統中,監控與告警系統在日益複雜的服務環境中扮演著至關重要的角色。而我們在這背景下,以 AlertManager 這個百分之九十以上與 Prome...

鐵人賽 Modern Web DAY 22

技術 靠 Grafana 吃飯的第二十二天 - 前端除了監控還需要可觀測性

前言 我們在前三章的介紹中,深入地了解前端的監控以及 Web Vitals 的相關知識。在前端開發中,許多開發者已經熟悉了各種監控工具,這些工具可以幫助我們了...