iT邦幫忙

0

PRTG 的 Sensor 到底要怎麼估?一台伺服器不是一個 Sensor

  • 分享至 

  • xImage
  •  

https://ithelp.ithome.com.tw/upload/images/20260824/201821717QnI8neGRi.png

開始用 PRTG ,很多在第一次規劃 sensor 數量的時候都估錯了。

直覺上會覺得「我有 50 台設備,買 500 sensor 不就夠了,一台 10 個」,但等到真的開始設定,才發現一台稍微複雜的伺服器根本不止 10 個 - - CPU 使用率一個、記憶體一個、每個硬碟分區各一個、每個網路介面各一個、再加上你想追蹤的服務狀態,輕輕鬆鬆就 15~20 個起跳。
這篇把 PRTG 的 sensor 邏輯、常見低估的地方,以及幾個實際設定的眉角整理出來。

先搞懂:sensor 是什麼

PRTG 的計價和授權都是以 sensor 數量為單位,不是設備數、不是使用者數。
一個 sensor 對應一個監控量測點。以一台 Linux 伺服器為例,如果你想監控:
CPU 使用率 → 1 sensor
記憶體使用率 → 1 sensor
磁碟空間(/、/var、/home 三個掛載點)→ 3 sensors
網路介面(eth0、eth1)→ 2 sensors
Ping 連線狀態 → 1 sensor
某個關鍵服務(如 nginx)的 process 狀態 → 1 sensor

這台伺服器就需要至少 9 個 sensor,還沒算 SNMP、log 監控、自訂 script 的部分。

最容易低估的三個場景

虛擬化環境是最常踩的地方。如果你有 VMware 或 Hyper-V,每台 VM 需要自己的 sensor 組合,Host 機也需要單獨監控。一個有 20 台 VM 的 Host,sensor 用量可能比想像中多出三倍。
網路設備也比想像中耗 sensor。一台 managed switch 如果有 24 個 port,你想監控每個 port 的流量進出,就是 24 個 traffic sensor,再加上整台設備的 CPU、記憶體,輕鬆超過 30 個。
應用程式監控是第三個坑。PRTG 支援 HTTP、SQL query、custom script 等方式監控應用程式狀態,這些都是額外的 sensor。如果你的環境有多個 web service 或資料庫需要監控,這塊很容易在初期規劃時被忽略。

Sensor 數量和監控頻率的取捨

這個比較少人提到,但 sensor 數量一大就會遇到。
PRTG 預設的輪詢間隔(polling interval)是 1 分鐘,sensor 數量少的時候沒感覺。但當 sensor 數量超過 5,000 個,PRTG Server 本身的 CPU 和記憶體負載會開始變明顯,官方建議把輪詢間隔調整到 5 分鐘或以上。
這代表你要想清楚哪些 sensor 真的需要 1 分鐘的即時精度(例如關鍵服務的存活狀態),哪些可以接受 5 分鐘(例如磁碟使用率的長期趨勢)。全部都設成最高頻率,等 sensor 數量一多,監控系統自己反而變成效能瓶頸。
實務上的做法是分級設定:關鍵服務 1 分鐘、一般效能指標 5 分鐘、趨勢型指標(如磁碟使用量)15 分鐘或 30 分鐘。

免費版適合用來做什麼?

PRTG 有提供永久免費版,上限是 100 個 sensor。
對一般評估來說,100 個 sensor 大概可以監控 5~10 台設備,深度依你想追蹤的指標而定。這個規模其實夠讓你真實感受 PRTG 的設定流程、alert 機制和 dashboard 邏輯,判斷和你的工作流程是否契合。
有一個比較實用的做法是:用免費版對你最複雜的一台設備做完整的 sensor 規劃,然後把實際用掉的 sensor 數乘上你的設備總數,這樣估出來的數字比直接套「每台 10 個」準確很多。

和 Zabbix / Checkmk 比,差在哪?

技術上三個都可以做到類似的監控覆蓋,但架構和體驗差異很大。
PRTG Zabbix Checkmk 部署平台 Windows Linux Linux Auto-discovery 內建,GUI 操作 要自己設定 action 有支援 Agent 不需要(走 SNMP/WMI) 大多數情況要裝 大多數情況要裝 OT/IoT 有支援 支援有限 支援有限 設定難度 相對低 高,template 和 trigger 要花時間 中等 授權 商業,依 sensor 數計費 開源免費 社群版免費,有商業版
技術上三個都可以做到類似的監控覆蓋,但體驗差異很大。

Zabbix 和 Checkmk 是開源的,不需要授權費用,支援的監控範圍也很廣。代價是設定複雜度高 - - Zabbix 的 template 和 trigger 設定有一定的學習曲線,Checkmk 相對好一點但也需要花時間熟悉。這兩個工具適合有能力自己維護、願意投入時間調整的環境。
PRTG 的差異在於「裝好就能用」的體驗。sensor 的自動發現(auto-discovery)可以掃描網段內的設備並建議適合的 sensor,dashboard 和 alert 的設定也比較直觀。代價是授權費用,以及 sensor 數量的上限管理。
沒有哪個一定比較好,取決於你的環境有沒有人願意花時間維護開源工具,還是更傾向有廠商支援的商業工具。

最後

PRTG 在這個市場已經三十年了,sensor 計價邏輯是它和多數監控工具最大的不同點,也是最容易在初期規劃時踩坑的地方。
搞清楚你的環境裡每種設備類型實際需要多少 sensor,比看方案定價表更重要。先用免費版跑一輪真實的 sensor 規劃,再評估要不要往上走。

有不同的 sensor 規劃心得或踩坑經驗,歡迎在留言區分享。

本文章同步轉載至 Medium

參考來源:
PRTG Network Monitor 官網
PRTG 效能調整建議


圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言