iT邦幫忙

2026 iThome 鐵人賽

DAY 1
0
自我挑戰組

用數據守護雙眼:生活型態對視力影響的探索性資料分析系列 第 1

專案啟航!為什麼我們需要用數據看懂視力危機?

  • 分享至 

  • xImage
  •  

第一天,我們不急著敲鍵盤寫迴歸模型,也不急著調參,先聊聊「為什麼要做這個題目」,以及接下來這30天,我們將如何用資料科學的方法,拆解現代人的用眼真相。

一、每天盯著螢幕的你,眼睛還好嗎?
早上被手機鬧鐘叫醒、通勤滑社群動態、上班上課盯著筆電寫程式或做報告,晚上放鬆時繼續追劇、打遊戲。
「長時間用眼、近距離盯著螢幕」已經不是少數人的特殊習慣,而是現代人無法迴避的生存常態。伴隨而來的,是乾眼、眼壓飆高、飛蚊症以及不斷加深的近視度數。

坊間充斥著許多護眼常識與耳語:

  • 「每天看螢幕超過 8 小時一定會快速近視?」
  • 「只要有去戶外運動,就算常盯螢幕也能抵銷傷害?」
  • 「吃葉黃素或早點睡,真的對視力維持有統計顯著的幫助嗎?」
    這些觀念聽起來言之成理,但真實的數據究竟怎麼說?到底哪些生活因子才是真正的「視力隱形殺手」?這正是這個系列想要回答的問題。

二、為什麼選擇「探索性資料分析(EDA)」?
在談到資料科學時,很多人第一時間想到的是複雜的深度學習、神經網路或各種花俏的模型演算法。
但在真實的資料科學工作流中,有超過70%的時間與價值其實體現在EDA(Exploratory Data Analysis,探索性資料分析)。

EDA的本質就像當一名數據偵探。
在沒有預設成見的情況下,透過視覺化圖表與統計摘要,摸清資料的長相、抓出荒謬的極端值、驗證常識假說,並找出隱藏在數字背後的真實趨勢。

與其把未經理解的髒數據直接丟進「機器學習黑盒子」得出不可靠的結果,不如扎扎實實把數據說的故事拆解清楚。這也是初學者踏入資料分析最關鍵、最實用的一項核心基本功。

三、30天完整學習與實戰地圖
這30天的內容將嚴格遵循標準的資料分析生命週期,整體架構分為五個階段:
第一階段:環境建置與資料前處理(Day1 – 7)

  • 建置Python數據分析工作環境(Jupyter / Colab)。
  • 取得公開健康與視力檢查數據,認識欄位定義。
  • 處理缺失值與極端離群值,產出乾淨結構化的資料集。
    第二階段:單變量探索(Day8 – 14)
  • 觀察單一變數的分佈樣貌(如:大家平均螢幕時長是多少?近視度數偏態如何?)。
  • 使用直方圖、箱形圖精準呈現數據集中與離散趨勢。
    第三階段:雙變量關聯與假說檢定(Day15 – 21)
  • 探索變數間的交互關係(螢幕時長 vs 視力、戶外活動 vs 視力)。
  • 繪製相關矩陣熱力圖,並運用統計檢定(T檢定、卡方檢定)驗證顯著性。
    第四階段:特徵工程與基礎模型解讀(Day22 – 27)
  • 建立衍生指標(例如「戶外活動/螢幕使用時長比」)。
  • 運用高解釋性的基礎線性/邏輯斯迴歸,透過模型權重係數量化生活因子的影響力。
    第五階段:洞見轉化與展示(Day28 – 30)
  • 將冰冷的統計數字轉譯為具體的3大個人化日常護眼指引。
  • 利用輕量化網頁工具展示視覺化圖表,完成鐵人賽30天複盤。

四、本系列使用的工具箱
在工具選擇上,我們追求「輕量、實用、易上手」,不需要安裝龐大繁雜的軟體:

  • 語言與環境:Python 3、Jupyter Notebook / Google Colab
  • 資料處理:⁠pandas⁠、⁠numpy⁠
  • 統計與視覺化:⁠matplotlib⁠、⁠seaborn⁠、⁠scipy⁠
  • 基礎建模:⁠scikit-learn⁠

下一篇
雲端開局!使用 Google Colab 快速打造分析環境與中文繪圖設定
系列文
用數據守護雙眼:生活型態對視力影響的探索性資料分析5
圖片
  熱門推薦
圖片
{{ item.channelVendor }} | {{ item.webinarstarted }} |
{{ formatDate(item.duration) }}
直播中

尚未有邦友留言

立即登入留言