利用弱分類器(決策樹)迭代訓練或得強分類器,其具有訓練效果好、不易過擬合等優點。 LightGBM V.S. XGBoost 圖源: https://re...
馬可夫決策過程( Markov Decision Process ,簡稱 MDP ) 用來描述強化學習問題的數學框架,是建模智能代理在與環境互動的情境下如何做出...
可以用來降維(dimension reduction),利用原有的特徵組合成新的特徵組,以達到降維的目的,同時保留住資料中的重要資訊 基本上它的目標就是將...
強化學習 依賴與動態( dynamic )環境的資料(隨著外部條件變化而改變的資料)重複互動以最大化累積回報( cumulative reward )找出能夠產...
點與點之間的距離 K-NN依照點與點之間的距離來計算點之間的相似性 通常使用的距離度量是歐氏距離(Euclidean Distance),但根據實際情況,也可...
半監督學習(Semi-supervised learning) 處理的訓練資料中有答案的資料和沒有答案的資料,半監督學習就是利用兩者的資料,來改善模型性能 L...
將所有樣本中相近得樣本點組成一個群組,一層一層往上堆疊,直至所有的樣本皆被分成一個群組為止 Hierarchical Clustering 透過將最接近的...
神經元與神經網路 細胞核細胞核控制神經元的基本生命過程在類神經網路中,類似的功能由模型的參數(權重和偏差)控制,參數會通過訓練過程來調整 軸突( Axon...
總的來說就是物以類聚 K-means Clustering 將數據集中的數據點分成不同群組,以便相似的數據點彼此靠近 選擇K值: 決定要將資料分成...
kernel trick 作天的SVM跟SVR有提到可以用kernel function將資料映射到高維空間中 解決的問題:當資料在原始空間中無法被線性分...
深度學習 是機器學習的一個分支,通過多層神經網絡來模擬和學習複雜的資料 神經網絡( Neural Network ) 深度學習的核心是神經網絡,這是由多個神經元...
層次聚類( Hierarchical Clustering ) 將資料集中的資料點分為不同群集的方法,群集之間形成一種層次結構,代表可以查看不同層次的群集結構,...
SVM (Support Vector Machine) 若資料為非線性,將資料映射到高維空間中(用kernel function) 找一超平面將資料分開,...
為強學習機融合方法 stacking 第一層為level 0,第二層為level 1 第一層可包含多個學習機,第二層只能有一個 第一層的學習機被稱為...
k-平均演算法(K-Means Clustering) 步驟 初始化: 從資料集中隨機選擇K個資料點作為初始群集中心,中心可以是資料集中的實際資料點或隨機生...
在前幾篇有提到關於 Ensemble 這個名詞,是之前都沒學過的東東,所以今天想要來一起了解這是個啥,其實我已經感受到我的鐵人賽學習順序非常混亂,但就先這樣吧,...
是基於 Gradient Boosted Decision Tree (GBDT) 改良與延伸 Boosting XGBoost是一種集成學習技術,通過組...
非監督式學習( unsupervised learning ) 沒有給定事先標記過的訓練資料,自動對輸入的資料進行分類或分群 非監督式學習的區別與監督式學習...
boosting 前幾天有寫過一點關於boosting跟bagging大概的概念,今天開始前再簡單說一下 透過組合弱學習機、改進每一次的錯誤、從而獲得一個...
昨天八點多睡,今天今神飽滿,終於筆者的每日日記回來了在這裡寫日記也不太對就是了,今天的標題有私心,這是一部我蠻喜歡的音樂劇,大家應該也看過,有被改編成電影(魔法...
原理 組合多個弱學習機來構建一個強學習機 將每個樣本的權重初始化為相等的值 建構弱分類器 將誤差大的資料權重加大 重複2跟3 加權投票決定結果 建構弱...
決策樹( Decision Tree ) 是用於分類和迴歸任務,一系列的規則和條件來對資料進行分類或預測 節點(Node) 每個節點表示一個特徵或屬性,對資...
使用多種學習算法來獲得比單獨使用任何單獨的學習算法更好的預測效果 集成學習 通過建立幾個模型組合來解決單一預測問題 所用來組合的多個模型之間要有差異...
好困、好忙、好累 正則化( Regularization ) 正則化主要用於防止模型 Overfitting 正則化方法( Lp 正則項) 通過向損失函數添加...
隨機森林是由多棵昨天提過的決策樹組成,適合用在分類問題 原理 由很多顆決策樹組成,他會先從原資料中隨機抽取多個樣本,用這些樣本以隨機特徵選取的方式建立多棵...
NCPC 小炮灰,謝謝你簽到題,至少不是 0。 線性迴歸( Linear Regression ) 用於預測未知資料的值找多個自變數( independent...
主要用於分類,也可以改為回歸樹(不建議),今天只討論單顆決測樹,明天會學習多顆決策樹組合成的隨機森林 決策樹原理 對資料重複進行二元分割,形成樹狀結構 根...
筆者今天不用補課很快樂,但生理時鐘還是讓我在九點多就醒了,可惡我以為今天會睡爽爽地說,但早上不用通勤很快樂,總之讓我們開始今天的筆記吧! 今天說一些機器學習...
前幾天的迴歸模型中,我們希望找到一個函數能最好的表達因變數與自變數之間的關係,而尋找這個函數的方法就是定義損失函數(loss function)或稱成本函數(...
昨天很快樂的開始說監督式學習,突然發現有東西沒說到,所以補到今天,這就是當天想當天主題的可悲,總之今天來寫寫模型得一些東東。 不知道為甚麼一職寫關於介紹的東...