過擬合 是什麼?
Overfitting:過擬合 的完整解釋
過擬合指模型過度記憶訓練資料的細節與雜訊,導致在未見過的新資料上預測表現大幅下滑
容易混淆
過擬合 vs 欠擬合
過擬合是學太專精,只會訓練集;欠擬合是學太少,連訓練集都學不好,兩者都導致模型泛化能力差,無法處理新資料。
最關鍵的區別:一個是記太熟,一個是學太少。
過擬合 vs 欠擬合
過擬合是學太細,欠擬合是學太少,兩邊都會讓泛化變差
最關鍵的區別:一個記太多,一個學太少。
記住這句就好
訓練資料背太熟,遇到新資料就失準
實際案例
案例 1:模型在訓練集接近滿分,到了測試集卻掉到很低
這種情況下,過擬合 會幫你把原本手工或靠直覺的步驟變得更穩。
案例 2:小資料配大模型,最後只學到雜訊沒有學到規律
另一個常見場景也能看出 過擬合 的價值,因為它處理的是同一種核心問題。
算法與應用
核心意思就是:訓練資料背太熟,遇到新資料就失準。
常見解法包含正則化、Dropout、早停、交叉驗證和增加資料
看訓練分數和驗證分數的落差,最容易先抓到問題
中英對照與常見說法
| 說法 | 出現場合 |
|---|---|
| 過度擬合、過擬合 | 台灣兩種說法都常見 |
| 过拟合、过度拟合 | 簡體寫法 |
| Overfitting | 英文原名 |
| 過度配適、過學習 | 統計學文獻裡的譯法 |
相反的問題是欠擬合(underfitting,欠拟合):模型太簡單,連訓練資料都學不好。
怎麼判斷
| 訓練誤差 | 驗證誤差 | 診斷 | 該做什麼 |
|---|---|---|---|
| 高 | 高 | 欠擬合 | 加大模型、加特徵、訓練久一點、減少正則化 |
| 低 | 高 | 過度擬合 | 加正則化、加資料、簡化模型、提早停止 |
| 低 | 低 | 良好 | 檢查有沒有資料洩漏,好得不合理就是有問題 |
| 高 | 低 | 通常是切分或評估寫錯了 | 先檢查程式碼,不要急著解釋 |
判斷過度擬合只看一件事:訓練誤差與驗證誤差的落差。單看訓練誤差很低沒有意義,單看驗證誤差不夠好也不代表是過度擬合,可能只是模型不夠力。
解法,依效果排序
增加資料是最有效的手段,沒有之一。拿不到新資料時用資料增強:影像可以旋轉、裁切、調色,文字可以同義替換、回譯。
提早停止最簡單。盯著驗證誤差,一開始上升就停,並保留當時的權重。實作成本幾乎為零,效果常常出乎意料地好。
正則化:L2(權重衰減)把權重壓小、L1 把部分權重壓到 0、Dropout 隨機關掉神經元逼模型不依賴少數路徑。
簡化模型:減少層數、減少特徵、限制決策樹深度。
交叉驗證不會減少過度擬合,但能讓你更準確地發現它,資料量小的時候特別重要。
兩個常被忽略的來源
對驗證集過度擬合。 反覆用同一個驗證集調超參數,選出來的模型已經隱含地朝它最佳化了。所以最終評估一定要留一個從頭到尾只用一次的測試集。
資料洩漏造成的假象。 特徵裡混進了預測當下拿不到的資訊,訓練與驗證誤差都很低,上線後直接崩潰。最常見的形式是用整個資料集算標準化參數再切分,以及同一個實體的資料同時出現在訓練與驗證兩邊。訓練與驗證誤差都低得不合理時,先懷疑洩漏,不要先高興。
情境判斷
Q1(直覺題): 模型在訓練集接近滿分,到了測試集卻掉到很低 這種情況,會先想到 過擬合 嗎?
→ 會,因為它正好在處理這件事的核心問題,只是還要看資料乾不乾淨、流程穩不穩。
Q2(判斷題): 訓練分數很好、測試分數很差,一定是過擬合嗎?
→ 多半是,但也要看資料切分、標註品質和任務難度,有時是資料分布不同
過擬合 在 iPAS 考試中的重點
根據歷年統計,過擬合 相關題目 平均佔 AI 技術類考題 8%, 屬於高頻考範圍。
常見出題方向:類神經網路架構(40%)、模型訓練與評估(35%)、防止過擬合的策略(25%)。
相關術語
常見問題
過擬合和欠擬合有什麼不同?
過擬合是指模型在訓練資料上表現很好,但在測試資料上表現很差;欠擬合是指模型在訓練資料和測試資料上都表現很差。 過擬合通常是因為模型過於複雜,學習了訓練資料中的雜訊;欠擬合通常是因為模型過於簡單,無法捕捉資料中的重要特徵。
什麼時候應該使用過擬合?
一般來說,我們應該避免過擬合。 但在某些特殊情況下,例如在資料量非常有限的情況下,或者在競賽中只關心特定測試集的表現時,可以適當允許模型過擬合。 但是,需要謹慎評估這種做法的風險,並採取相應的措施來控制過擬合的程度。
初學者學習過擬合最常見的誤解是什麼?
初學者最常見的誤解是認為訓練集準確率越高越好。 他們往往會過度追求在訓練集上的完美表現,而忽略了模型的泛化能力。 實際上,一個好的模型應該在訓練集和測試集上都表現良好,而不是只在訓練集上表現出色。
資料來源
- iPAS AI 應用規劃師評鑑內容範圍參考(115.02) ,經濟部產業人才能力鑑定