分層抽樣(Stratified Sampling)是什麼?

分層抽樣是一種統計抽樣方法,將母體依據特定特徵劃分為互斥的子群體(層),再從各層中獨立抽樣。這確保了各層在樣本中的代表性,能有效降低抽樣誤差,特別適用於處理不平衡資料集。|本頁含完整原理、應用場景、iPAS 考試重點與 3 個常見問答。

英文
Stratified Sampling
主題標籤
機器學習、資料處理、統計方法
考點定位
非 iPAS 核心術語
最後更新
2026/06/22
分層抽樣(Stratified Sampling)是什麼? 機器學習資料處理
術語快查

搜尋意圖: 如果你在找「分層抽樣 是什麼」或「分層抽樣 和相近概念差在哪」,先看這頁的短定義、完整說明與延伸比較。

TL;DR: 分層抽樣是一種統計抽樣方法,將母體依據特定特徵劃分為互斥的子群體(層),再從各層中獨立抽樣。這確保了各層在樣本中的代表性,能有效降低抽樣誤差,特別適用於處理不平衡資料集。

實用情境: 適合用在閱讀 AI 文章、產品文件或和同事討論時,先用一頁快速對齊概念。

下一步: 先讀完定義,再往下看延伸比較與對應工具,把概念轉成實際應用。

分層抽樣是一種統計抽樣方法,將母體依據特定特徵劃分為互斥的子群體(層),再從各層中獨立抽樣。這確保了各層在樣本中的代表性,能有效降低抽樣誤差,特別適用於處理不平衡資料集。

核心概念

分層抽樣(Stratified Sampling)是一種在統計學和機器學習領域中廣泛應用的抽樣技術。其核心思想是將一個具有異質性的研究母體,依據一個或多個與研究目標高度相關的共同特徵,劃分為若干個內部相對同質(homogeneous)且互不重疊的子群體,這些子群體被稱為「層」(strata)。一旦完成分層,研究者便會從每個層中獨立地抽取適當數量的樣本,然後將這些從各層抽取的子樣本合併,形成最終的整體樣本。

分層抽樣的主要目的在於確保樣本能夠充分且精確地代表母體中各個重要的子群體,即使這些子群體在母體中的比例很小。透過這種方式,分層抽樣能夠顯著降低抽樣誤差,提高統計估計的精確度。例如,在進行民意調查時,如果我們知道不同年齡層、性別或地理區域的人群對某個議題的看法可能存在顯著差異,那麼將母體劃分為這些層,並從每層中抽取足夠的樣本,將比簡單隨機抽樣更能獲得具代表性的結果。在機器學習中,這對於處理類別不平衡的資料集尤其重要,可以確保訓練集和測試集中各類別的比例與原始資料集保持一致。

分層抽樣的關鍵步驟包括:首先,明確定義分層變數和各層的邊界;其次,決定從每個層中抽取的樣本數量;最後,從每個層中獨立地執行隨機抽樣。選擇合適的分層變數是成功的關鍵,這些變數應與研究的目標變數密切相關,且能夠有效地將母體劃分為同質的子群體。

運作原理

分層抽樣的運作原理可以分解為幾個關鍵步驟:

1. 定義分層變數與分層

首先,需要選擇一個或多個與研究目標或因變數高度相關的變數作為分層變數。例如,在人口普查中可能是年齡、性別、教育程度或居住地區;在機器學習分類任務中,通常是目標變數的類別標籤。選定的分層變數必須能夠將母體劃分為互斥(mutually exclusive)且窮盡(collectively exhaustive)的子群體,即每個母體成員都且僅屬於一個層。理想情況下,層內的成員應盡可能同質,而層與層之間則應盡可能異質。

2. 確定每層的樣本量

確定每個層需要抽取的樣本數量是分層抽樣的另一個關鍵環節。常見的分配策略包括:

  • 等比例分層抽樣(Proportional Stratified Sampling): 這是最常見的方法,每層的樣本量與該層在母體中的比例成正比。這種方法確保了樣本的組成與母體結構相似,無需加權即可直接推斷母體。例如,如果某層佔母體總量的20%,則在樣本中也應佔20%。
  • 非等比例分層抽樣(Disproportional Stratified Sampling): 當研究者對某些特定層特別感興趣,或者某些層的變異性較大時,可以採用非等比例分配。例如,在處理機器學習中的不平衡資料集時,可以對少數類別的層分配更多樣本,以確保其在訓練中得到足夠的關注。這種情況下,在資料分析階段通常需要使用加權方法來校正,以確保結果對整個母體具有代表性。
  • 最佳分層抽樣(Optimal Allocation): 這種方法考慮了每層的大小以及每層內部變異性(通常是標準差),旨在最小化總體估計的變異數。它會對變異性較大的層分配更多樣本,同時考慮層的大小。這需要預先對各層的變異性有一定了解,通常在多階段抽樣或有歷史數據時使用。

3. 從每層獨立抽樣

一旦確定了每個層的樣本量,就從每個層中獨立地進行抽樣。最常見的方法是簡單隨機抽樣(Simple Random Sampling),即從每個層中隨機選取指定數量的樣本。此外,也可以在層內採用系統抽樣(Systematic Sampling)或其他隨機抽樣方法。

4. 樣本合併與分析

將從各層抽取的樣本合併,形成最終的整體樣本。如果採用的是等比例分層抽樣,則可以直接對合併後的樣本進行分析。如果採用了非等比例分層抽樣,則在進行統計推斷時,必須使用適當的加權方法來調整,以反映各層在母體中的真實比例,避免產生偏差的估計。

實際應用

分層抽樣因其能提高樣本代表性和估計精確度的優勢,在多個領域都有廣泛應用:

1. 機器學習資料集準備與評估

  • 處理類別不平衡資料集: 在分類問題中,當某些類別的樣本數量遠少於其他類別時(例如,詐欺交易與正常交易、罕見疾病與健康個體),直接隨機抽樣可能導致訓練集或測試集中少數類別的樣本過少。分層抽樣可以確保訓練集、驗證集和測試集中各類別的比例與原始資料集保持一致,從而避免模型偏向多數類,並能更可靠地評估模型對少數類的性能。
  • 交叉驗證(Cross-validation): 在進行K折交叉驗證時,分層抽樣確保每個折疊(fold)中各類別的比例與原始資料集相同。這對於模型評估的穩定性和可靠性至關重要,可以減少因隨機劃分導致的評估偏差,特別是在資料集較小或類別不平衡時。
  • 特徵工程與模型選擇: 在探索性資料分析或特徵選擇階段,分層抽樣可以幫助建立具有代表性的子集,加速實驗過程,同時確保子集能夠反映原始資料集的關鍵特性。

2. 社會科學與市場研究

  • 民意調查與社會調查: 根據地理區域、年齡組、性別、收入水平、教育程度等對人口進行分層,確保不同社會群體在樣本中的代表性。這使得調查結果能更準確地反映整體人口的觀點和行為。
  • 市場調研: 根據消費者行為、產品偏好、人口統計學特徵等對目標市場進行分層,以便更精確地了解各細分市場的需求、偏好和購買力,為產品開發和行銷策略提供依據。

3. 醫療與生物統計

  • 臨床試驗: 在設計臨床試驗時,可以根據患者的疾病嚴重程度、年齡、性別、合併症等進行分層,確保各治療組和對照組在這些關鍵變數上保持平衡。這有助於減少混雜變數的影響,提高試驗結果的內部有效性。
  • 流行病學研究: 對不同風險因子群體(例如吸煙者與非吸煙者、不同暴露水平的人群)進行分層抽樣,以更準確地估計疾病的發生率、盛行率和特定風險因子的影響。

4. 品質控制與工業應用

  • 產品檢測: 在製造業中,可以對不同批次、生產線、供應商或生產時段的產品進行分層抽樣,以確保整體品質的穩定性。這有助於及早發現生產過程中的問題,並對不同來源的品質進行比較分析。

常見誤區

儘管分層抽樣是一種強大的工具,但在實踐中仍存在一些常見的誤區,可能導致抽樣效果不佳或結果偏差:

1. 分層變數選擇不當

如果選擇的分層變數與研究目標或因變數不相關,或者這些變數未能有效地將母體劃分為內部同質的子群體,那麼分層抽樣的效果可能不如預期,甚至可能增加抽樣的複雜性而無法帶來顯著的效率提升。錯誤的分層變數可能導致層間差異不明顯,從而失去分層抽樣減少變異數的優勢。

2. 層定義不清晰或重疊

分層抽樣要求層之間必須是互斥且窮盡的。如果層的定義模糊不清,導致某些母體成員可能屬於多個層(重疊),或者某些成員不屬於任何層(遺漏),都將導致抽樣偏差,使得樣本無法真正代表母體。

3. 層內樣本量過小

如果某一層的樣本量被分配得過小,可能導致該層的統計估計不穩定,變異數過大,甚至無法進行有效的統計分析。這在處理稀有群體時尤其需要注意,即使是少數類,也需要確保足夠的樣本量來進行有意義的推斷。

4. 忽略抽樣權重

當採用非等比例分層抽樣時(例如,為了研究目的對某些小群體進行過度抽樣),如果在資料分析階段不使用適當的加權方法來調整,將會導致對整體母體的估計產生偏差。加權是為了將樣本數據「校正」回母體的真實比例,以確保推斷的有效性。

5. 誤認為分層抽樣總是優於簡單隨機抽樣

雖然分層抽樣通常能提供更精確的估計,但並非在所有情況下都絕對優於簡單隨機抽樣。如果母體本身是高度同質的,或者分層的成本(包括識別分層變數、劃分層和從各層獨立抽樣的成本)過高,其優勢可能不明顯,甚至可能得不償失。在這些情況下,簡單隨機抽樣可能更為簡潔有效。

6. 過度分層

將母體劃分過多的層,可能導致每個層的樣本量變得非常小,增加了抽樣的複雜性和成本,並且可能無法從中獲得足夠的統計推斷力。過度分層也可能使得資料分析變得更加困難,因為需要處理更多的子群體。

與相關技術的比較

1. 與簡單隨機抽樣 (Simple Random Sampling, SRS) 的比較

  • 簡單隨機抽樣: 從母體中以完全隨機的方式抽取N個樣本,每個母體成員被抽到的機率相等。它不考慮母體的內部結構。
  • 分層抽樣: 首先將母體劃分為若干層,然後從每個層中獨立地進行隨機抽樣。它明確利用了母體的內部結構。
  • 優勢: 分層抽樣在母體異質時能提供比SRS更精確的估計(即更小的變異數),尤其能確保稀有或重要子群體的代表性。SRS在母體同質時操作簡單有效,但可能無法捕捉到所有子群體的特徵,特別是當這些子群體在母體中佔比很小時。
  • 成本與複雜性: 分層抽樣通常需要更多的預備知識(關於分層變數和層的大小)和更高的實施成本,而SRS則相對簡單直接。

2. 與叢集抽樣 (Cluster Sampling) 的比較

  • 叢集抽樣: 將母體劃分為若干個「叢集」(例如,地理區域、學校班級),隨機選擇一些叢集,然後對選定的叢集進行全面調查或再抽樣。叢集內部通常是異質的,而叢集之間則被認為是相對同質的。
  • 分層抽樣: 將母體劃分為若干「層」,從每個層中抽樣。層內部是同質的,而層之間是異質的。
  • 目的: 叢集抽樣主要用於降低抽樣成本和提高實施效率,特別是當母體分佈廣泛或難以獲取完整名單時。分層抽樣主要用於提高估計精確度和確保各子群體的代表性。
  • 效率: 分層抽樣通常比叢集抽樣提供更高的統計效率(即更小的變異數),但其成本可能更高,尤其是在需要詳細的母體名單來進行分層時。

3. 與系統抽樣 (Systematic Sampling) 的比較

  • 系統抽樣: 從一個排序的母體列表中,每隔一個固定的間隔(例如,每第k個單位)抽取一個樣本。起始點是隨機選擇的。
  • 分層抽樣: 可以在每個層內使用系統抽樣作為層內抽樣的方法。例如,先將母體分層,然後在每個層內使用系統抽樣來選取樣本。
  • 關係: 系統抽樣是一種簡化抽樣過程的方法,而分層抽樣是一種提高樣本代表性和估計精確度的策略。兩者可以結合使用,但目的不同。

4. 與過採樣 (Oversampling) / 欠採樣 (Undersampling) 的比較(在機器學習中)

  • 過採樣/欠採樣: 這些是直接處理機器學習中類別不平衡資料集的方法。過採樣是增加少數類樣本的數量(例如,透過複製或生成合成樣本如SMOTE),欠採樣是減少多數類樣本的數量。它們直接改變了訓練資料集中各類別的實際分佈。
  • 分層抽樣: 是一種抽樣策略,確保在從原始資料集中抽取訓練集、測試集或進行交叉驗證時,各類別的比例與原始資料集保持一致。它不改變原始資料集的類別分佈,而是確保抽樣過程的代表性。
  • 關係: 分層抽樣可以與過採樣/欠採樣結合使用。例如,可以先使用分層抽樣來劃分訓練集和測試集,確保兩者類別分佈一致。然後,在訓練集上應用過採樣或欠採樣技術來平衡類別,以提高模型對少數類的學習能力。分層抽樣在模型評估階段尤其重要,確保測試集的類別分佈能真實反映實際情況,從而提供可靠的模型性能估計。

常見問題

分層抽樣與簡單隨機抽樣相比,主要優勢是什麼?

分層抽樣的主要優勢在於它能顯著提高樣本的代表性和統計估計的精確度,特別是當母體內部存在顯著異質性或包含重要的稀有子群體時。簡單隨機抽樣雖然操作簡便,但在異質母體中,可能因隨機性而導致某些重要子群體在樣本中比例過低或完全缺失,進而產生較大的抽樣誤差。分層抽樣透過將母體劃分為同質的「層」,並從每層獨立抽樣,確保了各層的特徵在最終樣本中得到適當反映,從而降低了估計的變異數,使得基於樣本的推斷更為可靠和精準。這對於需要精確分析各子群體特徵的研究尤為關鍵,例如在機器學習中確保不平衡類別的代表性。

在機器學習中,分層抽樣有哪些具體應用場景?

在機器學習中,分層抽樣主要應用於資料集準備和模型評估階段,特別是處理分類問題中的類別不平衡情況。例如,在建立訓練集、驗證集和測試集時,若不平衡資料集直接進行隨機抽樣,可能導致測試集中少數類別的樣本過少,無法有效評估模型對該類別的性能。分層抽樣能確保這些子集中各類別的比例與原始資料集保持一致,從而使模型訓練更穩定,評估結果更具代表性。此外,在交叉驗證(如K折交叉驗證)中,分層抽樣也確保了每個折疊(fold)中的類別分佈與整體資料集相似,避免了因隨機劃分導致的評估偏差,提高了模型性能估計的可靠性,這對於建立穩健的AI模型至關重要。

選擇分層變數時應考慮哪些因素?

選擇分層變數是分層抽樣成功的關鍵。首先,應選擇那些與研究目標或因變數高度相關的變數。如果分層變數與研究結果無關,則分層抽樣的效率提升將有限。其次,分層變數應該能夠將母體劃分為內部相對同質、但層間差異顯著的子群體。這種「層內同質,層間異質」的特性是分層抽樣減少變異數的基礎。再者,分層變數的資料必須是可獲取且易於識別的,以便於實際操作中對母體進行劃分。最後,應避免選擇過多或過細的分層變數,以免導致層數過多,使得某些層的樣本量過小,增加抽樣難度和成本,甚至影響統計推斷的穩定性,應在效率與精確度之間取得平衡。