語言模型(Language Model)是什麼?

語言模型是一種機器學習模型,用於預測給定文本序列中下一個詞彙或字符的概率分佈,是自然語言處理的基礎。|本頁含完整原理、應用場景、iPAS 考試重點與 3 個常見問答。

英文
Language Model
主題標籤
自然語言處理、機器學習、深度學習
考點定位
非 iPAS 核心術語
最後更新
2026/06/17
語言模型(Language Model)是什麼? 自然語言處理機器學習
術語快查

搜尋意圖: 如果你在找「語言模型 是什麼」或「語言模型 和相近概念差在哪」,先看這頁的短定義、完整說明與延伸比較。

TL;DR: 語言模型是一種機器學習模型,用於預測給定文本序列中下一個詞彙或字符的概率分佈,是自然語言處理的基礎。

實用情境: 適合用在閱讀 AI 文章、產品文件或和同事討論時,先用一頁快速對齊概念。

下一步: 先讀完定義,再往下看範例考題與延伸比較,把概念轉成可作答的判斷。

你每次打字時,手機為什麼常常能猜到下一個詞,這背後是什麼模型?

你可以把它想成一個專門猜下一個字或詞的語言機器,根據前文預測後面最可能出現什麼。

語言模型是一種機器學習模型,用於預測給定文本序列中下一個詞彙或字符的概率分佈,是自然語言處理的基礎。

容易混淆

大型語言模型 語言模型是總稱,大型語言模型是規模更大、通常建立在 Transformer 上的版本。

字典 字典只存定義,語言模型會學詞與詞怎麼接、在哪些語境出現。

記住這句就好

看前文,猜下一個。

實際案例

手機輸入法 打出「今天天氣很」時,系統會猜下一個常見詞,這就是語言模型在運作。

機器翻譯 模型要先理解前後語境,再決定下一個字該怎麼接,才能翻得順。

算法與應用

傳統 n-gram 語言模型只看前幾個詞,神經網路語言模型和 Transformer 則能看更長上下文。評估時常看困惑度,越低代表越會猜。

情境判斷

Q1(直覺題): 如果你現在遇到一個 手機輸入法 的場景,這個概念會是第一個想到的工具嗎? → 看情況,但如果任務目標和這個概念的用途一致,就很可能是。核心還是先確認你要解決的是分類、分群、壓縮、檢索,還是最佳化。

Q2(判斷題): 如果你把它和 字典 一起用,結果反而變不穩,通常該怎麼想? → 看情況。先檢查資料分布、特徵定義和模型假設是否相容,很多時候不是概念本身有問題,而是使用條件不對,像距離尺度沒對齊、標註規則不一致,或輸入格式不合。

常見問題

語言模型 最容易跟 大型語言模型 混淆嗎?

語言模型是總稱,大型語言模型是規模更大、通常建立在 Transformer 上的版本。

什麼情況會用到 語言模型?

你可以把它想成一個專門猜下一個字或詞的語言機器,根據前文預測後面最可能出現什麼。 實務上只要你要處理和這個概念相符的任務,就會用到它。

初學者最常錯在哪裡?

字典只存定義,語言模型會學詞與詞怎麼接、在哪些語境出現。

範例考題

某企業提供大型語言模型(LLM)API 服務,需支援高併發請求與流量波動,同時要求服務不中斷並具備故障容忍能力。若以高可用性與可擴展性為主要設計原則,下列哪一種部署方式較為適當?

  • A. 採用單一高效能虛擬機(VM)集中部署,以提升資源使用效率
  • B. 建立多個模型服務實例並透過負載分散機制提供服務 ✓ 正確答案
  • C. 將推論任務改由用戶端設備分擔,以降低伺服器負載壓力
  • D. 使用 FTP 協議傳輸請求與回應,以減少服務通訊負擔

解析:

高可用性與可擴展性的核心是建立多個服務實例並透過負載均衡分散流量,確保單一實例故障時服務不中斷,同時能動態擴展應對流量波動。

某企業導入大型語言模型(LLM)進行客服自動化,並已透過 Fine-Tuning 學習企業標準問答範例,但在實務運作中仍出現回應策略未符合服務優先順序及語氣與品牌風格不一致的情況,因此技術團隊建議再導入 Reinforcement Fine-tuning(RFT)機制進行優化,其主要目的為何?

  • A. 擴展模型的知識涵蓋範圍與資料記憶能力
  • B. 透過 reward 訊號調整模型回應策略與行為偏好 ✓ 正確答案
  • C. 提升模型推論速度與降低回應延遲
  • D. 降低 prompt 設計複雜度並取代訓練流程

解析:

Reinforcement Fine-tuning(RFT)的主要目的是透過 reward 訊號(獎勵信號)來調整模型的回應策略與行為偏好,使其更符合期望的服務優先順序與品牌風格。