大型語言模型

以海量文字訓練的AI語言系統

英文/別名LLM、Large Language Model

完整解釋

大型語言模型是以大量語言資料訓練、通常具有大量參數的模型,用來預測與生成符號序列,並可透過指令調整、檢索或工具使用完成多種語言任務。它能產生流暢回答,但核心仍是統計與計算模型;是否「理解」及可靠程度要依任務與測試界定。

閱讀與辨別重點

參數量不是能力的唯一尺度;資料品質、訓練方法、上下文、工具、評測與部署限制同樣重要。

參考來源

以下來源用於核對定義與辨讀重點;本站內容為整理與改寫。

  1. Wikipedia:大型語言模型Wikipedia

本站相關文章