名词解释 / 01

大语言模型

第 2 / 127 个名词认识 AI 和常见产品

英文名称:Large Language Model
英文缩写:LLM
所属分类:认识 AI 和常见产品

一句话解释

大语言模型是在大量文本及其他数据上训练、通过预测词元序列来理解和生成语言的模型,可完成问答、写作、摘要、翻译和信息提取等多种任务。

工作中什么时候会遇到

ChatGPT、DeepSeek、Claude、Gemini 以及许多企业办公助手的文字能力,通常由大语言模型提供。

能解决什么问题

  • 理解自然语言任务要求。
  • 生成、总结、改写和翻译文字。
  • 从文档中提取、分类和组织信息。
  • 作为知识库问答或 AI 智能体的推理与表达组件。

举个例子

计划人员可以让大语言模型把生产会议记录整理成“问题、决定、负责人、期限”。它能识别语言结构,但不能确认记录中缺失的真实进度,负责人和日期仍需参会者核对。

怎么使用

通过办公产品或企业应用输入任务、背景、可靠材料和输出格式。需要事实答案时接入可追溯资料,并要求给出引用;需要稳定流程时建立测试样本和人工复核。

使用时要注意什么

模型的核心机制不是数据库查询,可能生成流畅但错误的内容。长上下文、参数规模和排行榜都不能单独证明业务效果;应使用自己的材料和任务测试。

容易混淆的词

  • 语言模型:范围更广,规模可大可小。
  • 大模型:还可能包括视觉、语音等非语言模型。
  • 聊天机器人:是产品形态,可能使用大语言模型,也可能只用规则。

相关名词

大模型小语言模型GPTTransformer词元

参考来源