名词解释 / 01
大语言模型
第 2 / 127 个名词认识 AI 和常见产品
英文名称:Large Language Model
英文缩写:LLM
所属分类:认识 AI 和常见产品
一句话解释
大语言模型是在大量文本及其他数据上训练、通过预测词元序列来理解和生成语言的模型,可完成问答、写作、摘要、翻译和信息提取等多种任务。
工作中什么时候会遇到
ChatGPT、DeepSeek、Claude、Gemini 以及许多企业办公助手的文字能力,通常由大语言模型提供。
能解决什么问题
- 理解自然语言任务要求。
- 生成、总结、改写和翻译文字。
- 从文档中提取、分类和组织信息。
- 作为知识库问答或 AI 智能体的推理与表达组件。
举个例子
计划人员可以让大语言模型把生产会议记录整理成“问题、决定、负责人、期限”。它能识别语言结构,但不能确认记录中缺失的真实进度,负责人和日期仍需参会者核对。
怎么使用
通过办公产品或企业应用输入任务、背景、可靠材料和输出格式。需要事实答案时接入可追溯资料,并要求给出引用;需要稳定流程时建立测试样本和人工复核。
使用时要注意什么
模型的核心机制不是数据库查询,可能生成流畅但错误的内容。长上下文、参数规模和排行榜都不能单独证明业务效果;应使用自己的材料和任务测试。
容易混淆的词
- 语言模型:范围更广,规模可大可小。
- 大模型:还可能包括视觉、语音等非语言模型。
- 聊天机器人:是产品形态,可能使用大语言模型,也可能只用规则。