LLM
ChatGPT、Claude、Gemini的核心——通过阅读海量文本、学习预测「下一个词」的程序。
简单来说
LLM(Large Language Model,大语言模型)是ChatGPT、Claude、Gemini的核心。它的真面目其实很简单——一个通过阅读互联网上海量文本、训练来预测「这句话后面会接什么词」的程序。
「预测下一个词」听起来没什么了不起,但要把这件事做好,模型必须把语法、知识、逻辑通通学会。要准确猜出「韩国的首都是」后面该接什么词,就必须真正知道答案。于是,一台擅长预测下一个词的机器,结果也变成了擅长翻译、总结、写代码的机器。
新闻里出现「GPT-5」「Claude Opus」「Gemini」这类名字时,指的都是LLM的产品名。就像汽车公司每年推出新车型一样,AI公司也在不断推出更大、更聪明的LLM——这类发布正是AI新闻里最常见的题材。
在报道中是这样出现的
「Anthropic发布新LLM,宣称性能登顶」——意思是出现了新的「大脑」。我们平时使用的聊天机器人服务外观不变,但内部的大脑常常已经被替换。
亲手试一试
- 让聊天机器人「接着'秋天的天空'这句话往下写一句」,然后用全新对话把同样的问题再问两次。
- 每次得到的句子都不一样——这证明LLM并不是在给出固定的正确答案,而是在按概率挑选「看起来合理的下一个词」。
- 这次连续三次问「韩国的首都是哪里?」。这次每次答案都一样——概率明显偏向某个答案的问题,和不偏向的问题之间的差异,正是LLM「性格」的体现。
模型和大语言模型,区别在哪
箱子里的一格, 大的箱子
文章里这两个词经常被随意混用,让人以为是同一个意思。模型是对所有训练完成的AI程序的统称,大语言模型则是其中处理文字的那一类。会画图的模型、会生成声音的模型也是模型,但不是大语言模型。
| 对比项 | LLM | Model(模型) |
|---|---|---|
| 范围 | 其中能读写文字的那一类 | 所有训练完成的AI程序 |
| 包含关系 | 始终只是模型的一个分支 | 图像、视频、语音模型也都包括在内 |
| 举例来说 | GPT、Claude、Gemini、Llama | Sora、Imagen、AlphaFold也都是模型 |
| 能互换着叫吗 | 把图像模型叫做大语言模型就错了 | 把语言模型叫做模型并不算错 |
| 还容易和什么搞混 | 容易和体量混淆。做小的版本叫做小语言模型 | 容易和产品名混淆。ChatGPT是产品,GPT是模型 |
判断方法生成的不是文字,就只能叫模型;只有在读写文字的时候,才是大语言模型。
相关词条
出现过这个词的报道
目前还没有报道用到这个词。有新报道时会自动出现在这里。