大模型
也叫:LLM · Large Language Model · 大语言模型
大模型(LLM)是什么?用大白话理解:它是靠海量文本训练、擅长预测下一个字的程序。
他们说
基于 Transformer 架构的自回归大语言模型
老白翻译
一个把下一个字猜得特别准的程序。
它到底是什么
大模型不是“会思考的人”,更像一台读过海量文章的文字预测机。你给它一段话,它会猜后面最可能出现什么。
猜得够多、够准,看起来就像在聊天、写作、翻译、写代码。
生活里的例子
你打字时手机的联想输入,其实是“小模型”。大模型是把这件事做到极致:上下文更长、知识更广、表达更稳。
常见误解
- 误解:它真正理解世界。 多数时候它是在做模式匹配,不是亲身体验。
- 误解:它永远正确。 它会一本正经地编错(见「幻觉」)。
- 误解:越大越好。 还要看任务、成本和是否接了你的资料。
普通人怎么用
先把它当“超级草稿助手”:写提纲、改表达、解释概念。重要结论自己核对,别直接当真理。