AI是怎么工作的
你有没有玩过"文字接龙"游戏?比如我说"我喜欢喝咖",你接"啡",整个句子就是"我喜欢喝咖啡"。
大语言模型的工作原理,本质上就是在玩一个超级复杂的文字接龙。
想象一位玩家,他阅读过人类有史以来几乎所有的文字材料——书籍、文章、对话、代码……当他参与文字接龙时,给定前文"我喜欢喝咖",他能瞬间计算出所有可能的下一个词及其概率:
咖啡(85%)> 可乐(8%)> 茶(5%)> 其他(2%)
然后他根据这个概率分布随机选择一个词输出。这个过程不断重复,直到生成完整的回答。
三个关键概念需要记住:
Token(词元):AI处理的基本单位。英文单词可能1-3个Token,中文则是1-2个字符对应1个Token。理解这个概念有助于你估算AI能处理的信息量。
上下文窗口:可以理解为AI的"工作台"。它一次能容纳的信息是有限的,早期对话超出这个范围后,AI就会"遗忘"。
概率生成:AI不是"想"出答案,而是在计算概率后"选"出一个词。这就是为什么它有时会"一本正经胡说八道"——它的选择基于语言模式的统计关联,而不是事实核查。
为什么AI会"胡说八道"?
AI本质上是极其强大的语言统计模型,而非逻辑推理系统。它学习了大量文本中词语共现的规律,当你的问题恰好激活了某些强关联模式时,它会生成流畅但可能错误的内容——因为在它的"认知"里,这些词确实应该连在一起。
建立正确的AI心智模型
正确理解AI的工作原理能帮助你更有效地使用它:
• AI不是"思考"后回答,而是在"概率计算"后输出
• AI有时会自信地给出错误答案
• AI的知识有截止日期
• AI不具备真正的"理解"能力
既不要神化它(认为它像人一样思考、有真正的智能),也不要矮化它(认为它只是个搜索引擎)。把它看作一位博学的文字接龙高手——理解力超强,输出流畅,但偶尔会犯"听起来对但实际错"的错误。