第 1 课 · AI 到底是什么?
把大模型想象成一个读过全世界的书、特别会接话的人
先别管人工智能这四个字听起来多高深。你可以把现在说的 AI(准确说是大模型)想象成:
一个读过全世界的书、看过全世界的文章,特别会接话的人。
它没有真的思考,也不真的懂什么,它只是特别擅长一件事:你说上半句,它能猜出下半句大概率该说什么,而且猜得又快又准。就像你朋友圈里那种什么话题都能接两句的朋友,不是他什么都懂,是他看得多、见得广,接得住。
这个接话能力是怎么来的
这类模型在训练阶段读过海量的文字:书籍、网页、对话记录。它从中学会了「什么样的话后面大概率跟着什么样的话」这种统计规律。
它不是背下了某本书的内容,而是学会了人类语言的接话规律,所以哪怕是从没见过的问题,它也能凭这套规律给出一个说得通的回答。
所以它为什么会一本正经地说错话
这也是为什么它有时候会一本正经地说错话(业内叫幻觉):它是在按接话规律生成一段听起来通顺的话,不是在数据库里查一条确认为真的记录。
如果你问它一个它训练数据里很少见、或者本身就有争议的问题,它可能会给你一个听起来很自信、但其实经不起推敲的答案。这一点很重要,第 4 课会专门讲怎么应对。
再多说一句容易被忽略的:不同的 AI 聊天工具,背后用的大模型可能不一样,就像不同餐厅请了不同的厨师,做菜风格、擅长的菜系会不一样。但只要是这一类大模型,工作原理都是相通的:读得多、擅长接话、偶尔会自信地说错。
常见问题
不是。它没有存下网页原文,而是学到了语言规律,更接近读书读到内化,而不是复制粘贴。所以你没法要求它「把某某网页原文给我」,它给出来的很可能是它按规律编的一段像那么回事的话。
因为训练数据覆盖面极广,几乎所有公开的文字它都读过一遍。所以在广度上它碾压绝大多数人,但深度和准确度未必比专业人士强。这个特点决定了它最适合的用法:帮你快速铺开一个不熟悉的领域,而不是替你做专业判断。
按现在的原理,它输出的「我觉得」「我很高兴」都是学来的说话方式,不代表内部真有对应的状态。你可以把它当成一个演技很好的演员:台词很到位,但不等于他此刻真的在经历那个情绪。
本课自测
参考答案:它是一个读了海量文字、特别会接话的程序,你说上半句它能猜出下半句该说什么。
关键是别用「人工智能」「深度学习」这类词换一个同样听不懂的词。如果你的解释里出现了对方也不懂的名词,那就是没讲清楚。
因为它的底子是按规律接话,不是精确计算。这个问题下一课会展开。如果你现在能答到「它是在猜下一个字,不是在算」,就已经抓住重点了。
小结:AI = 一个见多识广、特别会接话的人,不是万能查询机。记住这句话,后面几节课都建立在这个基础上。