知道很多,为什么还是做不好?
最近读到《万维钢·现代思维工具100讲》中的一篇文章,作者借用 AI 的训练过程,解释人是如何学习和成长的。
其中有一句话让我印象特别深:
预训练决定能力的上限,后训练决定能力的下限。
这句话也让我重新思考了一个问题:为什么有些道理明明看过很多遍,真正遇到事情时,我还是用不出来?
一个人经历过的一切,都是他的预训练
AI 大模型正式投入使用之前,通常会先经历预训练。
简单来说,就是让模型阅读海量文本,不断预测下一个词。一次预测看起来没什么意义,但当这个过程重复几万亿次以后,模型就会慢慢理解语言、事实、因果关系,甚至人情世故。
人其实也有类似的过程。我们读过的书、见过的人、做过的事,以及过去的成功和失败,都在塑造我们理解世界的方式。
这也解释了为什么每个人都是独一无二的。我们的天赋、家庭、经历和运气都不相同,简单地拿自己和别人比较,意义其实很有限。即使赢了,也不代表起点相同;即使输了,也不代表自己没有进步。
相比之下,今天的自己和昨天的自己拥有更多相同的条件,这种比较反而更有意义。一个人或许永远到不了别人的起点,但只要长期保持向上的斜率,最后也会和原地不动的自己走到完全不同的位置。
预训练还会带来一种现象:有些能力并不是别人一步一步教出来的,而是积累到一定程度后,突然就能理解和运用了。
不过,这里也有一个很容易忽略的问题:知道一个概念,不等于真正理解了它。
我以前听过一个很高的标准:如果你不能比其他人更清楚地解释一个观点,就不配说自己真正持有它。这个要求可能有点苛刻,但它至少提醒了我,听说过、听懂了和彻底理解之间,还有很远的距离。
对普通人来说,一个更实用的检验方法是:你能不能用自己的话,把它解释给一个理解能力正常的人听懂?
真正的问题,是能不能稳定发挥
预训练之后的 AI 虽然读过很多内容,却不一定会按照人的要求做事。它可能知道答案,但不知道什么时候应该回答,也不知道怎样回答才有用。
所以,AI 还要进行后训练。有人给它示范什么是好的回答,有人对结果做出评价,它还会在答案能够验证的领域反复练习。后训练最重要的作用,不是凭空增加许多新能力,而是让模型更稳定地调用已有能力。
原文用两个指标解释了这种区别。
一个是 pass@k:同一道题允许尝试很多次,只要有一次做对,就说明脑子里存在通往答案的路。另一个是 pass@1:只给一次机会,第一次就得做对。
前者测的是潜力,后者测的是发挥。
这对人的启发很直接。一个道理你事后能想起来,一道题你做一百次偶尔能做对,都不能说明你已经掌握了它。真正的掌握,是在具体场景出现时,不需要别人提醒,也能及时把正确的方法调用出来。
这也是思维工具的作用。它未必给人增加一种全新的能力,而是把已有的知识和经验打包成一个“快捷键”。工具不能代替经验,却能让我们在需要的时候更快调用经验。光记住“基础概率”“古德哈特定律”这些名字没有用,只有它们能在真实场景中自动启动,才算真正属于自己。
人生中很多重要事情,考的恰恰都是 pass@1。面试、谈判、健康和信誉,往往不会给我们无限次重来的机会。新人偶尔犯错,别人可能愿意包容;但如果总在同一个地方出错,别人就很难继续把事情交给他。
有些事情甚至一次失败就可能失去全部筹码。正因为如此,不管成功概率看起来有多高,只要失败会造成自己无法承受的损失,就不应该孤注一掷。拒绝当赌徒,从我做起。
我缺的可能不是知识,而是后训练
读到这里,我不得不承认:我这些年学过的东西并不少,但很多知识只有在特定场景下才能被提取出来。真正把它们用到现实里、通过实践形成经验的次数,却少得可怜。
输入得再多,如果不能转化成输出和行动,意义终究是有限的。
比如,我知道看见一个特别美好的故事时,应该先查基础概率,但偶尔还是会想买彩票,幻想靠一次中奖解决短期的钱不够。理性上知道几乎不可能,并不妨碍人在压力下把希望寄托在小概率事件上。只责怪一个人不理性并不能解决问题。很多时候,他真正缺少的是收入、希望和对未来的信心。
再比如,“古德哈特定律”在课程中出现过很多次,可当原文再次提到它时,我一开始竟然想不起它是什么意思。看过一次,不代表记住;能够回忆出来,不代表理解;理解了,也远远不等于能够在行动中使用。
后训练也不是简单地“多做”。它至少需要三个条件。
第一,在真实情境中练习。知识只有进入现实,才可能从脑子里的概念变成能够调用的工具。
第二,获得真实反馈。犯错不可怕,可怕的是犯错以后不总结、不改进,下一次继续犯同样的错误。没有反馈的努力,可能只是在不断强化错误动作。
第三,练到足够熟练。最近我玩《毁灭战士:永恒》时学了几个很强的技巧,但在实战中就是用不出来。没有什么捷径,只能反复练习,把动作练到不需要刻意思考。其他事情也是一样,“无他,唯手熟尔”。
学习不是读了多少,而是改变了什么
原文最后说,人的优势在于可以终身进行预训练和后训练。
大脑一直具有一定的可塑性。年轻时或许改变得更快,但年龄增长并不意味着人就不能改变。很多人高考以后就停止主动学习,中年以后也不再成长,并不是因为大脑彻底失去了能力,而是因为他们不再给自己新的输入,也不再主动练习。
而且,今天的后训练也会成为明天的预训练。每一次真实行动和复盘,都会变成下一次判断可以调用的新经验。
我不想成为这样的人。
不过,光有这个愿望还不够。预训练看的是输入什么。我现在依然把很多时间花在娱乐小说、娱乐视频和情感内容上。这些东西不是完全不能看,但不能摄入过量。世界上还有很多更好的“训练数据”,比如经典书籍、真实的人和真实的事情。
互联网已经让知识变得前所未有地容易获取。问题早已不是有没有知识,而是我们能不能抵抗短期诱惑,把时间交给更有价值的输入。
而在后训练上,我做得更差。最主要的问题不是不会复盘,而是很多行动根本没有开始。这件事我已经写过很多次,却一直迈不开步伐。
所以,对我来说,接下来最重要的任务不是继续收集更多道理,而是去实践,去和人沟通,去使用以前学过的知识;做完以后接受真实反馈,再回头重看、重听和重新理解。要是还能找到志同道合的人,彼此交流和纠正,那就更好了。
学习不是一种情怀,也不只是“今年读五十本书”这样的数字。真正有效的学习,是选择更好的输入,在真实世界中行动,得到反馈,然后不断修正。
预训练决定你偶尔能做到什么,后训练决定你平时能做到什么。
我们学习那么多知识,不是为了把它们陈列在脑子里,而是希望有一天现实突然出题,只出一道,只考一次,我们也能稳稳接住。