真正的成长,是允许现实改写自己

很多时候,别人指出我的错误时,我的第一反应并不是接受,而是为自己辩护。

过一会儿,情绪下去了,我才有可能意识到:对方说得或许没错,刚才真正阻止我承认错误的,不是道理,而是本能。

这类经历让我逐渐意识到,一个人知道自己应该变得更好,和他真的发生改变,中间还有很长的距离。我们可以读很多书、做很多反思、给自己贴上“终身学习”的标签,但真正遇到事情时,接管行为的往往还是过去形成的反应模式。

最近重读《万维钢·现代思维工具100讲》中的《内核:你的三个「自我」》,里面提供了一个很有意思的解释框架:人可以被理解为有三个不同层次的自我——进程自我、界面自我和内核自我。

这个模型不一定是关于“自我”的最终答案,却让我更清楚地看到:为什么有些改变只停留在想法上,有些改变却能慢慢进入一个人的性格。

我们以为在反思,可能只是在查看日志

进程自我,是我们此时此刻感受到的念头、情绪和反应。

我在生气,我有点焦虑,我刚才那句话是不是说重了,我为什么又拖延了——这些感受都是真实的,但按照原文的比喻,进程自我更像系统运行时产生的日志。它记录了正在发生什么,却未必是真正做出决定的人。

这解释了一个很常见的现象:事情发生以后,我们可以把自己的反应分析得头头是道,下一次遇到类似情况,却还是重复原来的动作。

因为看见日志,不等于修改程序。

我第一份工作期间,有一段时间很害怕看到微信消息。只要手机响了,我就担心又是公司的事情,甚至不敢马上打开。回避消息能够暂时降低焦虑,却没有改变我对那份工作的判断,也没有解决让我焦虑的处境。

人面对不想接受的现实,最容易做的就是移开注意力:不看、不听、不承认。稍好一点的办法,是绕开会让自己难受的场景。但有些事情终究躲不过去。真正困难的,是承认自己的预测错了,然后修改对世界的理解。

人设在顺境中好用,压力会让内核接管

界面自我,是我们在不同情境中展示出来的角色。

在面试时,我们会组织一套自我介绍;面对领导、朋友和家人,我们也会调用不同的表达方式。一个平时内向的人,可以要求自己在某个场合表现得外向;一个情绪激动的人,也可以提醒自己先显得冷静一点。

原文把这种界面自我比作 AI 的系统提示词,我觉得很形象。好的提示词能够让模型暂时呈现出某种角色,却不会因此改变模型本身的能力。

人也是一样。我们可以告诉自己“我要成熟”“我要表里如一”“我要做一个知错能改的人”,但这些话更像是给自己写的提示词。环境温和时,它们可能有效;一旦进入高压状态,最后接管局面的还是更深层的反应模式。

比如,有些人说自己性格强势,却只敢对愿意包容自己的人强势,面对真正有权力的人反而非常客气。在我看来,这不是性格强势,而是欺软怕硬。一个人怎样介绍自己并不重要,他在面对比自己弱势的人时怎么做,反而更能说明问题。

我也会在生气以后,惊讶自己为什么说出了那样的话。那一刻,人设没有消失,只是它的约束力不够强。高压让表面的角色退了下去,也让更真实的反应模式暴露出来。

真正的改变,是修改那个做出预测的自己

在这个模型中,内核自我是由先天条件和长期经历共同形成的一套预测模型。它包含一个人对世界的默认判断:什么是机会,什么是威胁;遇到挫折时应该反击、逃跑,还是直接放弃;别人提出不同意见时,应该好奇,还是先保护自己。

如果把人类比成 AI,进程自我是一次运行中的输入和输出,界面自我是临时写入的提示词,内核自我则更像模型的参数。

真正的成长,不只是换一种说法,也不只是短暂控制住一次情绪,而是让新的经验逐渐改写这些参数。

这件事当然很慢。一个成年人很难因为听过一句道理,就立刻变成另一个人。别人也很难靠劝说直接改变他。改变只能由他自己发起,并且需要一次又一次真实反馈。

但很难改变,不等于不能改变。

这些年,我的脾气比以前好了一些。这个变化并不是因为我突然想通了某个道理,而是在一次次情绪上头、事后后悔、重新理解之后,才慢慢发生的。直到现在,当别人当面指出我的错误时,我的本能有时依然是辩护。区别只是,我开始尝试在听到消息和做出反应之间,留出一点时间,让理性有机会介入。

这短暂的停顿看起来很小,却可能是修改内核的入口。

强化什么,最终就会成为什么

原文认为,影响内核的两个重要因素,是训练数据和奖励函数。

一个人长期看什么、听什么、和什么人相处,就是在持续给大脑提供训练数据。情绪化、碎片化的信息看得越多,大脑就越擅长用情绪和简单对立理解世界;长期接触愿意讲事实、接受纠正的人,我们也更可能形成相似的习惯。

我不刷抖音,一部分原因就是不想让自己长期沉浸在那种信息环境里。但我也必须承认,不刷抖音不代表自己的输入就足够好。很多时候,明明有更有价值的知识在等着我,我还是会选择那些更轻松、更不费脑子的内容。

环境会训练我们,逃避和拖延同样会训练我们。每一次为了舒服而避开困难,都在强化“遇到压力就绕开”的反应;每一次面对错误仍然努力承认,也在强化另一种可能。

奖励函数则决定了我们认为什么才算做得好。如果写文章的标准只是“写完了”,我们会越来越擅长完成任务;如果标准是“陌生读者能不能看懂,并愿意讨论和转发”,我们才会开始在意表达是否真的对别人有用。

强化什么,最终就会成为什么。

终身学习,不只是终身摄入新知识

我一直希望自己成为一个终身学习的人。过去我对这件事的理解,更多是愿意接受新事物、不断学习新的知识和工具。

现在我觉得还应该再加上一条:让自己始终处于可以被更新的状态。

所谓可以被更新,不是别人说什么都接受,也不是遇到挫折就全盘否定自己。它是当自己的预测与现实发生冲突时,先承认现实不会为了维护我的自尊而改变,然后认真判断,到底是哪里出了问题。

现实永远可能打脸。有人会选择不看证据,有人会绕开类似场景,也有人愿意承认“原来我是错的”,让这次失败真正改变下一次的判断。

一个人能选择的处境并不总是很多,但在仍然存在的选择里,不选择同样是一种选择。我们无法决定自己的全部训练数据,也无法清除过去留下的所有参数,但仍然可以决定,接下来允许什么持续训练自己,以及怎样回应下一次来自现实的反馈。

真正的成长,或许不是终于拥有了一个完美而稳定的自我,而是无论到了什么年纪,都没有把自己的内核彻底冻结。