大脑表征的多峰性
有些心理状态,我们最想解释,偏偏最解释不动。
躁狂里,许多互不相容的念头同时活着,谁也压不倒谁。解离里,那个"我是某个具体的人"的统一感整个缺席了。还有一种更原始的、"尚未分化"的状态——就是事情还没有塌缩成一个确定答案之前的那一层。这些状态表面上很不一样,底下却是同一副骨架:它们都没有单一的答案。
而恰恰是这一点,让当代神经科学里最主流的一套大脑理论,在结构上没办法老实地描述它们。注意,这里说的不是"还没研究透",而是更彻底的东西:在它的数学里,根本写不下"没有单一答案"这件事。这篇东西想讲清楚的,就是这个"写不下"是怎么回事——它从哪来,为什么要命,以及它最后怎么绕回来,变成一个关于这套理论自己的、有点瘆人的笑话。
先说这套理论。它叫预测加工。核心图像很简单,甚至很美:大脑不是被动接收世界,而是不停地猜。它对"外面是什么"持有一个猜测,用这个猜测去预测接下来的感觉输入,再拿预测跟实际一比,差出来的那部分——预测误差——反过来推动它修正猜测。看见、听见、感到,在这个图像里都不是"接收",而是"猜测被误差反复打磨"的过程。它现在几乎统治了认知神经科学,因为它能写成漂亮的方程,方程还能解。
问题就藏在"还能解"这三个字里。
要把这套图像变成能算的方程,你得先决定:大脑那个"猜测",在数学上长什么样。想象大脑的信念是一片地形,哪里隆起一座山,就表示它觉得答案大概在那儿。一个很笃定的信念,是一座又高又尖的山;一个很模糊的信念,是一座又矮又平的山。那一个"在两种可能之间撕扯、拿不定主意"的信念呢?那是两座山。
现在,主流做法在这里玩了一个手脚,叫拉普拉斯近似。它嫌真实的地形太难算,就把它换成一座光滑的单峰山——具体办法是:只看地形最高的那个点,在那附近,把它当成一只倒扣的碗,也就是一条抛物线。而抛物线,你怎么掰,都只有一个顶点。它在数学上不可能长出两个鼓包。
这一步的分量,值得停下来掂一掂。那座单峰山,不是算出来的结果,而是算法用来搭建自己的材料。换句话说:你一旦用了这个近似,"在两种可能之间撕扯"就不再是大脑能够被描述成所持有的信念了。不是"大脑权衡了两个、挑掉了一个"——是这套数学里,压根没有"两个"的位置。而我们平时说的"信心""确定度"(术语叫 precision),在这套框架里,字面意思就是"那座唯一的山有多尖"。你能做的全部,只是把这一座山调尖、调钝。你没有任何地方,可以写下"其实有两个答案"。
你也许还抱一丝希望:就算只能用一座山,那它至少公道吧,会落在两座真山的中间,好歹把两边都照顾到?不会。这套数学挑那座单峰山的方式,本身带着偏向:面对两座山,它不取中间,而是死死咬住其中一座,主动无视另一座——因为它的构造,就是要躲开两山之间那道低谷,绝不在那儿放分量。于是毛边被删了两遍:第一遍,在你决定只用一座山的那一刻;第二遍,在它挑山的时候——它不和稀泥,它选边站,然后把落选的那座抹掉。(顺带说一句,反着挑的话会犯相反的毛病:把一座宽得离谱的山摊在所有峰上,糊成一团什么都盖住、什么都不准的东西。两种都不诚实;但主流用的这一种,是专门删峰的那一种。)
讲到这儿,一个尴尬的方法论问题就浮上来了。这些年有大量实验,声称证明了"大脑表征概率""神经元编码不确定性"。它们怎么证的?做法几乎千篇一律:先假定大脑的信念是那座单峰山,再把山的位置和宽窄拟合到神经数据上,然后展示——你看,拟合得挺好,而且山的宽窄会随任务难度变。可这种实验不可能发现两座山,因为从一开始,"两座山"就不在它能返回的答案清单里。这就像你只拿一把圆规去测一样东西是不是圆的——圆规只画得出圆,你当然永远只能确认"是圆的"。所以这个领域每一次"实证确认"了单峰图像,确认的结果从一开始就被钉死了。不是有人作假,是工具的形状决定了它只能交回这一种东西。
那么——单峰到底是关于大脑的事实,还是只是"我们碰巧只解得动这种数学"留下的人工痕迹?这个问题听起来像反问,但它其实有个能演示出来的真答案。
因为存在一种完全不同的设想,叫采样假说。它说:大脑表征一个信念,不靠把山的形状存成几个数,而靠随时间抽样——神经活动那种时时刻刻的闪烁、起伏,本身就是大脑从它的信念里一次次抽出来的样本。而一个靠抽样的码,可以是两座山的:要是信念真在两个答案间撕扯,活动就会在两个状态之间来回跳,你把时间拉长一看,它在两边都待过。大自然恰好给了我们一个完美的试验场:双稳态知觉。内克尔立方体、那张一会儿是花瓶一会儿是两张脸的图、旋转的舞女剪影——都是你的大脑能读成两种样子、并且会在两种读法之间翻来覆去跳的图像。而当人看这类图时,神经活动确实在两种解释之间跳。这种跳,正是单峰山的码无法表征、而抽样的码自然就能表征的东西。
于是关键的一锤落下了:换一种数学,单峰性就消失了。这意味着,单峰性从来就不是关于大脑的——它只是关于那一种做数学的方式。被锐化的,是方程,不是心智。那个反问,到此有了一个不靠嘴皮子的答案。
现在回到最要命的地方,也就是开头那些状态。
主流理论讲精神病,讲的是一套"信心旋钮拧错了"的故事。把"先验"那个旋钮拧得太笃定,自上而下的信念就压过感官,于是幻觉。把"预测误差"的信心拧异常了,大脑为了安顿那些莫名其妙显得很重要的误差信号,就长出妄想来给它们一个位置。解离,被读成某种把自我模型和身体绑定解开的旋钮故障;躁狂,被读成全局增益、全局信心被整体抬高。请注意:这里每一个,都是一座仍然单峰的山上的一个数。形状永远是对的(一座山),错的只是它的尖钝。
可我们真正在意的那些体验,偏偏是没有单一答案的状态。解离,是那种"我是某个人"的统一感的缺席;躁狂,是许多互不相容的框架同时活着、谁也不赢;"未分化",字面上就是塌缩成一个答案之前的那一层。把"这里没有单一的峰"描述成"这里有一座单峰山、只是尖钝调错了"——这是一个被焊进数学里的范畴错误。这套框架能上下调节塌缩的尖度,却既无法表征塌缩失败,也无法表征塌缩变成了好几个。于是它能给这些状态的全部词汇,被结构性地锁死在"你对某一件事的确定度没校准好";而真实的失序,也许根本是"某一件事这件事本身,散架了"。它漏掉的不是某个细节,是那个状态之所以成其为那个状态的全部东西。
讲到这儿,该把最硬的几个反驳请上台,否则只是自说自话。
第一个,也是最硬的。理论的辩护者会说:分层模型可以跨层表征两座山,哪怕每一层各自都是单峰的——高层的一座山,可以用来代表低层的一个"混合";带非线性的生成模型,完全能产出两座山的预测。所以"用了单峰的家族"并不严格等于"信念就是单峰的"。这是真的,而且重要,得老实认。但要害在于:大脑被认为拿来当作自己信念的那个东西——它对"是什么在引起我的感觉""我身上正在发生什么"这个原因的判断——在标准讲法里,仍然是那座单峰山。而临床体验,恰恰活在这一层。所以这个辩护软化了指控,却化解不掉:你能从一个单峰的"关于原因的信念",推出一个两座山的"关于数据的预测";可那个关于原因的信念——病理所在的那一层——还是单峰的。
第二个,实用主义辩护,有意思的是它反过来帮了倒忙。大脑必须行动,行动必须承诺到一个答案——你没法同时去够两个杯子。所以也许单峰塌缩不是 bug,而是大脑也面对的真实约束,拉普拉斯只是对一个真瓶颈的仿生。反驳很干脆:必须单峰地行动,不等于必须单峰地表征。把这两件事混为一谈,正是这套话术要打击的那个偷换。一个系统完全可以维持一个两座山的信念,然后从里头抽样出一个动作来——采样的码做的就是这件事。所以实用主义辩护非但救不了拉普拉斯,反而支持了采样这个替代方案:单峰性是输出端的事,不该回灌进表征端。瓶颈是真的,只是它被装在了错误的楼层。
第三个,社交场上最常听见的一句:"大家都知道拉普拉斯只是个方便,没人真信大脑是高斯的。"反驳是:指控咬住的,恰恰就是那个"回推到大脑"的步骤——"我们发现了大脑表征了一个后验"。它把"方便"洗成了"本体"。"这只是个近似"这句免责声明救不了你,如果你的方法只能交回这个近似——那每一次"确认",都是事先装好的。这句声明,社交上为真,方法论上没用。
退一步看,这一切有个更深的名字。挑哪个数学家族,起的作用,像一副你摘不下来的眼镜。它不裁决什么是真的,它裁决什么能够作为一个候选,出现在你眼前。两座山,从来不是被这个模型判为假——它压根没机会成为一个"可能为真的东西"被模型考虑。这正是"一个经验主张"(这信念碰巧是单峰的)和"一个先天的、构成性的约束"(单峰是任何信念想进这个系统必须采取的形状)之间的差别。康德当年管这种摘不下来的眼镜叫"直观的形式"。整段论证的脊梁——"锐化先于经验""被假设排除掉的,不是被计算压下去的"——说的就是这个区别。
而生物学,做的是一模一样的动作。
大脑里有一类抑制性神经元,这里有两族要紧。PV 细胞(小清蛋白)放电极快,在胞体周围狠狠一夹,管增益、管时序、把调谐削尖——它实现的是"赢者通吃"和"除性归一化",后者翻译成人话就是:当好几群神经元同时活跃,把主导那群之外的全压下去。SST 细胞(生长抑素)瞄准细胞远端的树突,管哪些自上而下的、情境的输入能放进来。两者合起来,侧向的和反馈的抑制,实现了一场朝单一赢家收敛的竞争。
而对应是字面的,不是比喻:一群神经元若有好几个活跃的鼓包,本可以表征一座两山的信念——多个鼓包,就是多个还活着的假设。抑制把主导鼓包之外的全部碾平。于是你能逐词列出一本词典:多个鼓包 ↔ 两座山的信念;PV/SST 碾掉非主导的鼓包 ↔ 数学塌缩到单一众数;幸存鼓包的增益 ↔ 信心、precision。在这本词典底下,"两个层级在描述同一个动作"这句话,是字面成立的,不是修辞。生物用细胞来锐化,数学用抛物线来锐化——同一个动作,两层皮。
还有一个收得几乎太整齐的事实,我得摆出来、同时如实给它贴上标签。破坏 PV 细胞,恰恰牵连到上面那些临床状态——精神分裂症里 PV 中间神经元功能减退,是这个领域最稳健的发现之一。如果你把它读成"锐化机器坏了",那么一条对称就闭合了:生物的锐化器失灵 → 临床状态,正好映射到数学的锐化器无能 → 建模不了那个状态。数学建模不了的那个状态,恰恰是生物学指着说"这是锐化器坏了"的那个状态。但得诚实:PV 跟精神分裂的关联是稳健的;把它解读成"单峰化的丧失",是一个理论读法,自洽得叫人心动,却还不是被确立的事实。别把这条对称的优美,当成它的证据。
那么,这一切到底给不给一个能被推翻的预测,还是只是一句聪明的牢骚?它给一个,而且为公平起见,我得说清"失败"长什么样、什么不算失败。它会长成这样:那套"信心旋钮"的躁狂/解离叙事,会需要越来越多临时加上去的补丁——多个信心参数、分层信心、随情境变的增益——而这些补丁只会累积,绝不收敛:每来一个新的临床异常,就靠再添一个数把它安顿掉,而不是靠结构上的改变。这正是科学哲学里说的"退化纲领"的签名。而竞争的那个预测是:一个允许两座山的框架(采样、混合、更灵活的家族),会用更少的旋钮、更自然地抓住这些状态。所以可被推翻的赌注是比较性的:在这些现象上,单峰版的预测加工是那个退化的纲领,多峰版的推断是那个进步的纲领。也得诚实:这很难干净地裁决,因为"信心加权"这套叙事太能变形、临床数据太吵,"系统性失败"多半是缓慢的、可争的,而不是一记利落的 KO。这是那种要在一个研究纲领的整个寿命尺度上、而不是在单个实验里见分晓的预测。
现在,整件事开始朝自己身上折回去了。
这套理论说:内省、知觉,拿过一个丰富的、高维的、可能有两座山的内在状态,然后汇报出一个锐化过的摘要——就是你意识到的那个知觉内容。而这套理论本身,拿过大脑那个丰富的、可能有两座山的推断状态,把它建模成一个锐化过的摘要——那座单峰的后验山。理论和它所解释的对象,长着同一个形状:两者都是删掉多峰、把单峰当作基准真相汇报上来的锐化机器。
这不只是个俏皮的巧合,它以一种很具体的方式腐蚀了这套理论认识自己的能力。它意味着:这套理论会系统性地对那个唯一能证伪它的残渣视而不见,因为它自己的表征装置,和它所建模的内省装置,共用同一个盲点。如果内省看不见锐化之前那一层,而内省的理论也无法表征锐化之前那一层,那么这套理论永远不可能用内省数据来发现自己的不足——错误从内部就是不可见的。这个盲点是自我封闭的。
出口是改变形式——采样,两座山的信念。而"改变形式是可能的、并且一旦改了单峰性就消失"这件事本身,就是那个证明:单峰性原本是形式的人工痕迹,不是大脑的事实。你可以指控内省对"锐化之前那一层"做的事——删掉毛边、把单峰当真相报上去——这套理论,对它自己的后验,逐字做了一遍。
唯一的区别在于:理论这一次删掉的东西,我们有办法从外面看见。内省的盲点,也许从内部永远焊死;但拉普拉斯的盲点,被一个非参数的解码器、一次双稳态实验、或者仅仅一句"就照这个躁狂状态本来的样子去相信它",就能从外头照亮。
这,是这整场镜厅里,仅剩的、也是唯一真实的不对称。