all_lessons/饮品的逻辑/03第 4 课 / 共 23 课

第一部分 · 为什么不只喝水

苦为什么会被爱上:先天怕苦,后天学会

上一课我们发现,人类最普遍的「多喝一杯」,是为了一个分子:咖啡因。它不给你能量,只是挡住大脑里「该休息了」的信号;身体习惯了它,停下来反而难受。可这个分子有个麻烦——它是苦的,装着它的茶和咖啡也是苦的;而苦,是身体生来就有的一道警报。那么多人每天主动端起一杯苦的东西,这份苦是怎么被爱上的?

被什么逼出咖啡因是苦的,而苦是身体天生的毒物警报。几十亿人却每天主动去喝苦的东西——这份苦是怎么被爱上的? 本课怕苦是天生的:人只有约 25 种苦味受体,新生儿一尝到苦就张嘴皱脸。爱苦是学出来的:每喝一杯,大脑都在记「这个味道之后跟着什么」,咖啡因解除戒断的那份回报,一杯一杯把苦标成了好东西。糖、盐、奶先把苦压下去,让人肯喝下一杯,回报再接手。 逼出下一课我们爱上的是苦背后那份回报。可咖啡因和风味锁在一片干叶子、一颗硬豆子里。热水怎么把它们拿出来,又为什么拿出来有先有后? → 04
科学小注
这一课最关键的证据,来自一个只有 36 个人的小实验:Yeomans 等人 1998 年让一夜没碰咖啡因的人,在 4 次早餐时喝一种从没喝过的果茶——茶里加了咖啡因的那组越喝越喜欢,没加的那组越喝越不喜欢。本课的模拟器是一个示意的学习模型,灵感来自这个实验:它用心理学里描述条件学习的 Rescorla–Wagner 式规则,每喝一杯,就把大脑对「这个味道之后会发生什么」的估计,朝这一杯实际带来的回报挪一步。苦度、遮盖、回报大小、学习快慢、「放弃线」都是示意常数——曲线说明的是方向和形状,不是哪个人要喝几杯才会爱上咖啡。
本课路线
(1) 苦是警报:25 个探头,盯着成千上万种分子。 (2) 天生的:出生两小时,就会怕苦。 (3) 可是人每天都在喝苦的东西。 (4) 大脑怎么学会:苦后面跟着什么。 (5) 先把苦压下去:糖、盐、香和奶。 (6) 动手:学会喜欢一杯苦东西。 (7) 一条从甜走到苦的路(中国版)。

一、苦是警报:25 个探头,盯着成千上万种分子

先回到上一课。咖啡因在植物里,本来可能是一种天然的杀虫剂:在植物里常见的浓度下,它和它的同类就能让昆虫不愿意吃、甚至中毒(Nathanson,1984)。如果它真是植物用来对虫子说「别吃我」的分子,那它尝起来是苦的,也就不奇怪了。

舌头上负责「苦」的,是一个受体家族,叫 TAS2R(第二类味觉受体)。人能尝出成千上万种化合物是苦的,可这个家族只有大约 25 个成员。2010 年,Meyerhof 等人把 25 种人类苦味受体一个个装进培养的细胞里,拿 104 种苦味物质挨个去试:

读这组数字,苦味系统不像一台分辨「这是哪一种苦」的精密仪器,更像几个口径很宽的探头:不管来的是哪种分子,只要像是「植物的防身武器」,就拉同一个警报。咖啡因就踩中了不少探头——细胞实验里,TAS2R7、TAS2R10、TAS2R14、TAS2R43、TAS2R46 这 5 种受体都对它有反应(Suess 等,2018)。约 25 个里占了 5 个,大约五分之一的苦味受体都认得它。

警报的意思很简单:这东西可能有毒,先吐出来再说。要理解后面的一切,得先承认这一点——一杯黑咖啡、一壶浓茶,在舌头看来,首先是一个危险信号。

二、天生的:出生两小时,就会怕苦

这道警报不用学。1988 年,Rosenstein 和 Oster 给 12 个出生才两小时的新生儿,分别尝一点蔗糖、盐、柠檬酸和奎宁(一种很苦的物质),录下每个孩子脸上的表情:

尝到的新生儿的脸
甜(蔗糖)面部放松,开始吮吸
酸(柠檬酸)嘴唇撅起,负面的表情
咸(盐)负面的表情
苦(奎宁)负面的表情,把嘴张开

新生儿已经能把甜和「不甜」分开。2001 年,Steiner 等人把同样的对比放到更大的范围里:人类新生儿和 11 个物种的 27 只非人灵长类动物,尝到蔗糖时都出现相似的「喜欢」表情,尝到奎宁时都出现相似的「厌恶」表情;物种之间亲缘越近,表情越像。

这说明两件事。第一,甜是天生的奖赏,苦是天生的警报,而且这套反应很古老,不是哪种文化教出来的。第二,所有爱喝咖啡、爱喝浓茶的成年人,都是从这张「张嘴、皱脸」的新生儿面孔出发的。这门课把它压成一句话:苦要学,甜天生。

三、可是,人每天都在喝苦的东西

警报这么古老,按理说人应该躲着苦走。可看一眼数字:

这两种苦的植物水,每天被成批地、主动地喝下去。天生的警报和每天的选择,正好相反。怎么解释?有三个候选答案,可以一个一个排除:

?「爱喝的人天生不怕苦」——第二节的新生儿,尝到苦都是负面的表情,爱喝苦的成年人也是从那张脸出发的。人和人对苦的敏感度确实不一样(下一节会说),可那是苦的程度不同,不是把苦当成了奖赏。
?「喝多了就习惯了」——如果只是多接触几次就会喜欢,那么不管杯子里有没有咖啡因,越喝都应该越喜欢。下一节的实验恰恰发现:没有咖啡因的那一杯,越喝越不喜欢。
!「学会了:苦后面跟着好处」——剩下的解释是,大脑把这个苦味和它之后带来的东西记在了一起。这个「好处」是什么,又是怎么记住的,是下一节的事。

四、大脑怎么学会:苦后面跟着什么

关键实验就是开头科学小注里那一个。1998 年,Yeomans、Spetch 和 Rogers 找来 36 位平时适量摄入咖啡因的人,请这些人从前一晚起不碰咖啡因,第二天早餐时喝一种从没喝过的果茶;这样的早餐一共做 4 次。一组的茶里加了 100 毫克咖啡因(和一杯咖啡差不多:按美国农业部数据换算,240 毫升滴滤咖啡约 96 毫克),另一组没加:

为什么偏偏是一夜没喝的人?作者的解释叫负强化:回报不是「多了一点快乐」,而是「少了一点难受」。第 02 课讲过,习惯喝咖啡因的人停下来,12–24 小时就开始出现头痛、困倦、提不起劲这些戒断症状,低到每天 100 毫克的量也会出现;而躲开戒断,正是人习惯性地每天去喝的核心原因之一(Juliano & Griffiths,2004)。一夜不喝,正好把人送到这个窗口的门口;早上那杯茶让难受退下去,大脑就把「这个陌生的味道」和「难受消失了」记在了一起。没有咖啡因的那组,喝完照样难受,于是这个味道被记成了「没用的东西」,越喝越不喜欢。

把这种学习写成一条规则,就是心理学里描述条件学习的经典写法(Rescorla–Wagner 规则):大脑对「这个味道之后会发生什么」有一个估计,记作 V;每喝一杯,看看实际得到的回报 R 比估计的好还是差,就把 V 往那个方向挪一步。估计得越离谱,挪得越多;估计准了,就不再挪。

喜好 = 舌头此刻的评价 h + 学到的回报 V 每喝一杯:V ← V + α ×(这一杯的回报 R − V)

注意这条式子里的分工。h 是舌头此刻的反应:苦就是负的,甜就是正的,不用学,当场就有。V 是大脑攒下来的东西,要一杯一杯地挪。苦本身没有变,变的是这个苦在大脑里的意思——从「可能有毒」变成了「接下来会舒服」。

每个人的起点不一样
能不能尝出一种叫 PTC(苯硫脲)的苦味物质,主要由 7 号染色体上的一个苦味受体基因决定,后来它被命名为 TAS2R38。这个基因上三个位点的差别,组合出世界各地常见的 5 种版本;它们完全解释了人群为什么分成「尝得出」和「几乎尝不出」两类,并解释了 PTC 敏感度差异的 55%–85%(Kim 等,2003)。PTC 不是咖啡因,这项研究不能直接告诉你谁更爱喝咖啡;它说明的是:同一杯东西,落在不同的舌头上,苦的程度本来就不一样。在下面的模拟器里,这相当于每个人的「苦度」滑块停在不同的位置。

五、先把苦压下去:糖、盐、香和奶

上一节的式子还藏着一个麻烦:V 要一杯一杯地攒,可第一杯的时候 V 还是零,喜好全靠舌头此刻的评价 h。照这条式子推下去:如果第一杯苦得太厉害,很可能就没有第二杯——学习还没开始,就结束了。所以,在回报接手之前,得有人先把 h 抬起来。办法有好几种:

下面的模拟器把这些办法合成一个旋钮,叫遮盖 m:遮盖越多,苦被压下去越多,同时奶和糖自己也带来一点天生就喜欢的味道。

舌头此刻的评价 h = − 苦度 b ×(1 − m)+ 0.5 × m

请注意遮盖在学习里扮演的角色:它不是让人学会爱苦的原因,回报才是;它是让人肯喝下一杯、给回报留出时间的那座桥。

六、动手:学会喜欢一杯苦东西

这个模拟器让一个人连喝 40 杯同一种饮品。你来定这杯东西有多苦(苦度 b)、加多少奶和糖去遮盖(m)、里面有没有咖啡因;还可以打开「每 5 杯减一点奶」,让遮盖每 5 杯减掉起始量的六分之一,第 31 杯起就什么都不加。每一杯,模型先算舌头此刻的评价 h,再加上学到的回报 V,得到这一杯的喜好;喝完,V 朝这一杯的回报挪四分之一:有咖啡因时回报记作 +1(解除了戒断),没有时记作 −0.3(喝了照样难受——对应 Yeomans 实验里没加咖啡因那组的下滑)。模型还多加了一条示意的假设:连续两杯喜好都低于 −0.5(放弃线),这个人就不再喝了。现实里人会不会放弃、在哪里放弃,因人而异;这条线只是让「第一口太苦」的后果在图上看得见。

学会喜欢一杯苦东西:40 杯里的喜好曲线
先点「陌生果茶+咖啡因」:仿 Yeomans 的设定,第 1 杯喜好 −0.15,第 2 杯就越过零线。再点「同一杯,不含咖啡因」:喜好一路往下掉,第 40 杯是 −0.45,40 杯都没越过零线。然后点「第一杯就喝黑咖啡」:苦度 0.8、不加遮盖,前两杯都在放弃线以下,第 2 杯后这个人就不喝了——回报还没来得及教。点「先喝奶咖」(遮盖 0.6):第 1 杯差一点(−0.02),第 2 杯就越过零线。最后点「奶咖,每 5 杯减一点奶」:第 31 杯起已经是黑咖啡,第 40 杯的喜好仍是 +0.20。这时再把「含咖啡因」关掉,看看同样的减奶计划会怎样。
第几杯开始「喜欢」(喜好 > 0)
—
第 40 杯的喜好
—
最后一杯喝的是
—
学到的回报 V(最后一杯)
—
—

玩上几圈,这一课的逻辑就摆在图上了。蓝色的喜好线,是橙色虚线(舌头此刻的评价)和紫色虚线(学到的回报)相加:舌头的那一半当场就定了,回报的那一半要一杯一杯攒。没有咖啡因,紫线往下走,再怎么喝也只会越来越不喜欢——「多喝几次就习惯了」在模型里不成立,在 Yeomans 的实验里也不成立。有咖啡因、却从黑咖啡开始,橙线一开始太低,人在紫线升上来之前就放弃了。先加遮盖,橙线被抬到零线附近,人肯喝下去,紫线很快升起来;之后每 5 杯撤掉一点奶,橙线一级一级往下走,可紫线已经升到快到顶,蓝线始终没跌回零线以下。你最后喝的是黑咖啡,喜欢却留了下来。反过来,同样的减奶计划,把咖啡因关掉,模型里这个人第 12 杯后就不喝了:桥撤了,却没有老师。图下那一排小方块,是每一杯加了多少遮盖:颜色越浅,加得越多。

模型里有一条值得点破的假设:学到的回报挂在「这个味道」上,奶多奶少它都认得。现实里,加了很多奶的一杯和一杯黑咖啡毕竟味道不同,学到的东西能「搬」过去多少,要打个折扣。所以这个模型说明的是方向——遮盖是桥、回报是老师——而不是「减奶计划」的配方。

七、一条从甜走到苦的路(中国版)

有了这张图,再回头看中国的咖啡。下面三件事都有出处:

把这三件事按时间排起来,像不像模拟器里那条「先加遮盖、再一点点撤」的曲线?先用甜和脂肪把苦压到人肯喝的程度,再让咖啡因的回报慢慢接手——三合一是遮盖最多的那一端,加奶加椰的现磨拿铁往黑咖啡挪了一步。

这是一个假说,不是结论
上面三条数据和「甜和脂肪当桥」的读法相容,但它们证明不了这条因果。同一段时间里,价格、便利、门店多少、收入和生活方式也都在变,这几组数字分不开它们。要真正检验这个假说,得追踪同一批人:这些人杯子里的奶和糖,是不是随着年头在变少?这门课没有找到这样的数据。所以请把它当成一种读法——它把第 02 课的回报、本课的学习和第 11、12 课的甜与奶串在了一起——而不是一个已经被证明的故事。

这个读法还给了一个可以拿来检验自己的预测:如果「桥」的说法对,那么一个人第一次喝咖啡时遮盖越多,越不容易在头几杯就放弃;而一旦咖啡因的回报学会了,撤掉一部分遮盖,喜欢也不会马上消失。下次你看到一个人从三合一换成拿铁、又从拿铁换成美式,可以想一想:那条紫色的线,大概已经升到很高了。

回到主线
一杯饮品,主角是水;人回来要的,是溶进去的那一小撮。这一课看清了那一小撮里两样东西的分工:糖靠味道讨好你,舌头当场就给奖赏,不用学;咖啡因不靠味道讨好你,它甚至是苦的,可它带来的回报(解除戒断)会一杯一杯地教你,把这个苦记成好东西。苦要学,甜天生——照这个道理,一杯苦的饮品想让第一次喝的人留下来,最省力的路是先用甜和奶把苦送进门,再让咖啡因把人留住(这是推论,不是统计)。可这份回报,得先从叶子和豆子里被拿出来。

常见误解

一句话带走
怕苦是天生的警报,爱苦是学出来的:喜好 = 舌头此刻的评价 + 大脑学到的回报。咖啡因解除戒断的那份回报,一杯一杯地把苦记成好东西;糖、盐、香气和奶先把苦压下去,让人肯喝下一杯——遮盖是桥,回报是老师,桥撤掉了,喜欢还在。
下一步
我们爱上的是苦背后那份回报。可咖啡因和风味锁在一片干叶子、一颗硬豆子里。热水怎么把它们拿出来,又为什么拿出来有先有后? → 第 04 课《萃取:热水从植物里拿东西,有先有后》会把一撮叶子丢进热水,看里面的分子怎么先「溶」开、再「走」出来,为什么磨细一半就快了四倍——以及为什么在一杯咖啡里,咖啡因恰好在跑得快的那一组。