ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

知觉不是录像而是建构:从格式塔到自上而下加工,大脑如何自动脑补世界

知觉不是录像而是建构:从格式塔到自上而下加工,大脑如何自动脑补世界 1. “眼见为实”其实是一句谎言知觉不是录像而是脑内重建刚开始读《心理学导论》知觉这一章时我以为自己会看到一堆关于眼睛如何“拍照”、耳朵如何“录音”的机械描述。真读进去才发现整章的结论几乎是在颠覆一个常识我们所谓“看见的世界”根本不是外界直接投射进来的图像而是大脑根据零散、片面的感觉信号结合经验、预期和上下文现场“脑补”出来的一个模型。换句话说知觉不是从眼睛开始的而是从大脑的解释开始的。就像你在深夜看见衣柜角落有个黑影第一反应是“有人”打开灯才发现只是搭在椅背上的外套——灯亮之前那个“人”确实存在于你的知觉里。它不真实但对你来说它那一刻就是真实。这一章之所以让我觉得是整个导论里最值得反复读的部分就是因为它把“理解世界”这件事从被动接收变成了主动建构。我们以为自己在“看世界”其实是在“演算世界”。而这套演算的底层逻辑从视网膜的神经编码到大脑皮层的高层解释每一环都在改写原始信号。以下是我整理出的完整建构链条按从外到内的顺序一点一点拆开讲。2. 从光子到“看见”视网膜、感受野与神经通路的加工流水线2.1 感觉是原料知觉是成品先厘清一对最基础的概念感觉和知觉。教科书里的定义非常精炼——感觉是把物理能量光、声、压力转变成神经信号的换能过程知觉则是大脑对这些信号进行组织、解释赋予意义的过程。拿吃东西举例舌头上的味蕾把食物分子变成“甜、咸、酸”的神经信号这是感觉而你判断出“这杯饮料是焦糖拿铁、温度正好、能提神”则是知觉。这个区分不是学术抠字眼。它告诉我们知觉的第一步是纯粹的生理换能但真正的重头戏——组织、识别、赋予意义——发生在大脑皮层。所以当你看一幅画时视网膜做的只是把画上的光斑转成电脉冲真正“看懂”这幅画的是颞叶和顶叶的联合皮层。有意思的是感觉系统会忠实地把信号传上来但知觉系统却常常“不忠实”——它只看对自己有用的部分其余全部忽略。我做过一个印象深刻的自我测试在安静房间里盯着墙上的一张白纸然后闭上眼。纸本身不会留影但我脑子里会短暂保留它的“形状感”。这说明知觉不完全依赖当下输入还有记忆和期待的参与。这也为后面要讲的自上而下加工埋下了伏笔。2.2 感受野神经元不是像素而是特征探测器很多人把视觉想象成摄像机原理——视网膜上密密麻麻的感光细胞像CCD一样逐点采样然后拼成一幅完整的画面。这个类比在光电层面成立但在神经层面就大错特错了。视杆细胞和视锥细胞确实像像素但信号从视网膜往大脑传递的过程中每一级都在做“特征提取”而不是“像素搬运”。这里必须提到一个关键术语感受野。一个视觉神经元的感受野就是视网膜上能影响该神经元活动的区域。有的细胞只在感受野中心有光时兴奋有的细胞偏爱亮-暗边界还有的细胞对特定朝向的线条反应最强。我当年读到Hubel和Wiesel的经典实验时最大的震撼在于大脑不是逐点重建图像而是一层一层地检测“特征”——从点、到线、到边缘、到朝向再到更高级的复杂形状。这就像你读一篇文章时大脑不是在逐字扫描而是在抓取关键词、句法结构和语义线索然后直接“生成”理解。感受野的层级组合就是大脑从像素到模式识别的关键桥梁。2.3 侧抑制与马赫带为什么我们总能看清轮廓看过黑白条纹图案的人大多注意过一种现象两种深浅不同的色块交界处会有一圈特别亮或特别暗的“假线”。那就是著名的马赫带错觉。过去我以为这只是视觉系统的某种“小bug”实际上它是侧抑制的必然副产品而且恰恰是一项进化优势。所谓侧抑制是指相邻的神经元在激活时会互相抑制对方的反应。它的作用类似于图像处理里的锐化滤镜把边界处的信号差拉大让轮廓更清晰。没有这种机制我们看到的画面会像没对焦的照片一样模糊。这个机制让我重新理解了“清晰”的本质。清晰不是信号强而是信号之间的对比度。大脑在进化时选择了一条性价比极高的策略——与其精确测量每个点的亮度不如放大不同区域之间的差异。因为对生存来说知道“这里和那里不一样”比知道“这里的绝对亮度是多少度”重要得多。我们看世界不是在看绝对数值而是在看相对变化。2.4 双通路假设看得见“是什么”与看得见“在哪里”顶叶和颞叶是两条视觉加工通路的终点。教科书把这两条路概括为腹侧通路枕颞通路负责“是什么”——物体识别、面孔识别、颜色判断背侧通路枕顶通路负责“在哪里”或“怎么做”——空间定位、运动感知、伸手抓取时的视觉引导。这个区分在实际生活中比比皆是。你一眼认出桌上的马克杯是“什么”腹侧同时伸出手去拿它时能准确判断它的位置和距离背侧。我读到这里时恍然大悟难怪有些脑损伤患者能“看见”物体位置却认不出它是什么而另一些患者能认出物体却无法伸手抓住它。两条通路像两个独立的应用进程共享同一个摄像头但各做各的工作。我甚至怀疑日常中的很多“粗心”也和这两条通路的配合有关比如在厨房找半天酱油瓶明明就在眼前却看不见——很可能腹侧通路忙于识别“与酱油瓶相似的东西”而背侧通路压根没把它标定为“可抓取物体”于是大脑把它当背景忽略了。知觉从来不是全景扫描而是按任务定向筛选。3. 格式塔派的遗产完形倾向如何把碎片拼成场景3.1 整体先于部分为什么我们不会把世界看成碎片拼图格式塔心理学是知觉研究里最“反直觉”的一个流派。它的核心主张极其精炼知觉不是先感知部分再整合成整体而是先感知整体再从中分出部分。举例来说当你看见一辆行驶中的汽车你不会先看见轮子、车门、车窗再把它们组装成“车”。你最先感知到的是一个移动的、有边界的整体形状然后才会注意到具体细节。格式塔派把这称为“整体优先性”。这个观点直接影响了我看世界的角度。以前我觉得知觉像乐高拼图——细节拼在一起形成整体。格式塔理论则说恰好相反我们自带一套“完形倾向”的底层算法先自动把零散刺激组织成最大、最简、最稳定的结构再在这个结构里寻找细节。3.2 接近、相似、连续、闭合大脑的四大“自动编组”法则格式塔学家总结了一系列知觉组织法则我把最常用的四条列出来每条都配了一个生活中马上能验证的例子法则核心逻辑日常验证接近律空间上靠近的元素容易被归为一组地铁座位上一排人挨着坐你会下意识认为他们是同伴相似律颜色、形状、大小相似的元素容易被归为一组满屏图标里所有绿色图标看起来像一“类”连续律方向一致、能连成平滑路径的元素被归为一组虚线画成的曲线会被看成一条连续曲线而不是很多线段闭合律有缺口但形态完整的形状大脑会自动“补全”中间有断口的圆环你仍会把它知觉成一个圆刚读完这部分时我还不太服气觉得这些规则太过“显而易见”。但真到设计场景里去观察就会发现这些规则恰恰意味着大脑的默认设置不是“记录所有元素”而是“以最小代价把元素编组成可理解的结构”。换句话说解释和简化是知觉自动执行的动作你根本阻止不了。3.3 图底关系背景永远在“退后”焦点始终在“跳前”最经典的格式塔演示图像就是花瓶-人脸两可图。同一张图你看的是花瓶就自动忽略了旁边两个人脸轮廓你聚焦人脸花瓶就变成了一片背景。眼睛接收的像素完全没变变化的是大脑对图底关系的分配。我曾经花很长时间盯着这类两可图试图“同时”看见两种图案结果发现根本做不到——知觉系统会强制你二选一。这让我更深刻地理解了一个道理知觉不是被动呈现所有信息而是主动决定“什么重要、什么不重要”。图底关系在实用层面上极其重要。设计UI时一个按钮要被看见最关键的不是它多鲜艳而是它与背景之间有明确的图底分离。驾驶时路边的行人如果被“编组”进背景树丛的相似纹理中就可能产生著名的摩托车骑士视盲效应——不是因为眼睛坏了而是大脑把那个人“归类为背景”了。4. 经验、期待与上下文自上而下加工如何“篡改”知觉4.1 两种加工模式的区别数据驱动 vs 概念驱动知觉心理学里还有一对基础概念自下而上加工数据驱动和自上而下加工概念驱动。前者指由刺激本身驱动——光线进入眼睛特征被逐步提取形成知觉后者指由知识、经验、预期和语境驱动——比如你在水果店看到“橙子”两个字紧接着看到一团橘色模糊物体会立刻把它认成橙子哪怕它的轮廓并不完全清晰。这里的关键是几乎所有自然情境中的知觉都是两种加工的混合且自上而下加工所占的比重远比我们以为的大。看到一个场景大脑会先根据上下文快速生成一个预期模型然后用这个模型去匹配眼前的信号。匹配对了知觉就顺畅迅速匹配不上大脑要么修正模型要么把异常信号“扭曲”成符合预期的样子——这就为大量视错觉埋下了伏笔。4.2 语境效应实验同一个“13”为什么会被看成“B”教科书里有一个特别经典的例子数字序列“A、13、C”和数字序列“12、13、14”中同一个“13”在两种语境下会被分别知觉成字母“B”或数字“13”。字符本身的信号一模一样但大脑根据前后文强制改写了它的类别。我在日常生活中反复体验到这种效应。比如洗碗时看见瓷砖上有一小片水渍下意识看成了一只小虫。水渍的形状其实很模糊但大脑基于“厨房可能有虫”的预期瞬间把它归类成了“活物”然后你才真的看见了“脚”和“触角”——其实那些细节根本不存在。这种例子随手就能抓一大堆它们证明了一件事大脑不是在解释知觉而是在先猜、后看猜测被反馈信号修正后才形成稳定的知觉体验。4.3 设定效应与动机想看见什么就更容易看见什么除了上下文动机和意图也会自上而下地调控知觉。教科书里管这叫设定效应。最典型的是饥饿时更容易注意到食物广告、着急时更能感知到时间的流逝速度、夜里独自在家时任何细小的响动都会被知觉成“脚步声”。我曾做过一个简单但有趣的验证连续一周刻意训练自己“在人群里快速找穿红衣服的人”。结果一周后哪怕我在专注走路没有刻意寻找红衣服也会从视野里“跳”出来。不是我的视觉变敏锐了而是我的知觉系统把“红色”这个特征在注意力权重里调高了。这一点在运动会、设计工作、驾驶中都很实用——你期待看到什么就更可能看到什么。反过来如果你长期训练自己在杂乱环境中找危险特征比如消防员找烟雾、医生在X光片上找结节你的知觉阈值会系统性降低。5. 知觉的漏与洞错觉、盲视和面孔失认暴露的建构真相5.1 错觉不是“看错了”而是建构规则的副产品既然知觉是建构那它必然会有“过度拟合”或“误判”的时候。视错觉与其说是视觉系统的缺陷不如说是建构规则的例外输出它们恰好暴露了大脑的默认参数。以穆勒-莱尔错觉为例两条等长的线段一条两端是向外箭头一条两端是向内箭头后者看起来明显更长。我一开始以为这只是“装饰影响判断”后来才意识到这是深度线索的副产品——向内箭头的图形在线索上被解读为“近处的物体角”大脑自动把它补偿成更短的物体向外箭头被解读为“远处的物体角”大脑为保持恒定大小而将它在感知上拉长。艾宾浩斯错觉同理同样大小的圆被大圆包围看起来更小被小圆包围看起来更大。这也是大脑在根据周围参照物做大小恒常性补偿。错觉不是错误而是大脑深度计算引擎的“模式过度应用”。这也解释了为什么错觉很难通过“告诉自己这是错觉”来消除——你在对抗的是一个底层自动引擎而不是一个认知决策。5.2 盲视看不见却能避开障碍知觉建构论最令人震撼的证据可能来自一个叫“盲视”的病例。患者因枕叶初级视皮层V1损伤而失明主观上完全看不到任何东西。但当实验者让他们走过一个布满障碍物的房间时他们能闪避障碍、绕开物体动作流畅得像能看见一样。当他们被问“你怎么做到的”他们会一脸茫然地回答“我不知道只是感觉应该往那边走”。这个现象彻底颠覆了“看见有视觉意识”的常识。视觉信号在V1受损后并没有完全中断部分信号仍会沿背侧通路传递到顶叶为动作系统提供空间信息但没有进入意识层。也就是说你的身体“看得见”但你的意识“看不见”。知觉建构不仅发生在意识层面还发生在更低级的无意识加工环节。我们谈“理解世界”时往往只关注意识层面却忽略了支撑意识知觉的大量无意识运算。盲视告诉我的最重要一件事是意识层面的知觉只是整个建构过程的“冰山一角”大量的信号筛选、空间计算、特征比对都在后台默默运行且永远不会变成“看”这一体验的内容。5.3 面孔失认当“是谁”这一层建构失效另一个让我印象深刻的障碍是面孔失认。患者视觉基本正常能看见五官、会看颜色、能识别物体但无法通过面孔识别出“这是谁”有时连镜子里自己都认不出。他们的知觉建构在“物体识别”这一层是好的但在“个体识别”这一层断了。这让我意识到所谓“理解世界”并不仅仅是一个统一过程而是一套模块化流水线。每个模块负责一层建构——线条检测、形状识别、类别归类、身份匹配——模块之间某一环失效并不会摧毁整条流水线只会留下一个非常具体的知觉空洞。普通人之所以没有这种空洞不过是因为各模块协作无碍罢了。反过来这也说明我们每一个人对世界的理解都是建立在一套高度分工、互相协作的建构机制之上的从来不是浑然一体的“看见”。6. 把建构论带回生活设计、学习与自我觉察中的知觉应用6.1 格式塔法则在设计里的直接投影学完知觉这一章我做的最直接的一件事就是重新审视自己桌面上的App图标和网页设计。很多设计师未必专门学过心理学但他们的作品之所以好看正是因为他们不自觉地在迎合格式塔法则。图标间距一致就容易被归为同一功能组接近律同一色系的卡片自然让人觉得是一组内容相似律一个裁切掉一部分的图形观者会自动补全所以视觉上没有断裂不适闭合律导航栏的连续线条让人感觉路径是“通”的连续律我在自己做材料整理时也开始刻意运用这些法则把相关文件放在相邻位置用颜色分类而不是文字分类让标题排成一条连续的行。结果发现别人阅读和理解的效率明显提高了。这不是什么玄学而是自觉利用大脑默认的编组规则减少对方的认知负荷。6.2 知觉学习训练比天赋更能改变“看见”的方式教科书还提到了一个非常振奋人心的概念知觉学习。它指的是通过反复训练知觉系统本身会发生可塑性改变。比如品酒师能尝出极其细微的单宁差异鸟类学家能一眼从枝头繁叶中认出目标鸟种放射科医生能在杂乱X光片上迅速定位异常病灶——这些都不是感觉器官变灵敏了而是高层知觉模型被训练得更加精密。对我个人的启发是所谓“经验”不只是知识的积累更是在大脑里建立起更细致的知觉分类模型。同一个场景、不同专业的人知觉到的东西完全不同。一个程序员看一个网页看到的是组件树和状态逻辑一个设计师看到的是视觉层级和色彩对比一个普通用户看到的只是“一个好看的页面”。这不是谁比谁看得更真而是各自的知觉建构模型不同。所以如果想让自己的专业能力上一个台阶一个重要抓手就是刻意训练知觉分辨力。比如写作的人可以每天刻意辨析两个相近词汇在感受上的差别做手工的人可以训练手对材质湿度和硬度的感知。知觉是可塑的这远比天生敏感更有价值。6.3 自我觉察看见“建构中的我”最后这一章对我最大的影响不在专业领域而在日常自我觉察。我现在会有意识地在某些情绪涌上来时提醒自己我“看见”的这件事很可能不是事情本身而是大脑结合经验、预期和当下情绪建构出来的一个版本。别人一个冷淡的眼神我可能立刻知觉成“他讨厌我”但事实上这个知觉包含了太多自上而下的预期——可能是我昨晚没睡好可能是我对自己的表现没信心可能是我最近太敏感于社交排斥。大脑抓住一个模糊线索按最熟悉、最有情绪负担的模式完成了建构。这不是说所有知觉都不可靠也不是要走向彻底的怀疑主义。而是说当我们知道知觉有建构的成分就可以在重大判断前多一个“悬置”的动作先问自己“现在这个判断里有多大比例是信号本身给的有多大比例是我自己脑补的”仅仅这一个问题就能减少很多不必要的情绪内耗。这一点我觉得是《心理学导论》里最值得带走的东西。知识会过时但对自己知觉过程的审视能力会持续影响你如何理解世界、理解别人、理解自己。去读原书吧这一章绝对值得反复翻。
返回列表