记忆广度「7±2」是怎么被误传的:Miller 说的不是数字位数

· 约 3 分钟 💾 数字记忆

几乎每篇讲记忆力的文章都会引一句「人的短时记忆只能装 7±2 个东西」,出处是 Miller 1956 年的论文。但这句话在传播过程中被悄悄改掉了一个词:Miller 说的单位是组块(chunk),不是数字

这个区别不是学术洁癖。它直接决定了你该怎么读 数字记忆 测试的成绩——以及为什么有人能记 20 位而他的记忆力并不比你好。

Miller 那篇论文到底写了什么

Miller 汇总了当时各种广度实验,发现不管材料是什么,人能同时持有的项目数都落在 7 上下。但他在文中就已经强调:这个”项目”的大小是可变的1 9 4 9 是四个项目,「1949」对中国人来说可以是一个项目。

他自己用的词是”magical”(带着调侃),并不认为 7 是一个生理常数。真正被误传的是后来的科普:把 chunk 直接翻译成”个”,再和”数字位数”混为一谈。

同样是 7 个,材料不同难度不同

材料典型广度为什么
数字(0–9)最长只有 10 个候选、发音短、几乎人人熟练
字母略短26 个候选,B/D/P/T 之类读音容易互相干扰
无关联的词更短每个词本身就占更多编码资源
无意义音节最短无法挂到任何已有知识上

发音长度也算变量:读起来短的项目更容易在默念循环里转起来。这也是数字广度在跨语言比较里会出现差异的原因之一——同样的十个数字,各语言念出来的音节长度不一样。

现代估计:把复述堵住之后只剩 4

Cowan 2001 的做法是设法排除掉复述和临时组块(比如同时让被试做一件占住嘴和注意力的事),再测能留下多少。答案是 4±1

所以更准确的说法是:4 左右是纯容量,7 左右是容量加上你现场做的编码工作。本站这个测试完全允许你默念、分段、编故事,测到的是后者。

往上走只能靠组块

本站的显示时长是「1 秒 + 每多一位 0.5 秒」:12 位数给 6.5 秒。到了 12 位以上,靠逐位默念一定来不及,唯一的出路是把数字串切成有意义的块——年份、电话号段、跑步成绩、两位数对应的固定形象。

这不是作弊。Ericsson 等人 1980 年那个经典个案里,被试把数字串编码成长跑成绩,练到接近 80 位;但他的字母广度没有跟着变好——练出来的是编码方案,不是容量

这个分数不能拿来做什么

它是消遣和自查工具,不是智力测验,也不是任何医疗评估。同一个人一天之内差一两位是常事,睡眠和环境噪音的影响很可能比”记忆力”本身更大。

如果你关心的是”我的记性是不是出问题了”,该看的是日常功能有没有变化(忘记刚说过的事、走神后完全接不上),以及找医生做标准化评估,而不是网页上的一个数字。

想换个材料对照着看的话:视觉记忆 测的是位置而不是数字,语言记忆 测的是”这个词刚才出现过没有”——三个测的是工作记忆的不同侧面,成绩之间不可互换。

❓ 常见问题

到底是 7±2 还是 4±1?哪个对?

两个都对,但说的不是同一件事。Miller 1956 那篇《The Magical Number Seven, Plus or Minus Two》(Psychological Review)统计的是各类广度任务的表现,单位是组块(chunk)——一个组块可以是一个数字,也可以是一个词、一个熟悉的缩写。而 Cowan 2001(Behavioral and Brain Sciences)把默念复述和临时组块都堵住之后再测,得到的纯容量约为 4±1。差的那 3 个不是记忆力,是你在测试过程中临时做的组块和复述。所以:允许复述的任务里 7 左右正常,堵住复述的实验里 4 左右正常,本站这个测试属于前者。

我只能记 7 位数,是不是记忆力差?

7 位正好落在最典型的区间里,谈不上差。一个参照:中国大陆的手机号是 11 位,绝大多数人第一次听是记不住的,要靠 3-4-4 分段才行——那就是组块在起作用。比"我几位"更有信息量的是两件事:(1) 你失败那一次是记错了还是手滑打错了(本站失败时会把正确答案和你打的那串并排摊开,就是为了分开这两种);(2) 分段策略换了之后成绩有没有变——如果一分段就多两位,说明你原来卡在策略上而不是容量上。

本站为什么从 6 位开始,不从 3 位开始?

前三关人人都过,白花十几秒。3、4、5 位几乎没有人记不住,连显示带打字要花掉十几秒,而这个测试真正的看点在 8 位往上。代价要知道:分数 3、4、5 从此不可能出现,连 6 位都没过的人直接记 0 分——也就是说 0 分那一档混着「手滑打错」和「真的记不住 6 位」两种人。看自己的百分位时把这一点考虑进去。

显示时长为什么是「1 秒 + 每多一位 0.5 秒」?临床测验不是每秒一位吗?

因为呈现方式不一样,照搬会变成干瞪眼。WAIS-IV / WMS 的数字广度测验确实规定主试以每秒一位念数字(手册还特别强调呈现速度会显著改变难度),但那是听觉、逐位串行呈现——受试者没有别的选择,1 秒/位就是呈现本身。本站是视觉、整串一次摊开:12 位数两三秒就读完了,照搬 1 秒/位等于剩下 9 秒干瞪眼。视觉整串呈现下读取是并行的、只有编码是串行的,所以每多一位该加的时间理应远小于 1 秒。但「跟着位数线性增长」这件事不能去掉:做成恒定 5 秒的话,到 15 位时连读一遍都不够,天花板就被阅读速度而不是记忆力卡住了。

用分段、编故事、记忆宫殿算作弊吗?

不算,而且那是往上走的唯一出路。Ericsson、Chase 和 Faloon 1980 年发在 Science 上的那篇《Acquisition of a memory skill》记录了一个大学生(代号 SF):他是长跑爱好者,把数字串当成跑步成绩来编码(比如 3492 记成"3 分 49.2 秒,接近一英里世界纪录"),经过 200 多小时练习把数字广度从 7 位推到近 80 位。但同一个人的字母广度没有跟着提高——练出来的是这套编码方法,不是容量本身。所以:拿组块技巧刷分是这个测试的正常玩法,只是别把结果理解成"我的记忆力变强了"。

这个分数和智力、和年龄有关系吗?

相关但远不能互相代替。数字广度是韦氏量表工作记忆指数的一个组成部分,但一个分测验不等于整个量表,更不等于智力;临床施测还有标准化的呈现方式、常模和主试控制,网页上点几下都没有。年龄:工作记忆广度大致在成年早期最好,之后缓慢下降,但个体差异远大于年龄差异。当天状态的影响可能比这两项都大——睡眠不足、刚喝完咖啡、旁边有人说话,都能让成绩差一两位。

💾 打开 数字记忆 Number Memory 中文版·数字显示「1秒+每多一位0.5秒」后消失把它打出来·对了加一位打错一次整局结束·失败摊开正确答案逐位对照·带本站真实数据的击败百分比与排行榜·本地运行

🔗 相关阅读

全部教程 →