语言记忆测试(Verbal Memory)是 Human Benchmark 上最”上瘾”的一个:屏幕上一次只出现一个词,你要判断它在这一局里出现过没有。见过点「见过」,第一次见点「新」。答错扣一条命,三条命用完结束,成绩就是答对的次数。
再认,而不是广度。数字记忆那类测试问的是”你一次能维持多少东西”,答案在几秒钟之内就要交卷;这个测试问的是”几分钟之后你还分得清见过和没见过吗”,累积到后面要同时压着几十个词。
它更接近日常生活里真正在用的那种记忆:这张脸认不认识、这件事跟他提过没有、这篇文章是不是读过。心理学里管这类任务叫再认记忆,它和”背下来”用的不是同一套机制——你显然背不出刚才出现过的四十个词,但你能认出它们。
打到三四十个之后,几乎每个词都有点眼熟——这不是错觉,是熟悉感在起作用:词在这一局里反复出现、彼此又都是常用词,大脑对它们的”处理流畅度”普遍提高了,而这种流畅度正是熟悉感的来源。
所以往上走的唯一通道是把判断依据换掉:不是”它看着眼熟”,而是”我记得它出现在哪一段”。后者叫回想,需要在看到词的那一刻就给它挂上一个钩子——一个画面、一句怪话、一个归属的类别。这也是为什么高分的人几乎都会说”我给每个词都编了点什么”。
不给你一张编出来的人群分布表。结果页上那行**“超过了本站 X% 的用户”**才是真话,它拿的是本站真实成绩:一个浏览器算一个用户、按各自的最好成绩比、同分算一半,样本不够 100 个不同浏览器时干脆不显示。
玩法是同一个:一次显示一个词,判断它在这一局里出现过没有,答错扣一条命。但不敢说逐条一致——那边的词库有多大、重复概率是多少,都没有公开口径,硬说"完全一致"是编的。本站的规则全写在这里,你可以自己核对:词库 600 多个中文常用词;重复概率固定 50%,头两个词必定是新词;三条命;满 200 个算通关。最大的一处不同是词库语言,见下一条。
原版是英文的。照搬到中文站,成绩里就会掺进一层"认不认得这个英文词"——那测的是词汇量而不是记忆力,而且对英语不好的人是系统性压低:一个没见过的生词,你连"它长什么样"都留不住,自然也谈不上记没记过。中文常用词对本站的访客几乎零门槛,测的才是"这个词刚才出现过没有"这一件事。挑词时还避开了两类:互为颠倒的词(蜜蜂/蜂蜜)和近义词对(地砖/瓷砖),那两类的错是"看错了"而不是"记错了"。
固定 50%,从头到尾不变。所以闭着眼乱点的期望成绩大约是"连对一次就死一次",三条命撑不过十来个词——这个测试没法靠蒙。头两个词必定是新词,因为那时候还没有"见过"这回事,掷骰子是白送分。概率刻意不随分数变化:做成"越往后越容易重复"会让高分段变简单,分数之间也就不可比了。
因为两个测试的失败方式不一样。数字记忆一局只有几十秒,失败几乎总是"到顶了",同一个人连打几局通常只差一位。而语言记忆一局要判断几十上百次,单次判断本身就带随机性——犹豫的时候基本是五五开。只给一条命的话,成绩主要由"哪一次手滑"决定而不是由记忆量决定。三条命把这份噪声压下去,又不至于让一局拖到十分钟。
非常正常,而且这正是这个测试真正的难点。出现过几十个词之后,"熟悉感"对几乎所有词都成立——它是这个玩法里唯一的敌人,不是遗忘。心理学里把这两种东西分得很清楚:熟悉感(觉得眼熟)和回想(记得它出现在哪一段)。想往上走,判断的依据必须从前者换成后者:不是"它看着眼熟",而是"我记得它是跟在那个动物后面出现的"。
四条,按见效顺序:① 给每个词挂钩子——想象它的样子、和上一个词编成一句怪话,扫一眼是留不下痕迹的;② 记"新词"而不是记"旧词",到后面旧词清单有几十个,而每个新词都是刚刚才发生的一件事,更容易挂住;③ 提防熟悉感,见上一条;④ 按类别分堆——动物、食物、家具……归堆之后判断一个词只需要在它那一堆里找,清单一下短了好几倍。
不是,只算这一局之内。每一局开始时都会重新洗牌,上一局出现过的词在这一局第一次出现时是新词。所以连打几局不会越来越难,也不用担心"我记得这词但不确定是不是上一局的"——凡是这一局里没出现过的,一律点「新」。
出词和判分全部在你的浏览器里完成,词库是随页面一起下载的。只有成绩数字会发到本站自己的服务器(用于那行"超过了 X% 的用户"和排行榜),不含任何其他内容;历史最好成绩存在本机 localStorage,点"清除"随时删掉。排行榜要登录才能提交,因为提交等于把你的微信昵称和头像公开挂到榜上——不提交照样能看榜,也照样有那行百分位。