做了一套真题,对完答案:听力对15题,阅读对18题。然后你想知道“这大概是多少分”。这个问题在四六级里没有直截了当的答案——但同一张分值表能回答另一个更有用的问题:时间只够复习一部分内容,先保哪一档题。

710分先切成四块,再切成三档单价

四级卷面没有“每题1分”这种均匀设计。全卷710分先按 35%、35%、15%、15% 分给听力、阅读、写作、翻译四大块,每一块内部再按题型定权重。

模块题型题量占全卷满分每题
写作作文一篇115%106.5
听力短篇新闻77%49.77.1
听力长对话88%56.87.1
听力听力篇章1020%14214.2
阅读选词填空105%35.53.55
阅读长篇阅读(段落匹配)1010%717.1
阅读仔细阅读1020%14214.2
翻译汉译英一段115%106.5

这张表的加法是对的:15+7+8+20+5+10+20+15 = 100;106.5+49.7+56.8+142+35.5+71+142+106.5 = 710。听力25题拿走248.5分,阅读30题拿走248.5分,写作和翻译各一道题各拿106.5分(成绩单上这两项合并显示为“写作和翻译”,满分213)。

同时能看出一个方便的换算:710的1%正好是7.1分,所以7.1代表1%,3.55代表0.5%,14.2代表2%。写作和翻译按15分制分档给分(如13—15、10—12、7—9……),15分制上的1分恰好等于7.1报道分。整个分值表其实就是一套百分比,题目的“分数”是先有权重、再乘710换算出来的。

40%的分数,藏在20道题里

把主要注意力放在单价而不是题量上,会看到几个反直觉的结构。

听力和阅读各248.5分,听力只有25题,阅读有30题,所以听力题的平均单价比阅读高(9.94 对 8.28)。而在两个模块内部,都出现了同一种分层:一个“昂贵档”(每题2%,14.2分)、一个“中档”(每题1%,7.1分)、一个“廉价档”(0.5%,3.55分)。

  • 昂贵档:听力篇章10题(142分)+ 仔细阅读10题(142分)= 284分,占全卷40%,只有20道题。
  • 中档:长对话8题(56.8分)+ 短篇新闻7题(49.7分)+ 长篇阅读10题(71分)。
  • 廉价档:选词填空10题,只有35.5分,每题3.55分。

这里有一个对“底子还在但荒废了一阵”的人特别重要的对照:四级里最贵的两档——听力篇章和仔细阅读——恰恰是高中英语最熟的两种题型(短文理解、阅读理解),考的是同样的能力:听懂/读懂大意、抓住细节、判断态度。而高中没有接触过的新题型是短篇新闻(7%)和选词填空(5%),加起来只有12%。新生最容易犯的判断错误,是把“最陌生的题型”当成“最该花时间的题型”,正好把顺序搞反。

425不是官方及格线

四级不设及格线,考试只报道分数,成绩单上也没有“合格/不合格”。425是后来形成的制度约定,来源很朴素:710 × 60% = 426,取整成425,于是它被当作60%的那条线。

它的实际用途有三个:报考六级通常要求四级成绩达到425分(含)以上;不少高校把425分作为毕业或学位的外语要求;用人单位在筛选简历时也直接看这条线。

需要注意,425只是“对710这条尺子取60%”,并不等于“正确率60%”。这个区别在下一节会变成关键。

为什么“每题几分”加不出你的成绩

四级的报道分由常模转换得到,官方公式是:

TotSco=XMeanSD×70+500\mathrm{TotSco}=\frac{X-\mathrm{Mean}}{\mathrm{SD}}\times 70+500

其中 XX 是常模转换前的原始分,Mean\mathrm{Mean} 是常模均值,SD\mathrm{SD} 是常模标准差。常模群体是考试设立时抽取的一个固定样本(四级取自全国16所高校约3万名非英语专业考生),均值与标准差来自这个样本,不随每场考试重算。

公式干的事,是把常模群体自己的分数分布搬到一把预先定好的尺子上:那个群体的平均分被放在500,标准差被定为70。于是500是“常模群体的平均水平”,710正好是 500+3×70,也就是尺子的顶端(超过顶端按顶分记)。

现在看两组推论,一组支持“每题几分”,一组否定“直接相加”。

先说支持的。这个变换是 XX 的一次函数,斜率为 70/SD70/\mathrm{SD},是固定正数。也就是说,原始分每多一分,报道分固定涨 70/SD70/\mathrm{SD} 点,人人相同。相对权重被完整保留:一道2%的题对报道分的贡献,确实是一道1%题的两倍。用于排序、用于决定先保哪一档,这张分值表是可靠的。

再说被否定的。公式里除了斜率,还有一个平移项 50070Mean/SD500-70\cdot \mathrm{Mean}/\mathrm{SD}。它决定你整体落在尺子的什么高度,而这个高度由固定常模样本决定,跟你的答题情况无关。你把每道题的分值相加,等于默认这一项不存在——算出来的是“比你一道题都不做时多出的分数”,不是成绩单上的分数。

还有一层:XX 本身也不是“对了几题”。它是按分值表加权后的卷面原始分,写作和翻译先按15分制给档次分再折算进来。所以“对14题仔细阅读 = 142分”这种算法,算的是相对增量,不是绝对成绩。

于是425的位置也可以算出来:

425500701.07\frac{425-500}{70}\approx -1.07

按正态分布近似,425大约在常模群体的第14百分位——那个样本里只有约14%的人低于这个分数。听起来很低,但尺子是用几十年前的一批考生定做的,人换了、尺子没换,同一个刻度在不同年代的“难度感”自然不同。这也说明了一件事:成绩单上的数字衡量的是你在常模分布里的位置,不是你当场做对了百分之多少。