# 新版托福口语怎么拿分：11 道题、两类任务，零准备时间下靠什么组织回答

从逐句复述 7 道与模拟面试 4 道各自考什么、8–12 秒与 45 秒的时间窗，到 0–5 分如何合成两个任务分，以及没有准备时间时该提前装好的说话结构

> 托福口语 · 托福 iBT 2026 改版 · 考试结构与评分 · 约 7 分钟 · 10 月 04 日

## 本篇要点

1. 新版托福口语是最后一科，约 8 分钟，11 道计分题，分成逐句复述 7 道和模拟面试 4 道，整科没有自适应，两项任务的准备时间都是 0。
2. 口语和阅读、听力最大的结构差别是：口语对所有人出同一套题，没有按表现分流这回事，开口一次就是最终答案。
3. 每道题最多 5 分，11 道题的原始分上限是 55 分；复述和面试各自合成一个任务分，最终换成 1 到 6 的 0.5 档位。两个任务分怎么合成，官方没有公布公式，“各占一半”是备考资料的反推。
4. 复述题给一张情境图，播 7 句逐渐变长的句子，每句给你 8 到 12 秒复述。这是唯一一个改写要扣分的任务：5 分的定义是意思完全可懂且与原句一字不差，4 分才允许小幅词或语法改动。
5. 复述题的难度爬升方式是句法：从单个独立主谓结构，加到复合动词、从属从句、关系从句和长名词短语；高分档还要求用重音和语调把意思带出来，而不只是词说对。
6. 复述题的音频可能带北美、英国、新西兰或澳大利亚口音，而作答要求一字不差，等于把口音适应直接算进分数。
7. 面试题是 4 个问题围绕一个主题，每题 45 秒，无准备时间，问题只播一遍；四个问题按“具体个人—偏好加理由—观点利弊—抽象推演”的阶梯设计。
8. 按每分钟 140 到 160 词的口语速度，45 秒大约说 100 到 120 词，所以一个直接回答加一个理由加一个具体例子就足够填满，不需要复杂论证。
9. 面试题按 Fluency、Intelligibility、Language Use、Organization 四个维度评分，其中三项都和有没有稳定的说话结构有关，因此结构必须提前练到不用想。
10. 可用的时间骨架是“回答 5 到 7 秒—展开 20 到 30 秒—收口约 5 秒”，四个问题共用同一个骨架，只替换展开里的内容。
11. 评分方向奖励清楚准确而不是用词高级：高级词用错、复杂句把意思说糊都会被扣，这是第三方从评分量表反推的结论，与官方 4 分、5 分的措辞方向一致。
12. 复述和面试要用不同方法分开练：复述练影子跟读求准，面试练“回答—展开—收口”的节奏求稳。

---

前面三篇把地图、阅读和听力都拆过一遍。口语跟它们有一个根本区别：阅读和听力都有两条自适应路径，第一模块决定你后面会遇到什么题；口语没有这回事。它的题目对所有人一样，也没有回头路——开口那一次就是最后一次，不能重录。

## 一、口语是最后一科，也是唯一完全不给你准备时间的一科

考试顺序是阅读、听力、写作、口语，口语收尾 [3]。整科大约 8 分钟，里面一共 11 道计分题，分成两类任务：逐句复述（Listen and Repeat）7 道，模拟面试（Take an Interview）4 道 [1][2]。

有两条要先记住。第一，每道题最多 5 分，这是官方技术手册明写的；11 道乘下来，口语的原始分上限是 55 分，这个数字也印在手册的科目表里 [1]。第二，两项任务的准备时间都是 0 [1]。

阅读可以回看，听力可以边听边记，口语只有“听到”和“开口”两件事，中间没有缓冲带。这一条基本决定了口语该怎么练，第四节专门说。好处是，整科不是一个需要自己硬扛的长材料，而是十几个十几秒钟一断的小任务接连完成。

## 二、复述题：唯一一个“改写要扣分”的任务

复述题的场面是这样的：屏幕上先给你一张图，可能是一张图书馆的楼层示意、一张实验室安全操作图，或者一条从教学楼到某个办公室的路线。然后你听到 7 句描述这张图的句子，一句一句播，句子越来越长，每句播完“嘟”一声，你对着麦克风把它复述出来 [1][4]。每句的时间窗是 8 到 12 秒 [1]。

句子“变长”具体长在哪里，官方描述得很清楚：从只有一个独立主谓结构的短句，逐步加进复合动词、从属从句、关系从句和较长的名词短语 [1]。

这里有一个很反直觉的点，也是这类题最容易练错的地方。

平时练口语，几乎所有方法都在教你“换个说法”——同义词替换、换句型、别重复原话。复述题恰好相反：改写就是扣分。评分量表里，5 分的定义是“完全可懂，且与原句一字不差”；4 分是“意思表达出来了，但不是原句，有小幅的词或语法改动”；再往下就是漏了内容、或者可懂度出了问题 [5][6]。面对这 7 道题，你要做的是尽量把每一个词按原样说出来，而不是说得更漂亮。

但别因此以为复述只看“词对不对”。官方给各档位写的描述里，高一档不只要求词准，还要求“用重音和语调把意思带出来”；低一档的典型表现是“虽然能重复较长的句子，但重音和语调带着母语的痕迹” [1]。也就是说，机器听的不只是你复述了多少内容词，还包括节奏和重读落在哪里。

这条任务里还有两处能白拿的分。

一处是那张图。7 句句子围绕同一张图展开，所以图本身就是上下文线索：听到第二句提到“二楼”，你大致能预判后面的词汇范围，某一句没听清时，图能帮你补回一部分。

另一处是口音。官方说明里写得很直接：口语部分听到的英语可能带北美、英国、新西兰或澳大利亚口音 [2]。复述又要求一字不差，等于把口音适应能力直接算进了分数。如果平时只听美音材料，考试当天碰到澳音句子，掉的是整道题的分。

## 三、面试题：4 个问题围绕一个主题，问题只播一遍

模拟面试看起来更像一次真实对话。屏幕上出现一位面试官，先用一两句话交代主题——比如“你参加了一项关于城市生活的研究”，然后开始提问。4 个问题，每题你有 45 秒作答，中间没有准备时间，每个问题只播一遍 [2][4]。

这 4 个问题不是随便凑的，而是一个固定的阶梯 [4]：

- 第一问通常最具体、最个人——你平时怎么做某件事，或者你现在的状况是什么。
- 第二问问偏好或习惯，并且要你给出理由。
- 第三问要观点、利弊或比较。
- 第四问最抽象，往往是“未来会怎样变化”或“这件事更广的影响是什么”。

这个阶梯对你的用处，不是拿来背模板，而是让你在听到第一问时就知道后面会往哪里走。既然主题在第一个问题之前就告诉你了，那几秒钟是整个口语部分唯一一点免费的信息——你可以在心里先把话题相关的几个词和一句基本立场放好。

还有一个数字必须提前算清楚：45 秒到底能说多少话。正常英语口语速度大约每分钟 140 到 160 词 [4]，按这个速度算，45 秒大约是 100 到 120 词。

这个估算很有用，因为它直接否定了很多人对这道题的想象。100 多词装不下一个复杂论证，也不需要。一个直接的回答，加一个理由，加一个具体例子，基本就把 45 秒填满了。反过来说，如果 45 秒里你只说了三四十个词就停下来，评分表里的“展开程度”一项就已经丢分了。

## 四、没有准备时间，能提前做的只有把结构装进身体

面试题的评分围绕四个维度：Fluency（流利度）、Intelligibility（可懂度）、Language Use（语法和词汇）、Organization（组织与切题）[5][6]。

四个维度里，只有 Language Use 跟“你的英语水平”直接相关，另外三项都跟你有没有一个稳定的说话结构有关。这就是零准备时间的真实压力所在：45 秒里你没有余力现场设计结构，只能想内容。结构一旦需要临场搭，Fluency 和 Organization 会同时掉分。

所以结构必须提前定好，练到不用想。一个能覆盖全部 4 个问题的骨架是“回答—展开—收口”，时间分配大致是 [4]：

- 回答，5 到 7 秒：直接给出答案，不要先铺垫背景。
- 展开，20 到 30 秒：给一到两个理由，并且至少留出一句具体例子。
- 收口，约 5 秒：用一句话把主要意思再说一次。

四个问题共用这个骨架，只换“展开”里放什么：前两问放你的亲身经历，后两问放“如果……会怎样”的推演或者利弊对比。这样你练的不是四套答案，而是一套节奏。

还有一条与直觉相反的结论值得写下来。备考资料反复强调：评分不为高级词汇买单，反而会惩罚“高级词用错”和“复杂句把意思说糊”的情况；常用的词用对、结构清楚、语速自然，得到的评价高于堆砌难词 [4]。这句话是第三方从评分量表反推的总结，不是 ETS 的原话，但它和官方量表里的措辞方向一致——5 分和 4 分的差别主要落在“充分回应、可懂、展开”，而不是“句子够不够复杂”。

## 五、两个任务分，决定你不能偏科

每道题按 0 到 5 打分。7 道复述题合出一个“复述任务分”，4 道面试题合出一个“面试任务分”，口语的最终档位由这两个任务分给出，再换到 1 到 6 的 0.5 档制上 [1][4]。

这里必须说清楚一条边界，因为很多备考文章会把它讲成规则。ETS 公布的是：每道题最多 5 分，11 道题的原始分上限 55 分，复述和面试各自作为一项独立的能力声明来报告 [1]。至于这两个任务分具体怎么合成最终的 1 到 6 档，官方没有单独公布公式。备考资料普遍按“两个任务分各占一半”来算 [4][5]，这个说法和官方给出的结构相容，但它是反推出来的，不是官方规则。

不过无论按哪种算法，有一件事是确定的：复述占 11 道题里的 7 道，分量都不小。而现实中绝大多数人都把练习时间全押在面试上——因为“回答一个观点题”至少是练过的动作，而“一字不差地听完就复述”几乎没人专门练过。这大概就是口语卡在 4 档上不去的一个常见原因。

所以这两类任务应该分开练，用完全不同的方法：复述题练的是影子跟读——跟着音频几乎同步地开口，练的是听和说的重合度，以及节奏和重读，目标是准；面试题练的是结构——把“回答—展开—收口”的节奏练成条件反射，让你听到任何题目时都自动启动，目标是稳。把这两件事混在一起练，两边都不容易长进。

## 术语表

- 逐句复述（Listen and Repeat）：口语第一部分，先看一张情境图，再听到 7 句逐渐变长、描述这张图的句子，每句听完后照原话复述一遍。
- 模拟面试（Take an Interview）：口语第二部分，屏幕上一位面试官围绕一个日常主题问 4 个问题，每题 45 秒作答，没有准备时间。
- 任务分：把同一类任务里每道题的 0–5 分取平均，得到的一个代表该类任务表现的分，复述和面试各有一个。
- 线性、无自适应：口语不像阅读和听力那样按你的表现分流，所有人拿到同样的题目和难度。
- 影子跟读：一边听一边几乎同步地开口复述，用来练复述题需要的听与说的重合度，以及节奏和重读。
- 回答—展开—收口：一套不依赖题目内容的时间骨架，先用几秒直接作答，再用理由和一个例子展开，最后用一句话收口，用来填满 45 秒。

## 来源

1. [ETS 官方技术手册（2026 版）：口语 11 道题、7+4 两类任务、8 分钟、准备时间为 0、每题最高 5 分、原始分上限 55、句子句法递进方式与各档位描述](https://www.ets.org/pdfs/toefl/toefl-ibt-test-specifications-2026.pdf)
2. [ETS 官方口语科目介绍页：两类任务各考什么，以及可能出现的北美、英国、新西兰、澳大利亚口音](https://www.ets.org/toefl/test-takers/ibt/about/content/speaking.html)
3. [ETS 教师常见问题文档：考试顺序为阅读、听力、写作、口语，口语由 AI 评分引擎评分](https://www.ets.org/pdfs/toefl/teacher-faq.pdf)
4. [备考网站对新版口语的整理：复述题时间窗、面试四问阶梯、每分钟 140–160 词与“回答—展开—收口”骨架、两个任务分的合成方式](https://prepdrills.com/blog/toefl-2026-speaking-guide/)
5. [两类任务 0–5 分评分量表的具体描述与四个评分维度](https://testsucceed.com/materials/tests/toefl_new/en/scoring/toefl-2026-new-speaking-scoring.html)
6. [口语自动评分提取的语音与语言特征，以及两类任务各维度对应的测量项](https://www.myspeakingscore.com/blog/how-toefl-speaking-is-scored)

---

原文：https://pangzhengboyin.com/articles/new-toefl-speaking-tasks-and-scoring-efdb318b

> **庞征博引** · 想学的，慢慢都会
>
> 庞征博引是把想学的东西写成连载的 AI 学习工具。说出想学什么，它会先了解你的基础，再把主题写成一篇篇 5–10 分钟能读完的文章；边读边问，接下来学什么跟着你走。这篇就是这样写出来的。
>
> 开始你自己的连载 → https://pangzhengboyin.com
