Skip to content

词汇篇:从“认识单词”到“能在语境中使用”

词汇不是一串“英文 = 中文”的键值对。真正掌握一个词或词块,至少包含:在声音和文字中辨认、理解常见义项、知道搭配与语域,并能在合适场景中主动使用。

删除两个误导性等式

旧版曾写“1000 词理解 75%”“7000 词理解接近 90%”。这类无条件等式会把不同的计数单位、语料类型和“理解”定义混在一起,因此本版删除。

讨论词汇规模时先问:

  • 计数单位是单词形式、词目还是词族
  • 材料是日常对话、小说、新闻、学术文本还是专业文档?
  • 覆盖率统计是否包含专有名词和透明复合词?
  • “认识”是选择题辨认,还是能在听说读写中产出?

Nation 等人的研究常用 95%98% 词汇覆盖率讨论阅读条件。95% 意味着平均约每 20 个运行词仍有 1 个不熟悉;98% 约每 50 个有 1 个。98% 更有利于较独立的理解,但这仍不是“达到某个固定词汇量就自动读懂”的保证。背景知识、文本结构、语言距离和任务要求都会改变结果。

先认识四种词汇

维度问题证据
接受性听力听到时能否切分并理解?不看字幕听句子并解释
接受性阅读看到时能否结合语境理解?在新文章中解释作用
产出性口语需要时能否迅速说出并搭配正确?录音中自然使用
产出性写作能否拼写、搭配并符合语域?在新任务中准确写出

“看答案觉得眼熟”只覆盖很小一部分。接受性词汇通常先于产出性词汇,训练目标应根据真实任务决定。

词族只是研究工具

help, helps, helped, helpful, helpless 可以在某些统计中归为一个词族,但学习者不一定会自动理解所有派生形式。词族能帮助估计覆盖率,却不能代替对词形、词性、派生和用法的学习。

技术、医学、法律等领域还包含大量术语和固定表达。对真实任务最有价值的单位经常不是单个词,而是:

  • 搭配:pose a risk, meet a deadline
  • 句块:What I mean is ..., It depends on whether ...
  • 构词关系:analyse → analysis → analytical
  • 语域:kidschildrenminors 在场合与含义上不同。

不把人分成视觉型和听觉型

学习者可能偏爱某种呈现方式,但证据不足以支持“按视觉型/听觉型匹配教学”。词汇本身需要多通道证据:

  1. 标准发音和连读中的实际声音;
  2. 拼写、词形和真实句子;
  3. 并录音,对比重音和音素;
  4. 自己的句子或短文;
  5. 在不同但相关的场景中。

图像适合具体概念,定义和语境更适合抽象词;发音必须依靠声音。呈现方式服从内容,而不是服从学习者标签。

选择要学的词

不要从一张巨大清单随机开始。按优先级筛选:

  1. 在当前材料或工作中重复出现;
  2. 不懂它会阻断主旨或任务;
  3. 能与已有词汇组成高频搭配;
  4. 未来两周有明确使用场景;
  5. 专业任务中的关键术语。

专有名词、低频细节或一次性出现且不妨碍理解的词,可以暂时略过。

一张高质量词卡

正面尽量要求回忆,不要只要求辨认。

text
场景:项目延期时,如何说“对进度构成风险”?
留空:The dependency may ____ a risk to the schedule.

背面包含:

  • pose a risk to
  • 一条来源可靠的原句与出处;
  • 发音或音频;
  • 简短释义与语域;
  • 自己的第二个例句;
  • 一个易混淆项,如 causepose 的差别。

卡片过长会把复习变成重新阅读。一个卡片尽量只测试一个决定。

动态间隔,而不是固定“记忆曲线”

遗忘是真实的,但不存在适合所有词、所有人的固定复习时间表。使用 Anki 等间隔重复工具时,让表现驱动间隔:

  • 秒答且能用于新句:增加间隔;
  • 回忆费力但正确:保持或小幅增加;
  • 经常混淆:增加辨析卡和新语境;
  • 总是失败:减少新卡、拆卡或补发音/概念基础;
  • 卡片答对但真实任务用不出:停止增加卡量,转向说写输出。

Anki 是一个选择,不是方法本身。早年本章分享的第三方“麦克米伦 7000 词汇”卡组链接已失效,也无法持续确认版权和维护状态,因此不再分发。

真实语境练习

每组新词至少完成以下两种迁移:

  • 替换语境:把原句中的人物、时间、观点或领域换掉;
  • 对比语境:写出正确用法和一个典型误用;
  • 口头复述:不看词表讲 60–90 秒;
  • 阅读检索:在真实语料中找 3 个不同来源的搭配;
  • 写作任务:在邮件、说明、日志或短文中自然使用。

词典优先查看学习者词典、发音、搭配和例句。AI 可以生成候选练习,但生成的释义、搭配和例句需要用词典或真实语料核验。

一个 30 分钟训练单元

  1. 5 分钟:从真实材料挑 5–8 个高价值词块。
  2. 8 分钟:查发音、常见义项、搭配和语域。
  3. 7 分钟:制作要求主动回忆的短卡片。
  4. 7 分钟:脱离材料说或写一个新场景。
  5. 3 分钟:记录错误与下一次复查条件。

一天新增多少词不重要。重要的是一周后能否在新任务里理解和使用。

如果你不确定自己究竟卡在哪一层,可以使用词汇审计模板,把听辨、阅读、口语、写作和延迟迁移分开记录。

7 天、30 天、12 周

7 天

  • 从一个真实主题收集 20–30 个词块;
  • 每个词块包含声音、搭配和来源句;
  • 至少做两次不看答案的回忆;
  • 第 7 天完成一次 2 分钟口头复述或 200 词写作。

30 天

  • 每周使用一次平行材料测试阅读/听力覆盖;
  • 每周完成一项包含本周词块的真实输出;
  • 删除低价值、重复或始终只靠提示答对的卡;
  • 比较第 1 天和第 30 天的理解、产出和保持,而非卡片总数。

12 周

  • 围绕一个专业或生活领域建立小型语料库;
  • 将高频词块用于会议、文章、代码评审、考试或演讲;
  • 抽样测试延迟回忆与陌生语境迁移;
  • 产出稳定后再扩展新领域,而不是无限堆词。

反馈标准

每个目标词块检查:

  • 能否在声音和文字中辨认;
  • 能否用自己的话解释当前义项;
  • 搭配、词形、语域是否自然;
  • 能否在没有提示的情况下产出;
  • 一周后能否在新语境复用。

参考资料

上一篇:认知篇 | 下一篇:听力篇

正文 CC BY-NC 4.0;站点与工具代码 MIT。