有个现象很多人都经历过:单词量明明在涨,口语却没跟着涨。背到八千词,开口还是那几句。
这不是你的问题,是存储单位错了。而这件事,语言学早就测过。
一个被反复引用的数字:58.6%
Erman 与 Warren 在 2000 年做过一项分析:他们手工标注了 19 段真实语料,判断其中有多少内容是预制组块(prefabs)——也就是整块取用、不是现场按语法拼出来的部分。
结果是:口语 58.6%,书面语 52.3%。
后来的语料库研究用不同方法重做,数字有出入,但方向一致:日常对话是所有语体里最"预制"的一种,有研究给出的比例甚至接近七成。
这个发现有个专门的名字,叫词块(lexical bundles),由 Biber 等人在 1999 年的《朗文英语口语与书面语语法》里正式提出。他们发现口语里反复出现的高频序列,大多是四个词左右的固定组合。
这个数字为什么和你有关
如果母语者一半以上的话是整块取用的,那么"词汇 + 语法 = 说话"这个模型从一开始就不成立。
真实的产出过程更像这样:
- 母语者:想表达 → 取出一整块 → 说出来。一步。
- 你现在:想表达 → 找中文 → 找对应单词 → 想语法怎么拼 → 想冠词时态 → 说出来。五步,每步都可能卡。
问题不在你不够快,在你走的步数本来就比对方多四步。而背单词只会让第二步的候选变多——它不减少步数。
这也是为什么"我什么都懂,就是说不出来"如此普遍:你存的是零件,要的是成品。
所以该存什么
把存储单位从"词"换成"块"。具体说,是这四类:
1. 对话框架(最高频,优先级最高) I don't know if… · Do you want to… · I was going to… · Are you going to… · What do you think about… · Is it okay if… 这类在口语语料里的频次极高,因为它们是句子的开头——开头有了,后面反而好接。
2. 缓冲与拖延 I mean… · You know… · sort of · kind of · or something like that · Let me think 很多人以为这些是"废话"该省掉。恰恰相反:它们是母语者给自己争取思考时间的装置。没有它们,你要么卡死,要么被迫加速到自己撑不住的语速。
3. 反应 Oh nice. · That's rough. · No way. · I know, right? · Fair enough. 短到可以不假思索,却决定了对方觉得你在不在听。
4. 功能句(一个场景一块) Could you hold for a moment? · Sorry, I didn't catch that. · I'd better let you go. 每个高频场景配一两块,用到时直接取。
怎么存进去
三条,都很朴素,但缺一不可:
- 整块记,别拆。记
That reminds me — I need to…,不要记remind = 提醒。存进去是什么形状,取出来就是什么形状。 - 出声,不是默念。词块的价值在于调用速度,而调用速度只能靠发声重复建立。看十遍不如出声三遍。
- 装进你自己的句子。同一块套进你真会说的内容里再说一遍。挂在例句上的块,取出来时还带着例句。
怎么找到"该存哪一块"
上面的清单只是起点。更有效的办法是让自己的表达缺口来决定存什么:
你想说一句话 → 用现有水平说出来(哪怕别扭)→ 看母语者会怎么说 → 把那个说法当成一整块,出声读三遍。
顺序是关键。先自己憋一遍,再看答案——那个落差就是你的缺口,而缺口处记住的东西最牢。直接看答案的那一遍,基本不留痕迹。
像话 就是按这个顺序设计的:你说一句自己的话,它照出母语者的说法并读给你听,你跟读,它逐词对比节奏。攒下来的每一块都来自你真想表达的内容,不是别人的例句表。
同一个主题的另外两面:英语思维是不是伪命题 讲的是怎么把"块"用起来,跟读法真的有用吗 讲的是节奏这一层的证据。
参考文献
- Erman, B., & Warren, B. (2000). The idiom principle and the open choice principle. *Text*, 20(1), 29–62.
- Biber, D., Johansson, S., Leech, G., Conrad, S., & Finegan, E. (1999). *Longman Grammar of Spoken and Written English.*(词块 lexical bundles 概念出处)
*像话(MirrorSay)是一款免费的 AI 英语口语练习 App:你说一句,它照出母语者的说法,再带你跟读。无需注册,你说的话不离开手机。*
