← 返回博客

什么是可理解输入?i+1 与输入式学习完整指南

作者:Sandor更新于: 2026年7月20日阅读需 13 分钟

快速回答

可理解输入指的是略高于你当前水平、但仍能借助语境理解的语言材料,这就是 Stephen Krashen 提出的 i+1。按照他的输入假说,推动语言习得的关键是理解信息,而不是死记语法规则。本指南会讲清理论基础,给出分级读物、带字幕看剧等具体例子,教你如何找到自己的 i+1 难度,并提供关于需要多少小时输入的务实估算。

可理解输入指的是略高于你当前水平,但你仍能借助语境理解的语言。你即使不认识其中每个词或结构,也能跟上意思。这个术语来自语言学家 Stephen Krashen。他把这个最佳区间称为 i+1,也就是你当前水平 (i) 再加上一个可承受的小台阶。他的输入假说认为,人类通过理解信息来习得语言。语法规则和操练的作用,比大多数课堂以为的要小得多。

这个想法几乎支撑了所有现代语言学习方法,比如泛读、学习者播客、看带字幕的电视剧、沉浸式学习法 和故事式教学。本指南会解释这个理论从何而来,什么才算可理解输入,如何找到自己的 i+1 水平,以及你现实中需要多少输入。我们也会避免那些看起来很精确但其实很虚的数字。

一个人站在一幅墙壁大小的拼图前,画面是日常咖啡馆场景,两位朋友隔桌相对,几乎所有拼图块都已就位,画面清晰可辨,只剩两处拼图形的空缺,这个人正把一块发光的拼图举向最近的缺口,附近漂浮着三块备用拼图,分别带有耳机、翻开的书和场记板图标,展现语境如何帮助你补上「可理解输入」中缺失的那一块

理论部分: Krashen 的输入假说、i+1 与情感过滤器

Stephen Krashen 在 Principles and Practice in Second Language Acquisition (Pergamon Press, 1982) 中提出了他的二语习得模型,基于 1970 年代末的研究。这个模型包含五个假说,其中有三个对日常学习者最重要。

习得 vs. 学习

Krashen 明确区分 习得学习。习得是通过理解语言来无意识地吸收语言。学习是有意识地研究规则。在他的模型里,习得会带来流利、自动化的语言使用。学到的规则只充当一个“监控器”,也就是你在有时间思考时才会用的心理编辑器,比如写作时。儿童的母语完全通过第一种过程习得。Krashen 的观点是,成年人仍然可以使用这种过程。

输入假说与 i+1

输入假说是这个模型的核心。我们在理解信息时习得语言,而这些信息里包含略超出我们当前能力的结构。Krashen 把它简写为 i+1。不是 i+0,因为那很舒服但学不到新东西。也不是 i+10,因为那只是一堆噪音。这个“拉伸”必须足够小,语境才能带你跨过去。

它带来的实践结论很激进: 在这种观点下,你不需要先学习某个结构才能习得它。你需要在自己能理解的信息里多次遇到它。

“因此,最好的方法是那些在低焦虑情境中提供‘可理解输入’的方法,包含学生真正想听的内容。” — Stephen Krashen, Principles and Practice in Second Language Acquisition (1982)

情感过滤器

上面的引文指向第三块拼图: 情感过滤器假说。焦虑、无聊、缺乏自信会像过滤器一样,阻止输入被大脑处理,即使你听懂了也是如此。一个在课堂里紧张的学习者,可能听到很多可理解的语言,却习得很少。这也是为什么你真正喜欢的输入,比如你本来就会看的剧、你想追完的故事,往往比“很有价值但很无聊”的教材音频更有效。

一个场景的两半:左边一个紧张的人蜷缩在扶手椅里,身前是一整块高高的雾面磨砂玻璃,迎面而来的声波(携带着一本打开的书和一块场记板图标)撞上玻璃后碎裂四散;右边同一个人放松地微笑坐着,手捧一杯冒着热气的马克杯,旁边一只猫正熟睡,同样的玻璃已降到低矮的屏障,让同样的声波和图标流过并聚拢成头顶一圈温暖的光晕,展示克拉申的情感过滤假说

批评者怎么说 (以及它为什么仍然重要)

客观地说,输入假说影响巨大,但并非没有争议。研究者指出,i+1 很难定义到足够精确以便测试。还有人发现,只靠理解的学习者往往听力很强,但口语准确性落后。于是 Merrill Swain 提出,产出语言 (output) 也有独立作用。像 Lightbown 和 Spada 的 How Languages Are Learned (Oxford University Press) 这类领域综述,通常给出一个温和共识: 大量可理解输入对习得是必要的,而互动、产出和一定的显性教学能让它更有效,尤其对成年人。

对你这个学习者来说,结论在学术争论中依然站得住: 你大部分时间应该用来理解目标语言的信息,其他一切都是补充。

什么算可理解输入: 具体例子

对你来说,一段内容要成为可理解输入,通常需要三个条件:

  1. 你能理解信息。 不必懂每个词,但要懂它在表达什么。
  2. 有一点点拉伸。 有些词或结构是新的,但你能靠语境猜出来。
  3. 你在关注意义。 你在跟故事或对话走,而不是在分析句子。

同一个播客,对某个学习者可能是完美输入,对初学者可能是噪音,对高级学习者可能只是舒适的背景听力。基于这一点,下面是常见输入来源以及它们适合的阶段:

输入来源最适合为什么有效需要注意
分级读物初级到中级 (A1-B1)词汇被控制在固定等级,你能保持接近 98% 的理解率可能显得平淡,一旦觉得轻松就升一级
学习者播客初级到中级 (A1-B2)语速慢、发音清晰,话题日常,常带文本稿在慢速区停留太久会拖延真实语速听力
儿童节目较高初级 (A2-B1)句子简单,有画面支持,重复多奇幻词汇和歌曲多,不一定像看起来那么简单
带目标语言字幕的电视剧中级 (B1-B2)真实对话加上文字安全网,让内容保持可理解母语字幕会把听力练习变成阅读
可反复播放的短电影或剧集片段较高初级到高级 (A2-C1)短场景可重复,直到真实语速变清晰看一遍通常不够,重复才是方法
和有耐心的人对话所有水平对方会实时调整表达,这是最原始的可理解输入很难安排到足够多的小时数

有两项研究给“你能理解信息”这个条件提供了数字参考。阅读方面,Hu 和 Nation 发现,学习者需要认识小说文本中约 98% 的词,才能在大多数情况下不借助帮助而轻松阅读。覆盖率到 80% 时,几乎没人能跟上 (Reading in a Foreign Language, 2000)。视频方面,Webb 和 Rodgers 分析了数百部电影,发现要达到电影对白大约 95% 的覆盖率,需要掌握约 3,000 个最常见的词族,再加上专有名词 ('The Lexical Coverage of Movies', Applied Linguistics, 2009)。

这就是为什么“直接看母语者电视剧”对初学者常常失败: 在核心词汇量不足时,原生媒体是 i+10,不是 i+1。解决办法不是放弃媒体,而是增加支撑,比如更简单的材料、字幕、更短的片段、重复观看,直到它变得可理解。

一整幅从左到右渐变的街景全景:左端笼罩在浓厚的淡紫灰色雾气中,只能隐约猜出建筑和行人的模糊轮廓;而向右侧,同一条街道逐渐显现出清晰鲜艳的景象——条纹面包店遮阳篷、靠在路灯柱上的自行车、一只狗、阳台上的鲜花和两个交谈的人,仍有几缕薄雾萦绕在个别细节上;一个手持耳机的人正站在雾气消散、景象变清晰的分界处,望向清晰的一端,展现出噪音与可理解输入之间的差别

可理解输入 vs. 传统语法学习

这两种方法常被当作对立面。更公平的对比是这样:

可理解输入传统语法学习
能建立什么听力、阅读、语境中的词汇、对自然表达的语感对规则的显性知识、错误意识、考试表现
体验像什么看、读、听你喜欢的内容学习: 练习题、表格、讲解
弱点单靠它,准确口语产出会更慢,周与周之间进步不易察觉知道规则不等于能在对话速度下用出来
什么时候会失败输入太难或注意力飘走它变成全部方法而不是补充

基于证据的立场不是“语法没用”。显性教学确实能带来可测量的帮助,尤其对成年人,因为它能加速“注意到”。一旦有人指出某个模式,你在输入里就更容易捕捉到它,每次遇到的收益也更大。输入研究真正削弱的是那种倒置的课堂饮食结构: 90% 学规则,10% 接触真实语言。它会培养出能在纸上变位,却点不了咖啡的人。

一个对大多数自学者很合适的比例是: 把大部分时间花在你喜欢的输入上,准备一本语法参考书,当某个模式反复困扰你时再查。再用间隔重复来记住输入不断喂给你的词汇。

如何找到你的 i+1 水平

没人能替你计算 i+1,这也是学界对这个概念的常见批评。但你可以用经验方法在两分钟内找到它。

两分钟自测

拿一页文本或两分钟音频,检查:

  • 你能用自己的话说出发生了什么吗? 如果不能,那就太难了,没有例外。
  • 每分钟或每页大概有多少生词? 能靠语境猜出的一小把最理想。如果你每句话都需要词典,就降级。
  • 五分钟后你还在跟故事走吗,还是已经变成纯声音? 理解会随时间崩塌,说明难度略高,或支撑 (字幕、文本稿) 太薄。

结合覆盖率研究给一个粗略锚点: 选择你能理解大约 90-98% 词汇的材料。低于这个区间,你是在解码,不是在习得。

把输入映射到 CEFR 等级

如果你知道自己的 CEFR 等级,可以更快定位:

  • A1-A2: 同级分级读物、初级学习者播客、带画面的教师讲解视频、非常短的片段反复看。
  • B1: 儿童和青少年节目、自然语速的中级学习者播客、带目标语言字幕的情景喜剧、你已经读过译本的简单小说。
  • B2: 带目标语言字幕的当代剧集和电影、熟悉话题的母语者播客、你喜欢类型的普通小说。
  • C1 及以上: 任何内容,关闭字幕。此时任务是量和范围 (新闻、辩论、地区口音、老电影)。

最有用的习惯是 每隔几周重新测试一次。学习者常常在不需要时还保留“辅助轮”,比如 B2 还听慢速播客,B1 还开母语字幕。这种舒适会悄悄封顶你的进步。

一位微笑的成年人自信地骑着自行车沿着公园蜿蜒的小径前行,过弯时身体倾斜,后轮上仍然装着的辅助小轮悬空转动、毫无用处;小径旁的草地上放着一个打开的工具箱,上面放着一把扳手,旁边还有一副已经拆下来的辅助轮,小径继续向前延伸,通向阳光下的丘陵,展现学习者在早已不再需要之后,仍然依赖慢速音频和母语字幕等「辅助轮」的现象

用电视剧和电影做可理解输入

电影和电视剧从理论上说是最好的免费真实语言来源: 你可以无限量听母语者彼此对话,带情绪、有语境、有剧情,让你想继续听懂。问题在于,上面的覆盖率数字说明,对大多数 B1 以下学习者来说,原生媒体太难。你可以用三个杠杆缩小差距:

  • 目标语言字幕。 它把快速语音锚定到拼写,让你半听到的词变成你能认出的词。它是脚手架,目标是随着时间减少依赖,而不是永远阅读字幕。
  • 短片段而不是整集。 你能理解的 3 分钟场景胜过 40 分钟的迷雾。短片段也让第三个杠杆成为可能。
  • 重复。 第二遍和第三遍才是关键: 音频没变,但你的感知变了。原本糊成一团的台词会变成清晰的词。

这种组合,也就是真实片段、字幕和内置重复,正是 Wordy 的设计方式: 它用真实电影和剧集的短片段教学。每个片段都足够小,你可以真正理解并反复观看。你遇到的词会进入你的复习卡组。如果你更想自己搭建系统,我们的用电影学语言指南会讲手动做法。学习西班牙语的最佳电影清单也很适合作为第一批选择。

💡 一场景规则

如果你只从这一节带走一件事,那就是别再用“看了几集”来衡量电视剧时间。每天选一个场景,用目标语言字幕看一遍,再不看字幕重看一遍,然后把其中两三句台词大声说出来。这样做 20 分钟,从技术定义上说,比两小时半懂不懂的背景播放更接近可理解输入。

可理解输入的常见错误

输入其实并不可理解。 这是第一大失败模式。A2 听母语者播客,B1 看无字幕剧情剧。你如果无法总结刚听到的内容,那就不是输入,只是氛围音。别不好意思,降级就行。简单但大量,胜过困难但困惑。

被动暴露。 工作时把语言当背景播放几乎没用,因为习得需要对意义的注意力。专注的 10 分钟胜过分心的 3 小时。

永远用母语字幕。 如果你第一次看某个内容完全跟不上,母语字幕可以救场。但它会把听力练习变成阅读你自己的语言。尽早切换到目标语言字幕,只要你还能勉强活下来就切。

无尽的新鲜感。 每天一个新视频很有成就感,但新内容会最大化生词量。把词汇从“见过一次”推到“认识”的,是对熟悉材料的重复。保留一部“主力剧”,反复回看。

多年零产出。 一些输入至上社区建议很长的沉默期。短期沉默无害,但理解和口语部分是分开的技能。口语需要自己的重复训练。小而规律的产出,比如跟读台词、语音消息、每周一次对话,能避免差距越拉越大。

硬扛焦虑。 如果某个来源让你紧张或无聊,情感过滤器的观点认为,你从中获得的东西会比小时数显示的少。享受不是奢侈品,在这个方法里它是承重结构。

你需要多少输入?

诚实答案是: 需要很多。没人知道确切多少,而且高度依赖语言组合。给你三个真实锚点,而不是编出来的数字:

  • Cambridge English 估计每个 CEFR 等级大约需要 180-200 小时的指导性学习。这意味着从零到 B2 大约 500-600 小时的指导学习,外加自学时间。
  • US Foreign Service Institute 规划英语母语者学习近亲语言 (Spanish, French, Italian) 需要约 600-750 小时课堂时间。学习远亲语言 (Japanese, Korean, Arabic, Mandarin) 需要约 2,200 小时。这些是高强度课堂小时数。自学者应把它们当作总投入时间的下限,而不是上限。
  • 以输入为主的自学者常报告,在较容易的语言上,经过大约 1,000-1,500 小时 的专注听读后,能达到比较舒适的接近 B2 的理解水平。把它当作社群经验,不是研究结论。

有三个提醒能避免这些数字误导你。第一,真正算数的是 可理解 输入的小时数,所以初学者用分级读物的一小时,比听不懂的新闻电台一小时更值。第二,理解通常先于口语,所以“B2 理解”和“B2 对话”是不同里程碑。第三,分布很重要: 每天一小时坚持两年,胜过偶尔周末狂刷,因为规律暴露能防止词汇在两次接触之间衰退。

令人鼓舞的算术是: 每天专注一小时,一年约 365 小时。对近亲语言来说,这意味着两到三年后,你就能比较舒服地看剧和读书。而更早的里程碑,比如完整跟上一段场景、无痛读完一章,会更快到来。慢没关系。听不懂才是唯一真正的失败状态。

这周从哪里开始

可理解输入不是你买来的产品,而是你应用的筛选器: 这段内容是否大体能懂,是否略有拉伸,是否有趣到让我明天还会回来? 从三个动作开始:

  1. 对你正在用的材料做两分钟自测,如果没通过就降一级。
  2. 选一个“主力剧”或“主力读物”,围绕它安排每天 30-60 分钟输入。
  3. 加一个每周的产出习惯,再小也行,让口语和理解一起增长。

然后保护这个习惯,坚持几个月。这个理论争论了四十年,但它的核心预测是语言学习中最常被重复验证的体验: 只要你理解足够多的信息,语言就会开始黏在你身上。

常见问题

用最简单的话说,什么是可理解输入?
可理解输入就是目标语言里你大部分能听懂或读懂的内容,虽然它比你水平略高。你能靠语境、画面、语气或已知词汇理解意思,大脑会顺带吸收新内容。能懂 90%-98% 词汇的故事算可理解输入,只听懂十个词里一个的新闻不算。
i+1 是什么意思?
i+1 是 Stephen Krashen 用来表示理想输入难度的简写。'i' 是你当前语言水平,'+1' 是比它高一点点的新词或新结构,但你能从语境推出来。完全等于你水平的内容新东西太少,远超你水平的内容又解码不了,介于两者之间的拉伸区才最容易习得。
只靠可理解输入就够了吗?
输入是基础,没有大量输入就很难习得语言,但多数研究者认为它不是全部。只做输入的人往往听读进步快、口语滞后,这也是 Merrill Swain 提出'输出'重要性的原因。更实用的做法是把输入作为主要时间投入,同时规律练口语,并少量学语法,帮助更快注意到模式。
看电视剧算可理解输入吗?
可以,但前提是你能听懂大部分台词。Webb 和 Rodgers 的研究发现,要覆盖电影对白约 95%,大概需要最常见的 3,000 个词族,所以零基础直接看母语者电视剧通常会听不懂。用目标语字幕、看熟悉剧情、反复看短片段,都能把同一部剧变成真正的可理解输入。只当背景音效果很小。
达到 B2 大概需要多少小时的输入?
没有精确数字,给出唯一数字的人基本是在猜。两个相对可靠的参照:Cambridge English 估计从零基础到 B2 约需 500-600 小时的指导学习,U.S. Foreign Service Institute 对接近英语的语言规划约 600-750 课时,对差异更大的语言约 2,200 课时。以输入为主的学习者通常也在同一量级,常见是 1,000 小时以上的高质量听读才能较稳达到 B2 理解,口语还需要单独练。
零基础也适合用可理解输入吗?
适合,但一开始的输入必须大幅简化。初学者需要为学习者设计的材料,比如慢速语音、图片、手势、同源词和高频词,就像照护者对孩子说话或好老师在黑板上画图那样。分级读物、初级播客、短视频片段反复看都有效。母语电影和小说暂时不适合,因为理解低于约 90% 时,几乎吸收不到东西。

来源与参考资料

  1. Krashen, S., *Principles and Practice in Second Language Acquisition*, Pergamon Press, 1982
  2. Webb, S. & Rodgers, M.P.H., '电影的词汇覆盖率', Applied Linguistics, 2009
  3. Hu, M. & Nation, P., '未知词汇密度与阅读理解', Reading in a Foreign Language, 2000
  4. Lightbown, P. & Spada, N., *How Languages Are Learned*, Oxford University Press
  5. U.S. Department of State, Foreign Service Institute, 外语培训类别
  6. Cambridge English, 指导学习时长与 CEFR 等级参考

用 Wordy 开始学习

看真实电影片段,边看边积累词汇。免费下载。

在 App Store 下载在 Google Play 获取可在 Chrome 网上应用店获取

更多语言指南