考生刚从 HSK 考试中获得一个等级,随即又面临大学申请中要求的完全不同的标准——CEFR 等级,即 B2 或 C1。目前尚无任何对照表能清晰地将两者衔接起来;也没有官方的换算公式。首先需要明确一点:本篇HSK与CEFR的对照基于HSK 3.0版本——即九级分级体系,分为三个阶段(初级、中级、高级),该体系已于2026年7月完全取代了旧的六级考试。任何仍依赖HSK 2.0教材或旧版对照表的人,其参考标准都是考试中心已不再采用的旧体系。
HSK专门测评汉语能力,通过围绕该语言构建的固定等级体系和题型进行考核。CEFR的运作方式则有所不同——它描述学习者在A1至C2任何级别、任何语言中能够达到的能力,而不局限于某一项特定考试。

在HSK 3.0体系下,九个等级分为三个阶段:初级(1-3级)、中级(4-6级)和高级(7-9级)。有一项结构性变化对比较至关重要——从3级开始,口语已成为正式考核内容;而旧版六级考试则将口语作为独立的、通常为选考的测试(HSKK),而非将其纳入主考试体系。这一转变意味着,HSK 3.0中3级及以上的成绩已反映出一定的口语能力,这会影响如何将该成绩与始终涵盖听、说、读、写四项技能的CEFR等级进行对照解读。
将HSK等级与CEFR进行对比时,最好按“阶段”而非“等级”逐一解读,因为官方大纲是将学习成果归类于特定阶段,而非仅凭4级与5级等单纯的等级来证明完全相同的能力水平。任何特定级别的成绩仅反映考生在该阶段考试形式下的表现——这并不保证其阅读、听力、口语和写作能力均等,因为学习者可能仅凭词汇量和结构化任务就轻松通过考试,但在即兴对话中却仍感到困难重重。
CEFR完全摒弃了“考试与语言”的对应模式。其六大等级和“能力陈述”被大学和雇主广泛采用,无论分数背后对应的是哪种语言。有三点使其在实践中依然实用:描述标准与实际任务相关而非语法点;适用于数十种语言而非仅限于某个考试体系;以及在招生、课程分班或课程设计需要共同参考点时,它总能派上用场。
将HSK等级映射到CEFR时应视为一个范围,因为这两个体系的设计初衷并非逐级对应。下文参考了官方HSK 3.0的阶段描述、CEFR的一般能力描述,以及接受性技能(阅读、听力)与产出性技能(口语、写作)的划分,而非仅凭词汇量来证明特定等级。

第1级至第3级构成HSK 3.0的“初级”阶段,大多数HSK等级与CEFR对应表将这一范围定位在A1-A2左右。这种重叠在理论上合乎逻辑:两个体系都描述了围绕日常话题展开的简短、可预测的交流,而非抽象内容,因此在一个体系中该阶段基础扎实的学习者,在另一个体系中往往也表现得同样扎实。
这种看似清晰的重叠有其简单的解释:两个框架初期的学习任务都高度依赖于背诵的句式和熟悉的情境,这使得学习者在掌握基础之后开始显现的技能失衡——例如阅读强而口语弱——尚无充分体现的空间。
一旦学习者达到HSK 3.0的中级阶段(第4-6级),大致对应CEFR的B1-B2级别,两者的对比就会明显变得不那么稳定。试想这样一个人:他能相当流利地阅读新闻文章,也能跟上母语者之间的快速对话,但在构思即兴回应时仍会犹豫——这种认知与产出之间的差距,正是单一CEFR标签开始产生误导之处。
各来源在此阶段存在分歧,主要有以下具体原因:有些更重视词汇量而非任务表现;有些则根据所比较的HSK级别或CEFR考试的不同,侧重测试不同的技能;此外,不同机构对B1与B2描述符实际要求的解读也各不相同。
HSK 3.0的高级阶段由第7至第9级组成,大致对应CEFR的C1-C2级别——尽管在该等级区间,HSK与CEFR的对应关系远不如低级别时可靠。第8级或第9级的优异成绩确实反映了真实的考试表现,但这并不意味着考生在任何情况下都能像稳定的C1或C2水平使用者那样进行语言运用。
使这一阶段最为复杂的因素包括:阅读速度以及处理内容密集、生僻文本的能力;词汇深度延伸至正式和抽象的主题领域;以及在真实的时间压力下(而非受控的考试环境中)进行口语和书面表达的能力。考试当天表现出色可能掩盖了某些不足,这些不足往往只有在考生需要就陌生话题连续交谈数分钟时才会显现,而非仅仅回答一套预先准备好的固定问题。
导致这两个体系之间存在差距的因素主要有三点。HSK是一项针对特定语言的考试;CEFR则是适用于数十种语言的参考框架。两者在各项技能的权重分配上也存在差异——HSK 3.0从3级起设有的必考口语部分,无法与CEFR在口语与其他三项技能权重上的权衡标准完全对应。此外,HSK的原始分数反映的是考试表现,而CEFR的描述性标准则描述的是学习者通常能做到的事情——这两种不同类型的信息虽然贴着看似相似的标签,但实质不同。
HSK通过单一考试机构的固定结构,专门衡量汉语水平。CEFR则描述任何语言的能力,完全不与任何单一考试挂钩。
这种差异在实际应用中同样显现。一名学生可能在词汇和阅读任务上轻松通过HSK 3.0第5级,但若由参照CEFR标准的面试官评估其即兴口语,可能会将该学生的口语能力评定为更接近B1,而非该级别名义上所暗示的B2——考试分数与能力描述标准针对同一个人回答了不同的问题。
从更根本的意义上讲,该框架本身也与考试分数运作方式不同:HSK认证的是在特定日期进行的一次具体考试的表现,而CEFR等级则描述了一种普遍能力,教师、雇主或招生官会根据他们所掌握的任何证据——如面试、写作样本或课程记录——来推断这种能力。
不同的对照表依据的是不同类型的证据,这正是为什么一个来源的对应关系看起来可能比另一个更严格。基于词汇量的对照表回答了一个狭义的问题——该级别要求掌握多少个单词——却很少说明学习者是否真的能够进行对话。而基于课程大纲的对照表则追踪学习者相对于标准教学大纲所处的位置,而不考虑原始词汇量。基于实际能力观察的对照则更贴近真实使用场景:此人能否真正完成眼前的任务,而与教学大纲规定其此时应掌握的内容无关。
HSK等级与CEFR的对应关系会因特定来源采用上述哪种方法而有所变化——侧重词汇量的对照表可能看起来比基于实际任务表现构建的对照表更为宽松,而这种差异更多地反映了方法本身的差异,而非两张对照表中存在任何错误。
这种对照比较在少数特定情况下才真正有价值:例如申请表要求填写CEFR等级,而申请人仅持有HSK成绩;或学习者因学习英语或法语已熟悉CEFR术语,希望大致了解自身汉语水平;又或者教师在规划课程时需要一个大致的参考点,而非精确的数值。
交换项目、学位申请及奖学金评审委员会是这种对照最常出现的场合——持有HSK证书的学生需要将其转换为采用CEFR标准的机构所认可的等效水平。从这个角度来看,HSK与CEFR的对照仅作为粗略的转换工具,而非绝对保证。
不过,这种对照确实存在实际局限。有些大学明确要求提供HSK证书且不接受其他证明;另一些则接受多种证明形式,并根据具体项目采取不同的评估标准。非正式的对照表不能凌驾于院校招生页面上的实际规定之上——在假设对照表的估算能满足特定要求之前,直接查阅该页面,可以避免日后大量徒劳的努力。
对于那些因学习英语或法语而已习惯以CEFR为参考框架的人来说,这为评估自己的汉语学习进度提供了一个现成的参照点——将HSK 3.0阶段与A1至C2进行对照,便能将一个陌生的数字转化为符合其已有认知体系的衡量标准。
以此方式进行比较,可以解答几个实际问题:学习者是仍在掌握基础知识,还是正在迈向独立使用语言的阶段,抑或是接近高级阶段所要求的阅读和写作水平。这种比较作为学习规划的参考比作为证书更有用——它有助于决定下一步的学习内容,而非向外部机构证明什么。
一个等级数字本身的重要性,远不如它实际能让你做到什么:能否不需每读几个词就停下来地阅读一篇短文,能否实时跟上课堂讲解,能否写出一篇条理清晰的短文,能否进行基础对话,或者能否处理一份正式文件。将分数与学习、工作或日常生活中实际遇到的任务进行对照,比单纯看数字本身能提供更有价值的参考。
解读分数实际意义的实用方法:
大多数将HSK与CEFR进行比较的讨论都忽略了这一点:学习者可能在阅读和听力部分表现优异,却在面对母语者不假思索就能回答的即兴提问时不知所措。某一项技能的出色表现,对其他技能的说明非常有限。

没有任何图表能给出精确的CEFR数值——最接近真实答案的方法是将推测结果与具体情境进行对照验证。以下四项任务值得尝试:在不要求重复的情况下跟上熟悉话题的正常语速对话;就某观点撰写一段简短文字;进行几分钟的口语交流而不需频繁重启;阅读日常文本而不需逐行翻译。这些都不需要在正式场合进行。诚实地完成这四项任务,往往比任何对照表更能说明问题。
HSK与CEFR只能进行大致的比较,绝非精确的换算——任何估算的准确性都取决于所涉及的HSK级别、实际测试的技能,以及最初生成该对照表所采用的映射方法。单次考试成绩很少能同时反映阅读、听力、口语和写作各方面的同等水平;对于任何正式场合——如申请或工作要求——接收机构自身明确提出的要求才是真正重要的,而非非正式的对照图表。
作为补充参考,Testizer提供了一项简短的在线语言水平测试,可结合考生现有的HSK成绩,对其实际水平进行二次评估。
这完全取决于具体院校和专业——有些明确要求HSK证书,有些则接受更广泛的证明材料。直接查阅大学自身的招生页面比依赖一般性建议更可靠,因为各校政策差异太大,无法一概而论。
在当前HSK 3.0的考试体系下,这种情况比以前少见了,因为口语现在从3级开始就纳入了考试内容,而不是作为单独的可选测试。话虽如此,阅读和听力仍可能比即兴口语进步得更快,因此通过考试并不保证各项技能的水平都同样出色。
在高级别中,词汇量会急剧增加,且进步不再是线性的——从一个高级阶段迈向下一个阶段,通常需要的语言输入量远比通过初级阶段时要多得多。持续稳定的阅读和听力量,其重要性已超过任何单一的学习技巧。
有些雇主将HSK成绩视为真正的筛选指标,尤其是当职位要求入职第一天就能使用中文时。另一些雇主则几乎不看成绩,而是更倾向于通过现场对话或与工作直接相关的任务来评估——证书最终只是众多参考因素之一,而非决定性因素。