英语之外,为何是中文
论中文作为人类第二语言的多维依据
The Chinese-language original of our essay on why Chinese may become humanity’s second language.
摘要
本文讨论一个嵌套的条件命题:如果人类只需要一种共同语言,那会是英语;如果人类还需要第二种,那可能是中文。本文不论证中文取代英语。英语作为第一通用语是全文的前提,全部论证只回答一个问题:“第二”是谁,为什么。
本文的核心主张是,选择“唯一”与选择“第二”遵循两种不同的逻辑。选唯一,比的是总覆盖与网络效应:英语拥有约14.9亿使用者,其中约四分之三是第二语言使用者,并已被科学、航空、互联网与国际组织锁定为通用标准。选第二,比的是在英语之外的边际增量、与英语的互补性以及可及性。按这一判据,中文约11.83亿使用者中约84%为母语者,而中国的英语普及程度偏低,这使中文成为英语之外最大的“原生人口块”。即使假定中文使用者中有将近一半会英语,中文带来的增量仍超过任何其他候选语言的全部使用者;以经济体量与知识产出加权,结论更加稳健。
中文还具备其他候选语言都没有的属性:汉字是以形表义的图画文字,能跨越读音差异被共同使用。千百年来,说不同方言的中国人,以及日本、朝鲜、越南的文人,共用同一套书写系统;面对新事物,这套系统又能按同一原理不断造字造词。
本文从语言学理论、文明演化、商业竞争与未来人类沟通四个视角检验上述判据,逐一比较西班牙语、法语、阿拉伯语与印地语,回应六种最强的质疑,最后给出命题中“可能”二字成立的四个条件:开放、活力、数字内容可达与持续可学。这四个条件都可以观测,也都可以被证伪。
关键词: 通用语;第二语言;英语;中文;边际沟通价值;表形文字;全球语言体系
一、引言:问题的提出
(一)为什么要问“第二”
全球化使共同语成为一种公共基础设施。贸易、科研、移民、旅行,乃至今天的人工智能与全球治理,都依赖低成本的跨语言沟通。语言与电话网、互联网一样具有网络外部性:使用的人越多,它对每一个使用者就越有用(Church & King, 1993)。因此,人类在共同语问题上不会“百花齐放”,而会向极少数几种语言集中。
在这极少数几种语言中,英语的地位已无悬念。荷兰社会学家 de Swaan(2001)把世界语言描述为一个分层的“星系”,英语是其中唯一的“超中心语言”;Crystal(2003)则把英语称为第一种真正全球性的语言。真正有意义、也真正有争议的,是下一个问题:英语之外,人类还需要什么?
这个问题在今天变得紧迫,原因有三。其一,世界经济与知识生产的重心正在东移,20世纪末以来制造与收入向亚洲回流的“大合流”(Baldwin, 2016),让英语覆盖不到的世界变得越来越重要。其二,英语单极格局本身有其代价:它把沟通的全部风险压在一个枢纽上,也让母语者享有结构性的语言特权(Van Parijs, 2011)。其三,机器翻译与生成式人工智能正在改变学习外语的成本与收益,有学者甚至预言英语将是“最后的通用语”(Ostler, 2010)。于是我们必须说清:为什么还需要第二种语言,如果需要,应该是哪一种。
这个问题对不同的人有不同的分量。对个人,它是“掌握英语之后,有限的学习时间投向哪里回报最大”。对各国教育政策,它是第二外语课程如何设置。对国际中文教育,它关乎自身的理论依据是否站得住。
(二)命题的结构
命题是一个嵌套的条件句。第一次选择在一张白纸上进行:如果只能有一种,选哪一种?第二次选择则在“英语已被选定”的前提下进行:在已有英语的世界里,再加哪一种?两次选择的判据截然不同。混淆两者,是许多相关讨论的根本缺陷:例如把西班牙语“分布国家多”、法语“国际组织地位高”当作它们成为第二语言的理由,其实是在用第一次选择的判据回答第二次选择的问题。
命题的两半句语气也不同:前半句说“会是”英语,后半句说“可能是”中文。前者是对现状的判断,后者是对趋势的判断,其成立有赖于条件。本文不回避这个差异,而把“可能”的成立条件当作论证的一部分,在第十一节列出四个可观测、可证伪的条件。一个没有边界的命题说服不了专家;一个标出边界的命题,才能接受检验。
需要特别说明的是本文的立场:本文不论证中文会取代英语。英语作为第一通用语是全文的前提,全部论证只回答“第二”是谁。这并非谦辞。第三节将说明,英语的地位由网络效应与制度锁定决定,在可预见的将来不会改变;第八节的语言竞争模型也显示,“唯一”的位置只会有一个。
最后,“需要”指的是功能性需要。共同语是母语之上的交流工具,与取代母语或削弱语言多样性无关。恰恰相反,第八节将论证,“一主一次”的格局比英语单极更有韧性,也更有利于保留人类思想的多样性。
(三)研究问题与方法
本文回答四个问题:选择“唯一通用语”应看什么,英语为何胜出;在英语已存在的前提下,第二通用语应看什么;按此判据,中文是否优于西班牙语、法语、阿拉伯语、印地语等候选;对中文最有力的质疑是什么,能否回应。
在方法上,本文综合使用全球语言体系理论、语言经济学、文字学、文化演化理论与网络科学的成果,辅以多指标比较。对数据不确定的环节,本文采用“占优推理”:不依赖精确估计,而是证明结论在最不利的合理假设下依然成立。对每一个论点,本文尽量给出三样东西:理论机制、可核查的证据、最强的反例与适用边界。全文引用的文献与数据来源集中列于文末。
(四)全文结构
第二节界定概念并建立论证框架。第三节论证第一命题,即为什么唯一的是英语。第四节给出全文的核心论据:中文的边际沟通价值最大。第五至第八节分别从语言学理论、文明演化、商业竞争与未来人类沟通四个视角检验这一论据。第九节与其他候选语言比较,第十节回应最强的质疑,第十一节给出结论、成立条件与启示。
二、概念界定与论证框架
选“唯一”与选“第二”是两道不同的题:前者求总覆盖最大,后者求英语之外的增量最大、与英语的互补最强。这一区分是全文的论证支点,下图概括了全文的结构。

图:全文论证结构 · 两种选择逻辑、四个视角、三步检验
左支给出英语,右支给出中文;四个视角只服务于右支,因为第一命题是现状判断,第二命题才需要论证。
(一)通用语与全球语言体系
通用语(lingua franca)指母语不同的人之间用于交流的共同语言。本文只讨论全球层面的通用语,即跨越国家与大洲、在科学、商业、外交与日常交往中被广泛使用的语言。
de Swaan(2001)提出的“全球语言体系”是讨论这一问题的标准框架。在这个体系里,世界上绝大多数语言是边缘语言;它们通过多语者连接到更高层的中心语言,中心语言又连接到约十二种超级中心语言,包括中文、西班牙语、法语、阿拉伯语、印地语、俄语等;处在顶端、把所有超级中心语言连接起来的,是唯一的“超中心语言”——英语。体系的连接者是多语者:一种语言被以其他语言为母语的人学得越多,它在体系中的位置就越高。
在这一框架下,本文命题可以重述为:英语是唯一的超中心语言;在超级中心语言中,中文最有资格成为全球语言体系的“第二极”。
de Swaan 还给出了衡量一种语言“沟通价值”的指标,即 Q 值:
其中 是普及度,即会说语言 i 的人占全部人口的比例; 是中心性,即多语者中会说语言 i 的比例。普及度衡量“有多少人说”,中心性衡量“有多少人把它当作桥梁”。第四节将说明,中文普及度高而中心性低,这一特点恰恰是它作为第二语言的优势,而非弱点。
本文的“使用者”包括母语者(L1)与第二语言使用者(L2);“中文”指普通话(现代标准汉语)及其汉字书写系统;“需要”以四类功能衡量,即沟通覆盖、经济机会、知识获取与文明理解。
(二)两种选择逻辑
第一种逻辑适用于选“唯一”。如果全人类只能共享一种语言,应当选择已经连接最多人、且最难被替换的那一种。语言选择是一种协调博弈:每个人学哪种语言,取决于别人学哪种(Selten & Pool, 1991)。一旦某种语言越过临界规模,每多一个学习者就使它对下一个学习者更有价值,均衡随之自我强化(Church & King, 1993)。因此第一通用语的判据是“总覆盖×网络效应”。
第二种逻辑适用于选“第二”。在英语已被选定的前提下,再学一种语言的价值,不取决于它本身有多“国际化”,而取决于它额外连接了多少英语连接不到的人、市场与知识。Ginsburgh & Weber(2011)在讨论“人类需要多少种语言”时,用“失语率”衡量一组语言把多少人排除在外。借用这一思路,第二语言的选择可以写成:
式中 是语言 L 的使用者集合, 是英语使用者集合,只计英语覆盖不到的部分; 是权重,可以取 1(按人头计),也可以按收入或知识产出加权。这个式子表达的含义很朴素:哪种语言能让全球“失语”的人减少最多,哪种就是第二。
两种逻辑会导向截然不同的答案。一种在国际组织里广泛使用的语言,如果它的使用者大多同时会英语,它的边际价值就不高;反之,一种外国学习者不多、母语人口却极其庞大且很少会英语的语言,边际价值就很高。前者在第一种逻辑下得分高,后者在第二种逻辑下得分高。命题问的是第二种。
(三)三个判据与一个独有属性
根据第二种逻辑,本文用三个判据衡量候选语言。
- 增量价值:在人口、经济、科技与数字世界中,它占据英语之外多大的一块。这是第四节的核心论据。
- 互补价值:它与英语在文明、文字与语言类型上差异多大。差异越大,“英语+X”的组合覆盖的人类经验就越广。这如同投资组合:两项资产的相关性越低,分散化的收益越大。
- 可及性:学习成本,以及教材、考试、技术与制度等传播基础设施。
除此之外,中文还有一项其他候选语言都不具备的属性:表形文字的跨语音通用性。以形表义的汉字能被读音不同的人共同使用,历史上已经是跨方言、跨国界的书面通用语。第五节与第六节将分别从文字理论与历史两方面论证这一点。
(四)四个视角
三个判据需要在不同层面接受检验。本文选取四个视角:语言学理论看语言与文字本身,文明演化看长时段的历史,商业竞争看激励与成本,未来人类沟通看技术与风险。每个视角都会同时检验多个判据。
| 视角 | 核心理论工具 | 主要检验的判据 | 章节 |
|---|---|---|---|
| 语言学理论 | 语言生态位假说、信息论、文字系统理论、认知科学 | 互补、可及、表形属性 | 第五节 |
| 文明演化 | 文明核心理论、轴心时代、集体大脑 | 互补、增量、表形属性 | 第六节 |
| 商业竞争 | 贸易引力模型、本地知识、结构洞、网络产业理论 | 增量、可及 | 第七节 |
| 未来人类沟通 | 机器翻译之辩、网络韧性、语言竞争动力学 | 增量、互补、可及 | 第八节 |
第九节的比较则把上述判据落实为具体指标:学习成本、与英语网络的重叠程度、第三方排名、核心优势与短板。
三、第一命题:为什么唯一的是英语
如果全人类只能共享一种语言,英语是唯一现实的答案。原因不在于英语“最好”,而在于它最早越过了网络临界点,并被一整套制度锁定。下面从规模、结构、历史、制度与知识生产五个方面说明这一点。
(一)规模与分布:世界最大的第二语言社群
据 Ethnologue(2026)的数据,英语使用者约14.93亿,其中母语者约3.72亿,第二语言使用者约11.21亿。二语者是母语者的3倍,也是世界第二大二语社群(现代标准阿拉伯语,约3.35亿)的3倍以上。在分布上,英语是58个主权国家和28个非主权地区的官方语言,遍及各大洲(Wikipedia, 2026a)。
这组数字的含义比数字本身更重要。通用语本质上是“他人的语言”,是不同母语者共同借用的工具。英语的二语者远多于母语者,说明它已高度“去民族化”:今天大量英语交流发生在非母语者之间,这正是“英语作为通用语”(ELF)研究的出发点(Seidlhofer, 2011)。
(二)结构:一种被外人“打磨过”的语言
社会语言类型学的一个重要发现是:当一种语言被大量成年人作为第二语言习得时,它的形态复杂度会被削减(Trudgill, 2011)。英语正是这样的例子。在与古诺斯语、诺曼法语的长期接触中,英语失去了语法性别,名词格只剩属格与代词格,动词变位大幅精简。McWhorter(2007)把英语列为“曾被大规模非母语习得”的五个案例之一。再加上只有26个字母的拉丁字母表、开放而善于吸收外来词的词汇系统,英语的入门门槛相对较低。
英语的弱点同样必须如实承认。它的拼写与读音对应极不规则,习语繁多;母语者因此在国际交流中享有结构性的“语言特权”,构成一种语言不公(Van Parijs, 2011)。这些不足并未动摇英语的地位,恰恰说明它的地位来自网络效应,而非语言本体的优越。
(三)历史:两次“帝国接力”
英语是历史上第一个在每一个大洲都有人使用的通用语(Ostler, 2010)。它的扩张经历了两次接力:19世纪,英国将英语带到各大洲;20世纪,美国在经济、科技、流行文化与战后国际秩序中接棒(Crystal, 2003)。工业革命、现代科学建制与互联网都在英语世界成熟,英语因此成为现代知识体系的“母版”。两次接力的叠加,使英语同时占据了殖民遗产的广度与战后秩序的高度。
(四)制度:被写进规则的语言
网络效应一旦形成,就会被制度固化。从博弈论看,语言学习是一种协调博弈,均衡一旦落在英语上,每个人的最优选择都是继续学英语(Selten & Pool, 1991;Church & King, 1993)。Van Parijs(2011)进一步指出一种“最大化最小理解”(maximin)机制:多语群体总会选择“掌握最差的人也最懂”的那种语言。因此,每一次跨语言的会议、谈判与合作,都在为英语投票。
这种选择已被写进行业规则。国际民航组织(ICAO)在2003年修订《芝加哥公约》附件,要求参与国际运行的飞行员与管制员英语能力达到“运行4级”(Wikipedia, 2026b);国际海事组织的《标准航海通信用语》以英语为基础;联合国秘书处的工作语言是英语和法语。规则一旦写入,换语言就不再是个人选择,而是整个行业的集体行动。
(五)知识与数字生产:人类知识的“主存储器”
在科学领域,自然科学类被索引的论文中英语占比超过90%;同一项研究还发现,在同一期刊内,非英语论文被引用的机会明显更低(Di Bitetti & Ferreras, 2017)。引用激励又反过来把更多研究者推向英语,形成自我强化的循环。
在数字世界,已知内容语言的网站中有49.5%使用英语(W3Techs, 2026);在最新一次 Common Crawl 公开网页抓取(CC-MAIN-2026-39)中,英语页面约占41.9%(Common Crawl, 2026)。大语言模型的训练语料以此类公开网页为主要来源之一,英语因此也成了人机交流的默认语言。
(六)小结:第一命题的强度与边界
英语的地位由人口、结构、历史、制度与知识五把锁共同固定,而且五把锁彼此加固。要替换它,必须让五者同时转向,这在可预见的将来不可想象。这正是本文把第一命题作为前提、而不讨论“取代”的原因。
同时,英语的“唯一”来自历史路径与网络效应,而非语言本体的优越。这一点决定了第二语言的竞争规则:它不能与英语“比总量”,只能“比增量”。下一节就从这里出发。
四、核心论据:中文的边际沟通价值最大
在英语覆盖不到的人群中,中文使用者是最大的一块:约11.83亿人,近乎第三名印地语(约6.11亿)的两倍,且八成以上是母语者。这是全文最重要的一条论据,其余各节都是对它的检验与延伸。

图:数据:Ethnologue(2026),经维基百科汇总,详见文末 · 总数取公布值
蓝色为中文:仅其母语者一段,就长过英语以外任何语言的全部使用者。
(一)事实:两种截然不同的人口结构
据 Ethnologue(2026),中文(普通话)使用者约11.83亿,其中母语者约9.88亿,居世界第一;第二语言使用者约1.94亿,主要是中国境内以其他汉语方言或少数民族语言为母语的人。在英语与中文之后,没有任何语言的使用者超过7亿:印地语约6.11亿,西班牙语约5.61亿,现代标准阿拉伯语约3.35亿,法语约3.34亿。
更值得注意的是结构。英语约四分之三的使用者是二语者,它是覆盖全球的“共享层”;中文约84%的使用者是母语者,它是一个英语难以触及的“原生人口块”。一个是“二语型”语言,一个是“母语型”语言。两者的人口结构恰好互补,这是中文增量最大的结构性原因。
(二)稳健性论证:不依赖精确估计的“占优”推理
要计算中文的增量,需要知道中文使用者中有多少人能用英语沟通。设这一比例为 x。x 没有精确统计,但论证并不需要它。我们只问:x 要多大,中文的增量才会被某个候选语言超过?为了让考验尽可能严格,假定其他候选语言与英语毫无重叠,即它们的全部使用者都算作增量。最大的对手是印地语:
也就是说,只要中文使用者中会英语的不超过一半左右,中文的增量就大于任何候选语言的全部使用者。现实中的 x 远低于这个临界值:EF 英语熟练度指数(2025)在123个参评国家和地区中把中国列为“低熟练度”,得分464(EF, 2025)。没有任何合理估计会认为中国有近半人口能用英语交流。
还可以做一个更严格的检验。印地语与乌尔都语在口语上基本互通,如果把二者合并计算(直接相加得约8.57亿,这是包含重复计算的上限),临界值降到约28%,中文依然占优。何况印度有10.6%的人口(约1.29亿人)在人口普查中报告会说英语(Census of India, 2011),印地—乌尔都语的实际增量远小于8.57亿。对西班牙语、法语而言,它们与英语世界的重叠更高,实际增量更小。
这一推理的价值在于:排序对参数的不确定性不敏感。无论 x 的真实值是5%、10%还是20%,结论都不变。一个在最不利假设下仍然成立的结论,才经得起专家的推敲。
(三)加权检验:从“人头”到“价值”
按人头计算只是第一步。对学习者而言,一种语言的价值还取决于它所连接的经济与知识。下面把第二节式中的权重 换成经济与知识指标。
以经济体量加权,中国名义GDP约20.85万亿美元(2026年估计,世界第二),按购买力平价计算约44.29万亿美元,居世界第一;2025年中国经济约占世界名义总量的17%、购买力平价总量的19%(IMF, 2026)。在所有非英语语言社群中,没有任何单一经济体接近这一体量。
以知识产出加权,结论同样明确。2024年全球专利申请达到创纪录的约370万件,中国创新主体提交约180万件,接近全球总量的一半;其后依次是美国(约50.2万件)、日本(约41.9万件)、韩国(约29.6万件)与德国(约13.3万件)(WIPO, 2025)。这些申请绝大多数以中文提交。在衡量高质量自然科学研究的自然指数中,中国2024年的贡献份额(Share)为32,122,居世界首位,比2023年增长17%,全球前十的科研机构中中国占八席(Nature Index, 2025)。
这里需要一个严谨的限定。中国学者的论文多以英文发表,因此科研产出衡量的是“以中文为工作语言的科研共同体”的规模——实验室、研讨会、工程文档与指导关系多用中文,而不是中文文献的数量。专利原文则是直接的中文知识存量。
人口、经济、知识三种权重下,中文的增量排序都居首。这是核心论据的第二重稳健性。
(四)回应“中心性”质疑
对这一论据,最专业的质疑来自 de Swaan 的 Q 值。中文的外国二语者少,中心性低,按 Q 值衡量,它的全球“沟通价值”会被压低。
但 Q 值回答的是“它在现有多语者中担当了多少桥梁”,而第二语言问的是“它能连接多少英语连接不到的人”。对后一个问题,中心性低恰恰是论据:它说明这十一亿多人无法经由任何其他语言触达,要连接他们,只能学中文。学习者稀缺也意味着个人回报更高,第七节将把这一点展开为“稀缺溢价”。
更重要的是两者的可变性不同。中心性可以被教育与贸易抬高,第六节将说明它正在上升;而这样规模的原生人口块,任何其他语言都无法复制。
(五)小结
在英语之外,中文连接的人最多、经济最大、知识生产最活跃,而且这一结论不依赖任何敏感参数。这就是“如果人类还需要第二种语言,可能是中文”最直接的理由。
五、语言学理论视角:一对结构互补、都适合外人学习的大语言
语言学不支持“某种语言天生更优越”之类的说法,本文也不作此主张。语言学支持的是另外四点:英语与汉语都是被成年外人大规模学习过、因而形态极简的语言;二者在语言类型与文字系统上相距最远,组合的信息增益最大;汉字是以形表义的图画文字,能跨越读音被共同使用,并能不断生长;中文的难点集中在入门层,结构层反而简约。
(一)语言生态位:大语言会“进化”出通用语形态
Lupyan & Dale(2010)对2000多种语言进行了大规模统计,发现语言结构在一定程度上由社会结构决定:使用人口越多、分布越广,屈折形态就越简单。使用者超过10万的语言,拥有简单动词变位的可能性约为使用者少于10万的语言的6倍。他们把这一规律称为“语言生态位假说”:语言如同生物,会适应其所处的社会生态。机制在于,成年二语学习者难以掌握复杂的屈折变化,当他们大量进入一个语言社区,冗余的形态会在几代人之内被“磨平”(Trudgill, 2011)。
McWhorter(2007)在《Language Interrupted》中挑选了五个“曾被大规模非母语习得”的标准语言作为案例:英语、普通话、波斯语、阿拉伯口语与马来语。他指出,普通话与其他汉语方言相比声调更少,音节末尾可出现的音更受限,体标记、否定标记与引导成分也更少;他把这些简化归因于唐代前后大量异族成年人迁入中国北方并学习汉语。
这一发现对本文命题意义重大。英语与普通话,恰是历史已经“在海量外人身上试验过”的两种大语言。普通话几乎没有屈折:没有时态、格、性的变化,复数标记“们”使用有限且可选,语法关系主要靠词序与虚词表达。对学习者而言,普通话的结构层是简约的,它的难点在别处——汉字与声调。从语言生态位的角度看,人类的前两种通用语落在这两种语言上,并非偶然。
(二)信息论:不夸大“效率”,只主张“互补”
关于语言“效率”,有一项必须引述的研究。Coupé et al.(2019)测量了17种语言的口语,发现它们的信息传递速率惊人地接近,平均约每秒39比特。普通话语速较慢、每个音节承载的信息较多,西班牙语等语速快、每音节信息较少,二者相抵。因此,本文不主张“汉语说起来更高效”。这类说法经不起专家追问,也不是本文论证所需。
信息论真正能为本文提供的,是“互补”的形式化。作为一种类比,可以把学习第二语言带来的“新信息”看作条件熵:
一种语言与英语的“互信息”越少,即越不相关,掌握它带来的新增视野就越大。这一类比可以落实为可测量的指标:用《世界语言结构地图集》(WALS)的类型特征衡量语法距离,用 ASJP 数据库衡量词汇距离。西班牙语、法语、德语与英语同属印欧语系,同用拉丁字母,共享大量同源词;中文则在语系、文字、音系(声调)与语法类型上全都不同。在“互补”这一判据上,中文在所有大语言中得分最高。
(三)文字系统理论:汉字是表形的图画文字
先界定术语。本文所说的“图画文字”取广义:指字形以图像为根基、主要通过字形而非读音来表达意义的文字,即“表形文字”;与之相对的是用字母记录语音的“表音文字”。这不同于文字学中专指“前文字阶段”的狭义用法(裘锡圭, 1988)。明确定义,是为了把讨论从术语之争引向实质问题。
汉字与英语文字的本质区别,在于字形连接的是什么。汉字的字形直接连接意义,是表形、以形表义;英语的字形连接语音,是表音、以形记音。索绪尔(1916)把世界文字分为表意与表音两大体系,正是以汉字作为前者的典型。
汉字的图像根基清晰可见。甲骨文中象形字约占四分之一;后起的会意字、形声字,也多由象形构件组合而成——“林”是两棵树,“河”由“水”与“可”组成(Wikipedia, 2026c)。汉字系统本质上是一个“图像构件的组合系统”。
以形表义的证据有三层。
第一层在字的内部。形旁稳定地提示意义类别:“氵”与水有关,“木”与树木有关,“扌”与手的动作有关。声旁则常因语音演变而失准:“江”从“工”得声,今天却读 jiāng。读者从字形获得的意义线索,比读音线索更可靠。
第二层在使用者之间。汉语各方言在口语上往往互不相通,却共享同一种书面语;口语不通的中、日、朝、越文人曾长期凭字形“笔谈”(见第六节);受过训练的读者能直接读两千多年前的文献,而英语读者不经专门训练,已难读懂六百年前的乔叟。拉丁字母能书写数以百计的语言,却不能让这些语言的使用者读懂彼此的文本;汉字却能让口语不通的人读懂同一篇文本。这是“表形”与“表音”之别最有力的证据,也是汉字天然具备“书面通用语”潜质的根源。
第三层在大脑之中。Tan et al.(2005)发现,中国儿童的汉字阅读能力主要依赖书写与字形分析能力,语音意识的贡献很小,这与拼音文字阅读高度依赖语音意识的规律截然不同;研究者概括为“学中文靠手,学英文靠耳”。Bolger et al.(2005)的元分析也表明,大脑的阅读网络既有跨文字的共性,又会随文字系统而调整。“表形”与“表音”的区别,在神经与认知层面有可测的对应。
这一立场需要正面回应学界主流的质疑,例如现代常用字中形声字占多数、许多字已看不出原图,第十节(五)将逐条作答。汉字的代价也必须如实承认:学习者需要记忆数千字形,读写习得期更长。这一代价正被拼音、输入法与人工智能大幅抵消(见第八、第十节)。
(四)适应力:一个能不断生长的开放系统
汉字不是一套封闭的图画,而是能按同一原理不断生长的开放系统。它对新事物、新情况的适应力,体现在三个层面。
第一,造新字。日本为本地特有的动植物与事物造出了“国字”,如“榊”(木+神,神社所用的神木)、“畑”、“鰯”,它们大多用会意法造成(Wikipedia, 2026f)。现代汉语也为新发现的化学元素造字:2017年发布的113、115、117、118号元素中文名为“鿭、镆、鿬、鿫”,形旁“钅、石、气”分别标示金属、固体非金属与气体类别,声旁取自元素名的读音;其中三个新字随后被收入 Unicode 11.0(Wikipedia, 2026g;Unicode IRG, N2198)。读者即使不认识这些字,也能从形旁看出它属于哪一类元素。
第二,组新词。新概念多靠现有语素组合进入汉语,如“电脑、手机、互联网”;或音义兼顾地吸收外来词,如“基因”。词汇在增长,汉字的数量却不必同步增长。
第三,跨国再造与回流。明治时期,日本学者在翻译欧洲的政治、哲学、法律与科学著作时,用汉字造出或赋予新义的“哲学、社会、经济、科学、革命、电话、银行、共和国”等词,19世纪末至20世纪初经译著与留日学生大量进入现代汉语(Wikipedia, 2026h)。其中“经济”“革命”等本是中国古词,在日本获得了现代含义。同一套以形表义的语素,能在不同国家被直接理解、再造并回流。这是表形文字特有的开放性:它把整个汉字文化圈变成了一个共享的语素库。
(五)透明性:词汇与数字的认知红利
汉语词汇的构词高度透明。“飞机、氧气、心脏病、低血糖”,知道语素就能推出词义;英语的专业词汇则多来自拉丁语、希腊语词根,如 hypoglycemia,对非专业者是不透明的。这意味着中文读者跨入一个新领域时,术语门槛更低。
数词系统是最清楚的例子。汉语的“十一”就是“十+一”,十进制结构一目了然;英语的 eleven、twelve 则隐藏了这一结构。Miller et al.(1995)的跨文化研究发现,这种差异反映在儿童学数数的难易上,说汉语的学前儿童在早期数学能力上占有优势。这是语言结构影响认知发展的可测证据。
识字负担也呈现“前重后轻”的特点。周有光总结的“汉字效用递减率”指出,最常用的1000字覆盖约90%的文本,此后每增加约1400字,未覆盖部分就降为原来的十分之一:2400字覆盖约99%,3800字覆盖约99.9%(Wikipedia, 2026d)。1988年发布的《现代汉语常用字表》中,2500个常用字的覆盖率为97.97%,加上1000个次常用字达到99.48%(Wikipedia, 2026e)。学习者付出的主要成本集中在最初的两三千字,越过这一阶段,边际成本迅速下降。
(六)语言与世界观:第二语言的价值在异质性
从洪堡特(1836)的“语言世界观”到维特根斯坦“我的语言的界限意味着我的世界的界限”(《逻辑哲学论》5.6),哲学传统一直认为,学习一种新语言,就是获得一种看世界的新方式;新语言与已有语言差异越大,收获越大。
这里必须谨慎。“语言决定思维”的强版本语言相对论已被学界否定;“语言影响注意与记忆习惯”的弱版本有实验支持,但仍存争议。本文只使用弱版本,并且不依赖它:即使不谈思维方式,英汉双语者掌握的也是两套差异最大的语言与文字系统,以及它们各自承载的文献传统。
(七)小结
语言学给出的不是“中文更好”,而是四点更实在的结论:中文与英语都是被外人打磨过的大语言;二者最互补;汉字是能跨越读音、跨越国界被共同使用并不断生长的表形文字;中文的门槛在字与调,属于入门成本,而非结构成本。
六、文明演化视角:两大文明核心需要一条“双语接口”
在长时段里,人类文明始终有东西两个核心。英语是西方核心的当代载体,中文是东方核心延续至今的载体。从文明演化的角度看,第二语言的含义,是在这两个核心之间架设一条宽带接口。
(一)双核心:长时段的常态
历史学家 Morris(2010)尝试用一个“社会发展指数”定量比较东西方,指数由能量获取、组织能力、信息技术与战争能力四项构成。他所说的“西方”,是从东地中海发源、后来扩展到欧洲与北美的文明核心;“东方”则是中国。他的结论是,西方在数千年里占据领先,但从公元6世纪到约1750年,东方领先了约1200年(Long Now Foundation, 2011)。这个指数的构造当然有争议,但“两个核心轮流领先”的判断与经济史研究相互印证。
Pomeranz(2000)的“大分流”论认为,直到约1800年,欧洲与中国最发达地区的差距才正式拉开;Broadberry, Guan & Li(2018)用历史国民账户方法估计,分流开始得更早。分流的时点有争议,但两派都承认,在数百年里东西方是两个可以相互比较的强大中心。Baldwin(2016)则把20世纪末以来制造业与收入重心向亚洲回流的过程称为“大合流”。
把这些研究放在一起,可以得到一个简单的推论:“英语独大”是近两百年的现象,“双核心”却是更长时段的常态。当文明重心重新趋于平衡,语言格局从单极走向“一主一次”,是这种再平衡在语言层面的投影。这并不意味着英语的第一地位会动摇,而意味着第二个核心需要它自己的语言接口。
(二)连续性:三千多年未断的文明记忆
学界公认独立起源的文字有四种:楔形文字、埃及圣书字、汉字与玛雅文字。其中只有汉字延续至今;最早的甲骨文可追溯到商王武丁时期,约公元前1250年至前1200年(Wikipedia, 2026i)。
雅斯贝尔斯(1949)提出“轴心时代”概念:大约公元前800年至前200年之间,希腊、以色列、印度、中国几乎同时奠定了至今影响人类的思想框架。英语世界直接继承了前两个传统,却主要通过翻译接触后两个。在这四大传统中,中国传统的书写系统从未中断,仍在活用的使用者群体也最大。学习中文,是直接进入这一传统的原文,而不必经由译者的过滤。李约瑟(Needham, 1954–)的《中国科学技术史》则展示了这一传统中独立发展的科技脉络。
(三)历史上的“双通用语”格局:命题并非新构想
“一主一次”的双通用语结构,在历史上的大型文明体系中并不罕见。
罗马帝国是最著名的例子。拉丁语是帝国的行政与法律语言,希腊语则是帝国东部的通用语,也是哲学与科学的语言。罗马精英以“兼通两语”(utraque lingua)为教养的标志(Adams, 2003)。在伊斯兰世界,阿拉伯语是宗教与学术语言,波斯语则在广大的东部地区长期承担行政与文学通用语的角色(Green, 2019)。
东亚的情形与本文关系最密切。文言文曾是中国、日本、朝鲜半岛与越南长达一千多年的共同书面语。从隋代直到20世纪初,口语不通的各国文人与使节靠“笔谈”交流:他们各自读音不同,却能读懂对方写下的汉字。1905年前后,越南革命家潘佩珠与梁启超在日本会面,潘佩珠能读写汉文,其汉越读音却无法被对方听懂,两人便坐在桌前,来回传递写满汉字的纸张(Wikipedia, 2026j)。这一场景恰是“表形文字能跨越读音”的历史实证。
这一遗产至今可见。日语《新选国语辞典》(2002)收录的词条中约49%是汉字词;在不同语体里,娱乐杂志用词约35%为汉字词,报纸用词超过一半,科学杂志用词达到60%(Wikipedia, 2026k)。语体越正式、越专业,汉字词越多——在汉字文化圈内,汉字至今仍是知识的语言。
由此可见,大型文明体系常见“一主一次”的双通用语结构,而中文并不是一个“候选新人”,它拥有千年的区域通用语履历。本文的命题,实际上是让这一履历在全球尺度上延续。
(四)集体大脑:连接两个最大的知识网络
文化演化理论认为,一个社会的创新速度取决于其“集体大脑”的规模与连通度:人越多、联系越紧密,知识的传递与重组就越高效(Muthukrishna & Henrich, 2016)。今天世界上最大的两个知识网络,分别以英语和中文为工作语言(数据见第四节)。二者之间的连通度,直接影响人类整体的学习速度;英汉双语者与翻译,就是连接这两个网络的桥梁。
多样性还是一种进化保险。单一语言、单一思想框架的系统更脆弱,一旦出错难以纠正;保留一个成熟、独立、与主流差异最大的文明“操作系统”,是降低系统性风险的选择。法国哲学家于连(Jullien, 1995)正是从这个意义上把中国当作欧洲思想的“外部”:正因为汉语思想在印欧语法框架之外独立发展,它最能暴露西方思想中被视为理所当然的前提。
这一洞见并不新。远在1697年,莱布尼茨就在《中国近事》序言中写道:他认为这是命运的奇特安排——人类最高的教养与文雅,今天仿佛集中在我们大陆的两端,即欧洲与中国(Leibniz, 1697)。本文命题可以看作这一洞见在语言层面的版本。
(五)制度化:中文的国际存在正在沉淀
中文是联合国六种正式语言之一。在教育层面,截至2025年,已有86个国家将中文纳入国民教育体系(中国日报, 2025);截至2023年底,海外正在学习中文的人约3000万,累计学习和使用中文的人接近2亿(界面新闻, 2024)。与中文所连接的经济体量相比,这些数字仍然偏小——这既是差距,也是空间(见第七节“稀缺溢价”)。
(六)小结
文明演化视角把命题从“国力比较”提升到“结构需要”:双核心的人类文明需要双语接口;历史上的大型文明体系常有“一主一次”的通用语;而中文在东亚已有千年的通用语履历,其表形文字正是这一履历的基础。
七、商业竞争视角:语言是贸易成本,中文是最大的“未对冲敞口”
语言差异是一种可以测量的贸易成本。在英语之外,中文联结的是世界最大的贸易国与制造国,而懂中文的外国人又极少。这两点加在一起,使中文成为商业上边际回报最高的语言。
(一)语言即贸易成本:引力模型的证据
国际贸易的引力模型长期被用来估计共同语言对双边贸易的影响。Egger & Lassmann(2012)汇总了81篇论文中的701个估计值,元分析显示,共同语言平均使双边贸易直接增加约44%。
Melitz & Toubal(2014)为195个国家构建了新的语言数据集,把“共同官方语言”“共同母语”“共同实际口语”与“语言相似度”分开测量。他们发现,所有语言因素加在一起的效应,至少是传统“共同官方语言”虚拟变量所显示效应的两倍;“沟通便利”独立于族群与信任而发挥作用;翻译与口译服务也显著促进贸易。
这些研究的含义很直接:语言障碍是真实的成本,降低它的回报与对方的经济体量成正比。对英语世界而言,与世界最大贸易国之间的语言障碍,是规模最大、也最少被“对冲”的一项语言成本。
(二)市场与供应链:绕不开中文的生产网络
中国是世界最大的贸易国与货物出口国,其制造业产出超过其后九个最大制造国之和(Wikipedia, 2026l)。与世界各国的贸易关系也已发生结构性变化:2001年中国加入世界贸易组织时,有数据的国家中超过八成与美国的贸易额大于与中国;到2018年,190个国家中已有128个与中国的贸易额超过与美国的贸易额(Lowy Institute, n.d.)。
对企业而言,这意味着大量供应链关系的另一端说中文。在中国占据关键地位的产业中,如电池、光伏与电动汽车,可以合理推断,一手的技术文档、行业标准与工程交流大量以中文进行。这一判断值得通过产业案例进一步检验;但即使只看贸易总量,中文也已是英语之外最重要的商业语言。
(三)本地知识:翻译替代不了的部分
哈耶克(Hayek, 1945)在《知识在社会中的运用》中指出,经济中最关键的知识,是关于“特定时间与地点的具体情况”的知识。这种知识分散在无数当事人手中,难以集中,也难以转译。
中国市场正是这样一个本地知识密集的环境。政策细则、地方标准、消费者评论、行业论坛、招投标公告,只以中文存在,并且更新极快。机器翻译降低了“读懂一段文字”的成本,却没有降低“知道该读什么、如何解读语境”的成本。商业竞争优势恰恰在后者:谁能最先发现、最准确地理解本地信息,谁就能最先行动。
(四)稀缺溢价:供需比最高的语言技能
一种语言技能的市场价值,取决于需求与供给之比:需求来自该语言所联结的经济体量,供给来自掌握该语言的外国人数。西班牙语、法语拥有众多外籍掌握者;中文所联结的经济约占世界名义总量的六分之一,海外学习者却只有约3000万(见第四、六节),其中达到熟练水平的更少。供需比越悬殊,单位技能的溢价就越高。
这与第四节的“中心性低”互为表里:对全人类而言,它是增量;对个人而言,它是溢价。需要注意的是,稀缺溢价会随学习者增加而下降,但在可预见的将来,学习者的增长远不足以填平这一缺口。
(五)结构洞:站在两大网络之间
社会学家 Burt(1992)的“结构洞”理论指出,当两个网络彼此隔绝时,连接它们的中介者拥有信息与控制上的优势。英语网络与中文网络之间的结构洞,是当今世界规模最大的一个。英汉双语者、双语企业与双语平台,是这一结构洞最大的受益者。
这种需求还是双向的。中国企业在电动汽车、电池、光伏、跨境电商、短视频等领域走向海外,在当地创造了对懂中文人才的需求;外国企业进入中国市场或与中国供应商合作,同样需要这样的人才。
(六)网络产业经验:为什么是“一主一次”,而不是赢家通吃
语言是典型的网络产品:一种语言对学习者的价值,随其他使用者数量增加而增加(Katz & Shapiro, 1985)。网络产业的经验表明,强网络效应的市场并不总是赢家通吃,常见的是“一主一次”的双寡头格局,如移动操作系统、大型客机制造与银行卡组织。第二名得以长期存续的条件,是拥有庞大且黏性的自有用户基数。
中文约9.88亿母语者,正是这样的“装机量”。西班牙语、法语的用户基数更小,而且与英语网络高度重叠,难以形成独立的第二极。
从博弈论看,在“人人学英语”的均衡下,一个理性学习者选择第二语言的最优反应,是“边际价值÷学习成本”最高的那一种。对占世界多数的非印欧语学习者而言,中文的比值最高;对英语母语者而言,西班牙语因学习成本低而构成真实的竞争(详见第十节)。
(七)小结
商业竞争视角从激励与成本两端支持命题:语言障碍是可测的贸易成本,中文联结的是最大的贸易与制造体系;本地知识无法被翻译完全替代;学习者稀缺带来溢价;而网络产业的常见均衡,恰恰是“一主一次”。
八、未来人类沟通视角:人工智能时代更需要第二通用语
人工智能不会取消“第二语言”问题,而会重塑它。当机器承担起日常翻译,人类需要的是在两大人工智能与数字生态之间直接理解、校验与建立信任的双语能力——而这两大生态,恰是英语与中文。
(一)最强的反论点:机器翻译会让第二语言过时吗
对本文命题最根本的挑战来自技术。Ostler(2010)在《最后的通用语》中认为,英语可能是人类最后一种通用语:随着机器翻译的进步,人们将不再需要人工中介来口译或笔译。如果这一预言成立,“第二语言”的问题似乎就失去了意义。本文从三个方面回应。
第一是对称性。机器翻译对所有语言同等地降低沟通成本。它改变的是“有多少人需要学第二语言”,而不是“哪一种语言排第二”。命题本身是条件句——“如果人类还需要第二种语言”——它回答的是排序,而非总量。
第二是翻译的边界。信任的建立、复杂的谈判、法律与外交文本、思想与文学,都依赖对语境与弦外之音的直接理解。Melitz & Toubal(2014)的研究显示,语言对贸易的影响既有“沟通便利”的渠道,也有族群与信任的渠道;翻译能改善前者,却难以替代后者。更重要的是,越依赖机器,就越需要能校验机器的人。在跨语言的法律文件、科技报告与外交交流中,最终负责的仍然是人。
第三,人工智能反而降低了学习中文的门槛。语音识别可以即时纠正声调,拼音输入法让书写不再依赖手写记忆,对话式人工智能可以随时解释每个字的字源与用法。汉字与声调这两个传统门槛,正在被技术大幅削减。技术对学习成本最高的语言帮助最大。
(二)双极人工智能生态:训练机器的两种语言
人工智能本身正在形成中美两极。斯坦福大学以人为本人工智能研究院在一项分析中指出,2024年8月至2025年8月,中国开发者占 Hugging Face 平台全部模型下载量的17.1%,略高于美国开发者的15.8%;2025年9月,新发布的微调模型中有63%基于中国的基座模型,阿里巴巴的通义千问(Qwen)取代 Meta 的 Llama,成为下载量最大的语言模型家族(The Decoder, 2026)。
中文也是英语之外最大的单一语言数字生态。截至2025年12月,中国网民规模达11.25亿,互联网普及率为80.1%(中国互联网络信息中心, 2026)。
这里必须正视一个测量问题。在 W3Techs 的统计中,中文网站仅占已知内容语言网站的1.3%(W3Techs, 2026);在 Common Crawl 最新一次抓取中,中文页面约占4.2%(Common Crawl, 2026)。这与11亿网民的规模明显不相称。一个合理的解释是,中文内容大量存在于封闭的移动平台之内,公开网页的统计会系统性地低估它。但这也说明,中文数字内容的开放度与可检索性不足,这是中文成为第二通用语的一个真实短板。本文把它列为命题成立的条件之一(第十一节)。
把这些放在一起看,知识生产越来越由“数据+模型”驱动,而数据与模型高度集中于英语和中文两大生态。第二通用语因此也是“第二数据语言”。
(三)网络科学:双枢纽系统更有韧性
Albert, Jeong & Barabási(2000)发现,互联网、万维网与社会网络这类无标度网络有一个关键的不对称性:它们对随机故障极其稳健,却对少数枢纽节点的定向打击极其脆弱。
只有一种通用语的全球沟通系统,正是典型的“单枢纽”结构。一旦这个枢纽因政治、技术或平台原因受阻,整个系统都会受损。增加第二个大型且独立的枢纽,能显著提高系统韧性。这也解释了第二通用语为什么必须是“独立的大枢纽”:西班牙语、法语的使用网络与英语高度重叠,更像英语枢纽的卫星;中文网络则规模巨大且相对独立。
(四)语言竞争动力学:为什么是“一主一次”
Abrams & Strogatz(2003)建立了一个语言竞争的数学模型。模型显示,两种语言竞争时,地位较低、使用者比例低于临界值的一方会进入加速衰退;这一模型很好地拟合了威尔士语、苏格兰盖尔语与克丘亚语的历史数据。这解释了为什么“唯一”的通用语只会有一个。
Minett & Wang(2008)在这一模型中引入双语者与社会结构,发现提高语言地位、增加教育资源,可以使较弱的语言得以维持。换言之,第二语言能否长期站稳,取决于三个条件:母语基数、地位与教育供给。中文有近10亿母语者,地位与教育供给都在上升,是三项条件同时具备的唯一候选。
(五)全球公共问题:人类最重要的对话是英汉对话
人工智能安全、气候变化、核风险、公共卫生,这些全球性风险的治理都离不开英语世界与中文世界的合作。二者是全球最大的两个经济体,也是最大的两支人工智能力量。在高风险议题上,误解的成本最高,也最需要人类双语“接口”——能在关键时刻直接理解对方、校验机器译文的人。这是第二通用语最深刻的未来价值。
(六)小结
未来越依赖机器沟通,人类越需要在两大语言与数据生态之间保有直接理解的能力。“英语+中文”由此从个人选择,上升为人类沟通基础设施的冗余设计。
九、比较论证:为什么不是西班牙语、法语、阿拉伯语或印地语
三个独立的第三方排名中,中文在英语以外都位居第一或第二。唯一排在中文前面的,是英国视角下的西班牙语——而它恰恰输在本文最看重的两个判据:边际增量与互补性。
(一)多指标对照
| 候选语言 | 英语母语者学习时长(FSI) | 与英语网络的重叠 | PLI 排名(2016) | 核心优势 | 核心短板 |
|---|---|---|---|---|---|
| 中文 | 88周(IV类) | 低:中国英语熟练度“低”,使用者八成以上为母语者 | 2 | 最大增量人口;经济与知识体量;独立大枢纽;表形汉字可跨读音共享 | 字与调的入门成本;数字内容开放度 |
| 法语 | 24–30周(I类) | 高:同属印欧语系,英语词汇大量源自法语;法国熟练度“中等” | 3 | 国际组织与非洲的影响力 | 母语人口小;与英语同属欧洲文明圈 |
| 西班牙语 | 24–30周(I类) | 高:同属印欧语系、同用拉丁字母;西班牙熟练度“中等” | 4 | 易学;约20国官方语言;覆盖美洲 | 与英语网络重叠;经济与科研体量较小 |
| 阿拉伯语 | 88周(IV类) | 中低:沙特“很低”、阿联酋“低” | 5 | 宗教与地缘地位;覆盖中东北非 | 书面语与各地口语分离;学习成本与中文相当 |
| 印地语 | 约44周(III类) | 中:印度10.6%人口会说英语,集中于精英阶层 | 10 | 人口大、增长快 | 印度国内亦非全民通用;国际使用有限 |
表中学习时长来自美国国务院外交学院(U.S. Department of State, n.d.),熟练度分档来自 EF 英语熟练度指数(EF, 2025),排名来自 Chan(2016),印度数据来自人口普查(Census of India, 2011)。各语言的使用人数见第四节图表,此处不重复。
(二)第三方排名的交叉验证
全球视角的排名来自 INSEAD 的 Kai L. Chan(2016)提出的“语言力量指数”(PLI)。它从一个思想实验出发:如果一个外星人降落地球,哪种语言对它最有用?指数从地理、经济、沟通、知识与媒体、外交五个维度、二十项指标进行评估。结果是英语以0.889遥遥领先,普通话以0.411位居第二,其后是法语、西班牙语与阿拉伯语;指数还预测,到2050年英语仍将居首,只是差距有所缩小。这与本文的命题完全一致:英语第一,中文第二。
商业视角的排名来自彭博2011年的评选。它先选出母语人口最多的25种语言,再缩小到二十国集团中非英语国家的官方语言,最终的排序是:普通话第一,法语第二,阿拉伯语第三,西班牙语第四(ABC News, 2011)。
英国视角的排名来自英国文化协会的《未来语言》报告(2017)。它综合考虑了英国的企业需求、贸易目标、外交优先事项与互联网使用等因素,前五名依次是西班牙语、普通话、法语、阿拉伯语与德语(British Council, 2017)。
三个排名放在一起,可以看到一个清楚的规律:西班牙语只在“英语母语国”的排名中领先,原因是对英国人而言学习成本低、地理与贸易上邻近;一旦换成全球视角或商业视角,中文即居英语以外的首位。这一规律恰好印证了本文的边际框架:视角越接近“全人类”,中文的优势越明显。
(三)最强对手:西班牙语
西班牙语的优势是真实的。对英语母语者而言,它的学习时长约为中文的三分之一;它是约20个国家的官方语言,在美洲覆盖广泛。如果问题是“一个美国人或英国人明年学什么最容易见效”,西班牙语是很强的答案。
但命题问的是“全人类的第二语言”。在这个问题上,西班牙语在两个核心判据上都落后。就增量而言,即便假设西语使用者无人会英语,其增量也不到中文的六成(按中文使用者有两成会英语的保守假设计算)。就互补而言,它与英语同属印欧语系、同用拉丁字母、同属西方文明,是所有候选中互补性最低的之一。
至于“易学”,它是相对于学习者的母语而言的。FSI 的分级只适用于英语母语者。对占世界多数的非印欧语使用者而言,西班牙语的成本优势大幅缩小;对汉字文化圈的学习者而言,中文反而更易入门(见第十节)。
(四)其他候选
印地语人口众多,印度经济也在快速增长。但印度自身以英语为精英层的通用语,南北语言分野明显,印地语在印度国内尚非全民通用;它带来的增量中有相当一部分已被英语覆盖,国际使用也较有限。
阿拉伯语有重要的宗教与地缘地位,但存在“双层语言”现象:用于书面与正式场合的现代标准阿拉伯语没有母语者,各地口语差异很大。对英语母语者而言,它与中文同属最难的 IV 类,却没有中文所联结的经济与科技体量。
法语在国际组织与非洲有重要影响,但母语者仅约0.75亿,增长主要来自非洲的二语教育;它与英语同属欧洲文明圈,互补性低。俄语、德语、日语与葡萄牙语,则或规模不足,或与英语网络重叠,或人口正在下行。
(五)小结
比较的关键不在“谁更国际化”,而在“谁在英语之外增加最多、与英语重叠最少”。按这一标准,中文在综合排序中居首,只在“对英语母语者的学习成本”一项上落后。
十、反驳与回应
一个命题能否成立,要看它能否经受最强的反驳。本节预设六种最有力的质疑并逐一作答。其中,学习成本与地缘政治两点只能部分化解,本文把它们列入命题成立的条件(第十一节)。
(一)难学论:“美国外交学院把中文列为最难的一类”
这是最常见、也最有分量的质疑。美国国务院外交学院把普通话、阿拉伯语、日语与韩语列为 IV 类“超难语言”,英语母语者约需88周(2200课时)才能达到工作水平;西班牙语与法语属于 I 类,约24至30周(U.S. Department of State, n.d.)。本文承认:对英语母语者而言,学中文的时间成本约为学西班牙语的三倍。
但这一质疑需要放在正确的尺度上看。第一,难度是相对的。FSI 的分级只衡量英语母语者,难度取决于学习者母语与目标语之间的距离。对日本、韩国、越南等汉字文化圈的学习者,汉字与大量汉字词显著降低了入门成本;对占世界多数的非印欧语使用者,西班牙语也并不“容易”。命题讨论的是全人类,不是英语母语者。
第二,难点是结构性的。中文的难点集中在入门层:汉字与声调。语法层则极其简约,识字负担也“前重后轻”,最常用的1000字就能覆盖约90%的文本(见第五节)。这与屈折复杂、越学越难的语言恰恰相反。
第三,教学法与技术正在改变成本。利用汉字的表形理据,以构件与形旁为纲、借助图像讲解字源,可以显著降低识字的记忆负担;语音识别与人工智能陪练则削减了发音门槛(见第八节)。
第四,历史表明,通用语的地位由价值决定,而不由难度决定。拉丁语与文言文在各自的时代都不易学,却都成为了维持千年的通用语。
(二)国际化不足论:“中文主要还是中国人在用”
这一质疑在事实上是对的:中文的外国二语者比例低,中心性低。但如第四节所论,这恰恰是“增量”的来源——正因为中文使用者很少同时使用其他通用语,学中文才能连接到他们。
其次,国际化正在制度层面推进:已有86个国家把中文纳入国民教育体系(见第六节);海外华人社群遍布各大洲,构成了现成的网络节点。
最后,“国际化不足”是一个近代现象,而非语言的本性。在千余年里,中文曾是东亚跨国的书面通用语(见第六节)。它在过去做到过的事,没有理由认为它在未来做不到。
(三)人工智能翻译消解论
这一质疑已在第八节(一)详细回应。此处补充一点:即使人工智能使学习第二语言的需求普遍下降,命题的条件句“如果人类还需要第二种语言”依然成立。它回答的是排序,而非总量;任何需求水平下,排在第二的仍是边际价值最高的那一种。
(四)人口衰退论:“中国人口将在本世纪减半”
这一质疑有确凿的数据支撑。按联合国《世界人口展望2024》的中方案,中国人口将从2025年的约14亿降至2100年的约6.33亿;印度则将在2061年前后达到约17亿的峰值(Pew Research Center, 2025)。
本文的回应有三点。其一,语言影响力取决于经济、技术与制度,而非人口总量——英国本土人口始终只占世界的很小一部分,英语却成了全球通用语。其二,按同一方案,2050年中国人口仍约有12.6亿(Worldometers, 2026),在本世纪中叶,中文使用者仍将以十亿计;人口下降真正的风险,是创新与经济活力可能随之减弱,这被本文列为命题成立的条件之一。其三,印度人口虽已超过中国,但印度的精英通用语是英语,这扩大的是英语的规模,而非印地语的“第二”地位。
(五)对“图画文字”说的质疑与回应
本文把汉字界定为表形的图画文字。文字学界的主流表述与此不同:裘锡圭(1988)称汉字为“意符—音符—记号文字”,DeFrancis(1984)称之为“语素音节文字”。本文尊重这些表述,并在此正面商榷。专家最可能提出三点质疑。
质疑一:现代常用字中形声字占多数。在3500个常用字中,形声字约占58%(Wikipedia, 2026c),它们带有表音成分,因此汉字应称“意音文字”。回应是:形声字的两个构件本身大多源于象形;形旁表义稳定,声旁却常因语音演变而失准。读者实际依靠的是整字之形,而不是拼读——汉字阅读主要靠字形与书写记忆,语音意识的贡献很小(Tan et al., 2005)。
质疑二:“我、是、的”等大量常用字已经看不出原来的图形。回应是:一种文字属于什么类型,由它的字形连接什么决定,而不是由它的起源,或者能否“看图识字”决定。拉丁字母 A 也源于牛头之形,却因为它连接语音而属于表音文字;汉字的字形虽经隶变而抽象化,连接的仍是意义,故仍是表形文字。
质疑三:“图画文字”在文字学中特指前文字阶段,如纳西东巴文。回应是:本文已明确采用广义定义(见第五节)。汉字是一种“成熟的图画文字”:它通过假借与形声扩展了表达能力,能够完整地记录语言,但它的根本编码方式仍是以形表义。
决定性的证据来自使用。读音差异基本不妨碍人们共用同一套汉字:口语不通的各地中国人共用同一书面语,中、日、朝、越文人可以笔谈。边界同样说明问题:各地另造的文字分为两类。一类是为书写本地语言而借字记音:日语假名源自借汉字之音的“万叶假名”,用来书写助词与词尾变化(Wikipedia, 2026m);粤语的“嘅、咗、冇”书写虚词与常用词;越南喃字多为形声字,如表示“三”的𠀧由表音的“巴”与表义的“三”组成(Wikipedia, 2026n)。另一类是为本地特有事物新造的会意字,如日本国字“榊”“畑”“鰯”(Wikipedia, 2026f)。前者表明各地需要补充的是自己的语音与语法,后者表明以形表义的造字法本身能跨国界延伸。各地共享的,始终是以形表义的核心;这也证明了汉字系统面对新事物、新情况的适应能力。
(六)地缘政治论:“大国竞争会压制中文的国际地位”
这一质疑同样有事实依据。据美国政府问责局的报告,美国高校的孔子学院从2019年的约100所降至2023年的不足5所(GAO, 2023)。政治摩擦确实会抑制制度化的中文推广。
本文的回应是:第一,竞争反而会提高“理解对手”的需求。冷战时期,美国在1958年通过《国防教育法》后大规模资助俄语等关键语言的教学;对手越重要,它的语言就越需要有人懂。第二,语言的长期价值由经济与知识体量决定,而政治周期远短于语言周期。
本文也承认这一回应的限度:如果中国与世界的人员、贸易与信息交流显著收缩,命题中的“可能”就会失去根据。这正是第十一节把“开放”列为首要条件的原因。
十一、结论与启示
英语是“唯一”的现实答案,中文是“第二”的最优答案。命题中的“可能”二字,取决于四个可以观测、也可以被证伪的条件。
(一)结论
第一命题——如果人类只需要一种语言,那会是英语——是对现状的判断,确定性高。英语的地位由人口、结构、历史、制度与知识五把锁共同固定,在可预见的将来不会改变。本文把它作为前提,不讨论也不主张中文取代英语。
第二命题——如果人类还需要第二种语言,那可能是中文——得到了多重支持。在边际增量上,中文是英语之外最大的原生人口块,这一结论在人口、经济、知识三种权重下都成立,且对参数的不确定性不敏感。在互补性上,中文在语系、文字、音系与文明传统上与英语差异最大。在独有属性上,汉字是能跨越读音、跨越国界被共同使用,并能不断生长的表形文字。语言学理论、文明演化、商业竞争与未来人类沟通四个视角的检验结果一致。中文唯一明显落后的,是对英语母语者而言的学习成本。
两个命题合起来,描述的是一个“一主一次”的全球语言结构。它既是大型文明体系的历史常态,也是网络产业的常见均衡,还是比单极更有韧性的沟通架构。
(二)“可能”成立的四个条件
命题说的是“可能”,而不是“必然”。它的成立依赖四个条件:
- 开放:中国与世界的人员、贸易与信息交流保持开放。语言的吸引力来自它所连接的世界;一个封闭的世界不会让人想学它的语言。
- 活力:在人口下降的背景下,中文世界的经济与创新活力得以维持。
- 可达:中文数字内容的开放度与可检索性提高,弥合第八节指出的测量缺口。
- 可学:国际中文教育与技术持续降低入门成本,外国学习者规模持续增长。
这四个条件都有可观测的指标:外国中文学习者与汉语水平考试考生数、纳入国民教育体系的国家数、中文在公开网页语料中的份额、中国在全球贸易与专利中的份额,以及语言力量指数等第三方排名。如果这些指标在十年尺度上持续下行,本文的结论就应被修正。一个写明了如何被推翻的命题,才是一个可以被认真对待的命题。
(三)启示
对个人而言,“英语+中文”是覆盖面最大、互补性最强的双语组合。对汉字文化圈与非印欧语背景的学习者来说,它的“价值÷成本”比尤其高。
对各国外语教育政策而言,选择第二外语应看“边际价值”,而不是“国际化程度”。一种语言在国际场合被使用得多,不等于它能为学习者打开英语之外的世界。
对国际中文教育而言,最大的机会在于发挥汉字的表形优势:用图像、字源与部件讲汉字,用故事、漫画、影视、音频与游戏降低入门成本,用人工智能帮助学习者跨过声调与识字两道门槛。
对中文世界自身而言,提高数字内容的开放度,是扩大中文“第二通用语”地位最直接的杠杆。语言的价值在于连接,而连接需要开放。
(四)结语
三百多年前,莱布尼茨期待大陆两端的欧洲与中国彼此伸手。今天,英语与中文正是这两只手。它们不是竞争同一个位置的对手,而是人类沟通中最需要连在一起的两端。
参考文献与资料来源
正文采用“作者,年份”形式标注,全部引用集中列于此。标注“经……汇总”或“报道”者为转引,正式发表前建议核对一手出处。数据访问日期为2026年9月29日。
一、学术文献
- Abrams, D. M., & Strogatz, S. H. (2003). Modelling the dynamics of language death. Nature, 424, 900. 链接
- Adams, J. N. (2003). Bilingualism and the Latin Language. Cambridge University Press.
- Albert, R., Jeong, H., & Barabási, A.-L. (2000). Error and attack tolerance of complex networks. Nature, 406, 378–382. 链接
- Baldwin, R. (2016). The Great Convergence: Information Technology and the New Globalization. Harvard University Press.
- Bolger, D. J., Perfetti, C. A., & Schneider, W. (2005). Cross-cultural effect on the brain revisited: Universal structures plus writing system variation. Human Brain Mapping, 25, 92–104. 摘要
- Broadberry, S., Guan, H., & Li, D. D. (2018). China, Europe, and the Great Divergence: A study in historical national accounting, 980–1850. Journal of Economic History, 78(4).
- Burt, R. S. (1992). Structural Holes: The Social Structure of Competition. Harvard University Press.
- Chan, K. L. (2016). Power Language Index. INSEAD. INSEAD Knowledge 介绍
- Church, J., & King, I. (1993). Bilingualism and network externalities. Canadian Journal of Economics, 26(2).
- Coupé, C., Oh, Y. M., Dediu, D., & Pellegrino, F. (2019). Different languages, similar encoding efficiency: Comparable information rates across the human communicative niche. Science Advances, 5(9), eaaw2594. CNRS 新闻稿
- Crystal, D. (2003). English as a Global Language (2nd ed.). Cambridge University Press.
- de Swaan, A. (2001). Words of the World: The Global Language System. Polity.
- DeFrancis, J. (1984). The Chinese Language: Fact and Fantasy. University of Hawaii Press.
- Di Bitetti, M. S., & Ferreras, J. A. (2017). Publish (in English) or perish: The effect on citation rate of using languages other than English in scientific publications. Ambio, 46. 链接
- Egger, P. H., & Lassmann, A. (2012). The language effect in international trade: A meta-analysis. Economics Letters, 116(2), 221–224. 链接
- Ginsburgh, V., & Weber, S. (2011). How Many Languages Do We Need? The Economics of Linguistic Diversity. Princeton University Press.
- Green, N. (Ed.). (2019). The Persianate World: The Frontiers of a Eurasian Lingua Franca. University of California Press.
- Hayek, F. A. (1945). The use of knowledge in society. American Economic Review, 35(4), 519–530.
- Humboldt, W. von (1836). Über die Verschiedenheit des menschlichen Sprachbaues(洪堡特《论人类语言结构的差异》).
- Jaspers, K. (1949). Vom Ursprung und Ziel der Geschichte(雅斯贝尔斯《历史的起源与目标》).
- Jullien, F. (1995). Le Détour et l’accès. Grasset(英译本 Detour and Access, 2000).
- Katz, M. L., & Shapiro, C. (1985). Network externalities, competition, and compatibility. American Economic Review, 75(3), 424–440.
- Leibniz, G. W. (1697). Novissima Sinica(莱布尼茨《中国近事》). 序言引文见 LA Review of Books China Channel。
- Lupyan, G., & Dale, R. (2010). Language structure is partly determined by social structure. PLoS ONE, 5(1), e8559. ScienceDaily 报道
- McWhorter, J. H. (2007). Language Interrupted: Signs of Non-Native Acquisition in Standard Language Grammars. Oxford University Press. LINGUIST List 书评
- Melitz, J., & Toubal, F. (2014). Native language, spoken language, translation and trade. Journal of International Economics, 93(2), 351–363. 链接
- Miller, K. F., Smith, C. M., Zhu, J., & Zhang, H. (1995). Preschool origins of cross-national differences in mathematical competence: The role of number-naming systems. Psychological Science, 6(1). 链接
- Minett, J. W., & Wang, W. S.-Y. (2008). Modelling endangered languages: The effects of bilingualism and social structure. Lingua, 118(1), 19–45. 链接
- Morris, I. (2010). Why the West Rules—For Now. Farrar, Straus and Giroux.
- Muthukrishna, M., & Henrich, J. (2016). Innovation in the collective brain. Philosophical Transactions of the Royal Society B, 371(1690). 链接
- Needham, J. (1954–). Science and Civilisation in China(李约瑟《中国科学技术史》). Cambridge University Press.
- Ostler, N. (2010). The Last Lingua Franca: English Until the Return of Babel. Walker & Company. Omniglot 书评
- Pomeranz, K. (2000). The Great Divergence: China, Europe, and the Making of the Modern World Economy. Princeton University Press.
- Saussure, F. de (1916). Cours de linguistique générale(索绪尔《普通语言学教程》).
- Seidlhofer, B. (2011). Understanding English as a Lingua Franca. Oxford University Press.
- Selten, R., & Pool, J. (1991). The distribution of foreign language skills as a game equilibrium. In R. Selten (Ed.), Game Equilibrium Models IV. Springer.
- Tan, L. H., Spinks, J. A., Eden, G. F., Perfetti, C. A., & Siok, W. T. (2005). Reading depends on writing, in Chinese. PNAS, 102(23). 香港大学新闻稿
- Trudgill, P. (2011). Sociolinguistic Typology: Social Determinants of Linguistic Complexity. Oxford University Press.
- Van Parijs, P. (2011). Linguistic Justice for Europe and for the World. Oxford University Press.
- Wittgenstein, L. (1921). Tractatus Logico-Philosophicus(维特根斯坦《逻辑哲学论》).
- 裘锡圭(1988).《文字学概要》.商务印书馆。
二、数据、报告与资料来源
- ABC News (2011). Top 3 useful foreign languages for business excludes Spanish(报道彭博2011年商业语言排名). 链接
- British Council (2017). Languages for the Future. 新闻稿
- Census of India (2011). 英语使用者数据,经维基百科“Indian English”条目汇总。链接
- Common Crawl (2026). Statistics of Common Crawl Monthly Archives: Languages(CC-MAIN-2026-39). 链接
- EF (2025). EF English Proficiency Index 2025,经维基百科汇总。链接
- Ethnologue (2026). Most spoken languages,经维基百科“List of languages by total number of speakers”汇总。链接
- GAO (2023). China: With Nearly All U.S. Confucius Institutes Closed, Some Schools Sought Alternative Language Support(GAO-24-105981). 链接
- IMF (2026). World Economic Outlook 估计值,经维基百科“Economy of China”条目汇总。链接
- Long Now Foundation (2011). Ian Morris: Why the West Rules—For Now(讲座摘要). 链接
- Lowy Institute (n.d.). Chart of the week: Global trade through a US-China lens. The Interpreter. 链接
- Nature Index (2025). 2025 Research Leaders,新闻稿。链接
- Pew Research Center (2025). 5 facts about how the world’s population is expected to change by 2100(据联合国《世界人口展望2024》). 链接
- The Decoder (2026). China captured the global lead in open-weight AI development during 2025, Stanford analysis shows(报道斯坦福 HAI 分析). 链接
- Unicode IRG (N2198). 中国提交的新元素用字编码提案。链接
- U.S. Department of State (n.d.). Foreign Language Training(FSI 语言难度分级). 链接
- W3Techs (2026). Usage statistics of content languages for websites(2026年9月). 链接
- Wikipedia (2026a). List of countries and territories where English is an official language. 链接
- Wikipedia (2026b). Aviation English(ICAO 英语能力要求). 链接
- Wikipedia (2026c). Chinese character classification. 链接
- Wikipedia (2026d). Chinese character frequency(周有光“汉字效用递减率”). 链接
- Wikipedia (2026e). List of Frequently Used Characters in Modern Chinese(《现代汉语常用字表》,1988). 链接
- Wikipedia (2026f). Kokuji. 链接
- Wikipedia (2026g). Chemical elements in East Asian languages. 链接
- Wikipedia (2026h). Wasei-kango. 链接
- Wikipedia (2026i). Chinese characters. 链接
- Wikipedia (2026j). Brush talk. 链接
- Wikipedia (2026k). Sino-Xenic vocabularies. 链接
- Wikipedia (2026l). Economy of China. 链接
- Wikipedia (2026m). Kana. 链接
- Wikipedia (2026n). Chữ Nôm. 链接
- WIPO (2025). World Intellectual Property Indicators 2025,新闻稿。链接
- Worldometers (2026). China Population(据联合国《世界人口展望2024》). 链接
- 中国互联网络信息中心(2026).《第57次中国互联网络发展状况统计报告》。链接
- 中国日报(2025).2025世界中文大会报道。链接
- 界面新闻(2024).全球中文学习人数相关报道。链接
Discussion
Questions, corrections and your own examples are welcome. Please keep it kind and on topic.
Loading comments…