中国大规模模型的创新与突破。2026年6月17日,智谱科技发布了GLM-5.2,该模型在Artificial Analysis智能指数中跻身全球第三,富瑞的报告称之为“中国人工智能发展的一座里程碑”。仅一个月后的7月16日深夜,月之暗面推出了Kimi K3,这款拥有2.8万亿参数的模型在Frontend Code Arena中以1679分夺得第一,Artificial Analysis智能指数达到57分,创下开源历史的最高记录。发布后48小时内,用户请求量几乎达到了计算集群的负荷极限,月之暗面随即宣布暂停C端的新用户订阅;而在72小时内,美国股市的AI板块蒸发了4700亿美元,费城半导体指数在一周内下跌了12.5%。这一切被市场称为“DeepSeek时刻2.0”。
进入8月,全球最大的AI模型调用平台OpenRouter上,前十名模型中有六个来自中国,其中排名第一的DeepSeek V4 Flash在一周内处理了8.2万亿tokens,环比增长超过999%。而美国的最强模型GPT-5.6 Luna则位列第五。该平台的用户中有47%来自美国,只有6%是中国用户。a16z的合伙人马丁·卡萨多在接受《经济学人》采访时透露,众多寻求融资的硅谷AI初创公司中,使用中国开源模型的比例可能高达80%。a16z还引用了Sensor Tower关于Kimi K3付费订阅的统计,引发广泛关注:“美国人在争论中国AI,而全世界在购买它。”
与此同时,资本市场也在增加对中国AI的投资。据悉,月之暗面F轮融资早在6月就已经启动,许多投资者在K3发布之前就完成了决策,最终融资额超过35亿美元,约合人民币250亿元。在这一轮融资中,国家人工智能产业投资基金作为独家领投方,其他投资者还包括国寿、工商银行、农业银行、建设银行、中信及中金公司等。而早前的老股东如腾讯、美团、红杉资本、IDG和宁德时代等,则继续加码和跟投。
从GLM-5.2进入全球前三到K3登顶编程榜,再到DeepSeek在调用量上领先,中国开源模型正在逐步从次要地位迈向主流。面对拥有强大资本和计算能力的国际巨头,中国的模型公司宛如面对希腊神话中的奥德修斯,虽然在力量上不占优势,但依然通过智谋和高效的资源利用、架构创新、开源生态和资本组织方式开辟了新路径。
在这一发展中,被忽视的中国大模型正是其“起点”。2024年底时,中国模型在OpenRouter上的token份额不足2%,被视为“便宜但不够好”的选择。然而,2025年初,随着DeepSeek-R1推理模型的开源,国内大模型企业开启了多轮开源浪潮,逐步打破了行业内“开源低配”的潜规则。在过去的一年里,国产模型在9个月中保持着全球开源模型的规模上限。工信部在今年7月发布的数据表明,中国的开源大模型全球累计下载量已超100亿次。根据Hugging Face 2026年春季报告,中国自研开源模型的下载占比首次超过美国,成为全球每10次大模型下载中的6次皆来自中国。
随后的转折发生在今年7月,当Kimi K3发布时,其达到了2.8万亿的总参数,单次推理激活的参数大约为1040亿——有896个专家中每次激活16个,稀疏度达到了56:1。自研的KDA混合线性注意力机制将上下文窗口扩展至100万tokens。在Artificial Analysis的智能指数评测中,K3得分57,在189款受测模型中名列全球第三,仅次于Claude Fable 5(60分)和GPT-5.6 Sol(59分),创造了开源模型历史的新高分——之前的开源最强模型GLM-5.2仅为51分,DeepSeek V4 Pro则为44分。国外分析师认为,在评测上,前沿与中端的差距在15分以上,而3分的差距意味着平手。
在多个单项测评中,Front Code Arena中,K3以1679的Elo分数登顶,七个细分领域的评测中拿下了六个第一,而在官方的长程软件工程评测SWE Marathon中,K3超越了Fable 5。发布当天,马斯克对此表示“令人印象深刻”,次日xAI即宣布启动Grok 4.6,参数目标直指2.8万亿。加州大学伯克利分校的教授Ion Stoica判断:中国开源模型与全球顶尖闭源模型的差距已从6至9个月缩短至2至3个月。Hugging Face的CEO克莱芒·德朗格也指出,中国在开源权重AI模型领域处于领先地位,有望在2026年底或2027年实现赶超美国的前沿大模型企业。