八月的大模型圈,有一组数字耐人寻味:在开放模型调用平台OpenRouter上,中国模型的token消耗占比已从2025年底的不足20%升至超过60%,美国模型则降至40%以下。支撑这一变化的,是整个夏天的密集开源。
8月3日,阿里巴巴发布Qwen3.8-Max,总参数2.4万亿,这是千问家族史上第一次把Max级旗舰权重开放下载;8月14日,智谱发布GLM-5.3(总参数约7400亿、激活400亿);8月26日晚两家几乎同时出手——智谱开源GLM-5.3-Flash(总参数3200亿、激活180亿),阿里开源Qwen3.8-Flash(总参数1250亿、每token仅激活60亿);8月28日,腾讯混元开源Hy4 preview(总参数7700亿、激活490亿,上下文突破1M)。短短一个月,国内头部厂商把“开源”从个别动作做成了集体节奏。
更值得琢磨的是开源背后的含金量。GLM-5.3-Flash在Artificial Analysis综合智能指数中拿到57分,与Anthropic的Claude Opus 4.8持平,价格却只有后者的四十分之一;更关键的是,它全部线上推理流量由10万张国产芯片集群承载,单token成本已与英伟达GPU相当。这意味着国产大模型第一次不是单靠“便宜”取胜,而是把性能、成本、算力底座三件事同时跑通。
有人把开源理解为“赔本赚吆喝”。但从模型下载量、开发者调用量这些硬指标看,开源其实是最划算的一笔长期投资:权重开放出去,换回来的是开发者的使用习惯、真实场景数据和生态位。当一家创业公司或一个学生团队能用几分之一的成本把前沿模型跑进自己的项目,创新就不再是少数巨头的专利。
当然,热闹之下也要保持清醒。开源不等于没有门槛——训练算力、数据质量、工程化能力依然是硬骨头;价格战背后,DeepSeek已在8月对部分模型实行峰谷定价,说明算力成本的压力真实存在。开源的价值,终究要落在“用得起、用得久、用得出成果”上。
对我们这些正在读书的年轻人来说,这个夏天的意义或许更直接:曾经需要申请、排队、付费才能获得的前沿模型能力,如今下载权重就能上手。技术平权不是一句口号,它正在一行行开源代码里发生。(南昌大学 邹渠成)