导语

长期以来,采用公有云托管源站的全球分发业务都会遇到一个隐蔽的性能坑:公有云的Anycast入口IP会让CDN的智能缓存调度失效,明明源站部署在新加坡,用户请求却可能被绕到芝加哥的缓存节点再回源,平白多了两次跨洋往返,延迟飙升的同时带宽成本也大幅上涨。Cloudflare近日上线的公有云专属智能分层缓存方案,正是为了解决这一痛点而生,无需改动现有架构,仅需几步配置即可大幅优化回源效率。

事实综述

Cloudflare第一代智能分层缓存早在2021年就已上线,核心逻辑是通过实时探测全球节点到源站的延迟,选择唯一最近的上层缓存节点集中处理所有回源请求,以此提升缓存命中率、减少回源连接数、降低回源延迟,该特性上线后很快成为Cloudflare最受欢迎的缓存拓扑,面向所有套餐用户免费开放。

但原有方案存在一个明显局限:当源站部署在公有云、使用云厂商提供的Anycast或区域单播入口IP时,延迟探测机制会失效——此时探测到的低延迟实际是云厂商边缘入口的延迟,而非源站真实部署位置的延迟,同一个源站IP可能同时显示和十几个Cloudflare节点的延迟都很低,原有机制无法确定唯一最优上层节点,只能保守 fallback 到多上层节点架构,虽然不会出现故障,但缓存资源被分散,命中率下降,甚至会出现严重的流量绕路:比如亚洲用户的请求先被转到芝加哥的上层节点,再回新加坡的源站,平白增加数百毫秒延迟,这类问题也是公有云源站用户反馈最多的性能痛点。

本次推出的公有云专属智能分层缓存方案针对性解决了这一问题:首先Cloudflare会自动识别Anycast类型的源站IP,用户仅需在后台的缓存配置页面,给对应源站IP设置云区域提示(例如aws:us-east-1gcp:europe-west1),系统就会自动完成后续的最优节点匹配。底层逻辑上,Cloudflare会每几小时同步一次支持的公有云厂商最新IP段映射表,结合每15分钟更新一次的全局节点延迟探针数据,为每个云区域匹配最优的主备上层缓存节点,主备节点部署在不同的PoP(接入点),避免单点故障。如果是新上线的云区域暂时没有足够的探针数据,系统会先 fallback 到地理最近的一级节点,等探针数据积累充足后自动切换到最优解。

目前该方案首期支持AWS、GCP、Azure、Oracle Cloud四家主流公有云服务商,后续会扩展更多厂商。配置方式除了后台手动单条或批量设置外,还开放了API接口,同时支持Terraform配置,可无缝融入现有基础设施即代码(IaC)工作流。

解读与评价

这一方案的推出精准击中了当前多云部署的普遍痛点:随着公有云的普及,Anycast入口已经成为云厂商的标准配置,此前行业内没有低成本的通用解决方案,企业要么接受回源效率低下的性能损耗,要么在每个云区域单独部署缓存层,运维和资源成本大幅提升。Cloudflare的方案相当于把多云场景下的全局缓存调度能力标准化、免费化,接入门槛极低,几乎没有试错成本。

对于中国出海开发者而言,这一方案的价值尤其明显:多数出海业务都会把源站部署在东南亚、欧美等区域的公有云,面向全球用户分发,跨区域回源的延迟和带宽成本一直是运营的核心开销之一,现在仅需花几分钟配置区域提示,即可免费获得10%-30%的跨区域访问延迟优化,同时降低跨区域回源的带宽成本,对跨境电商、内容平台、全球化SaaS等对延迟敏感的业务来说,用户体验的提升会直接转化为商业收益。

不过接入时也需要注意几点:一是配置的云区域提示必须和源站实际部署区域完全一致,否则反而会导致更严重的流量绕路;二是目前首期仅支持四家海外公有云,使用阿里云、腾讯云等国内云厂商海外区域的出海业务暂时还无法享受该优化,需要等待Cloudflare后续扩展支持;三是新上线的云区域初始阶段依赖地理位置匹配节点,可能存在1-2天的探针数据积累期,优化效果会逐步释放。