导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

ChatGPT、Claude、Grok集体掉线,为何第一“背锅侠”又是Cloudflare?

9月3日晚,ChatGPT、Claude与Grok三家头部AI应用几乎同一时间出现服务中断。更值得注意的是,事发后业界第一反应不是排查自身服务,而是纷纷去看Cloudflare、AWS和Azure的状态页——尤其是Cloudflare。

然而最新状态信息显示,Cloudflare并未出现全球性重大事故,也没有证据表明三者的故障来自同一源头。那么问题来了:为什么现代互联网一旦出现大面积服务异常,Cloudflare总是最先被怀疑的名字之一?

ChatGPT、Claude、Grok集体掉线,为啥都怀疑Cloudflare?

一、为什么宕机总是联想Cloudflare?

很多人最早认识Cloudflare,是从CDN加速或DDoS防护开始。但如果今天仍只把它看作CDN公司,已经过时。打开一个网站,直观上是“用户→网站”;真实链路则复杂得多:用户→域名→DNS→Cloudflare→CDN/WAF/DDoS/身份验证/边缘计算→网站服务器。

也就是说,Cloudflare不一定拥有你访问的网站,却可能站在你和网站之间:网站要加速经过它,被攻击时挡在前面靠它,API请求、机器人流量、企业员工访问内部系统也要经过它。开发者把程序跑到边缘节点,有Workers;AI时代,模型API、AI Gateway、Agent、MCP也开始延伸。

Cloudflare自己的定位,就是一套服务于apps、agents和workforce的统一平台。将之视为互联网的“水电煤”,或许更准确。

Cloudflare——互联网基础设施

二、Cloudflare宕机,半个互联网一起报错?

位置越重要,出错的代价也越大。回看Cloudflare的宕机史,几乎是一部现代分布式网络故障警示录。

2019年,一条WAF安全规则中的正则表达式出错,把处理HTTP流量的CPU打满,核心代理、CDN、WAF全受影响,大量网站出现502错误。2022年,一次网络配置调整影响19个数据中心,且恰好是最繁忙的一批,一度波及约50%的请求量。

2025年,Cloudflare自身产品越多,事故也开始“内部传染”。6月Workers KV底层存储故障,连累WARP、Access、Gateway、Workers AI、Turnstile等服务持续两小时;11月一次数据库权限修改导致Bot Management配置文件膨胀到原来的两倍,同步到大量机器后,最终把核心网络流量搞出了问题——Cloudflare一度以为遭遇超大规模DDoS,排查后才知是自生成大文件。

Cloudflare故障排查

说到底,真正把小错误放大的,是Cloudflare所嵌入的位置——它已在太多网站、应用和服务的必经之路上。

三、AI时代最易忽视的“铲子”

如果将Cloudflare只看成“很关键的互联网基础设施公司”,其实还少看一层。过去几年其业务路径清晰:从CDN、DNS、DDoS防护,扩向Zero Trust、网络安全、Workers开发平台,现在又接上AI Gateway、Workers AI和Agent基础设施。

AI正在让这个位置更值钱。原因不复杂——Agent越多,网络请求越多,身份越多,安全需求也越多。传统互联网主要是人访问机器,一天请求量有限;Agent则完全不同,为完成一个任务可能连续搜索几十个页面、调用多个API,背后可能是几十上百次机器调用。当流量从Human-to-Machine走向Machine-to-Machine时,Cloudflare就是它们运行的平台和必经网络,理论上只会越来越忙。

最新财报也验证了这一趋势。季度营收达6.96亿美元,同比增长36%,增速从去年四季度、今年一季度的34%左右继续向上。年收入已超20亿美元后仍能重新加速,并不容易。8月初财报发布后,NET一度冲到330美元上方。不过,市场也已知道它的好,8月高点后股价出现回落。未来要看Agent带来的机器流量、安全需求和开发平台收入,能否跑得足够快,继续消化当下很高的预期。

这次ChatGPT、Claude和Grok集体故障虽然不是Cloudflare导致,但这个乌龙本身,很适合用来认识Cloudflare:我们平时看到的都是最上面那一层,今天是ChatGPT,明天是Claude,再过几年或许又换成新的Agent。应用会换、入口也会换,但只要它们还需要联网、访问数据、验证身份、调用API,也需要有人挡攻击,下面那层基础设施就不会凭空消失。甚至,机器越多,这一层可能越忙。Cloudflare押的,大概就是这件事。