ChatGPT、Claude、Grok 集体掉线,为啥都怀疑 Cloudflare?

CN
45分钟前

既是互联网宕机的「背锅侠」,也是 AI 时代被容易被忽视的「铲子」。

9 月 3 日晚,ChatGPT、Claude、Grok 三家头部 AI,几乎同一时间掉线。

小声吐槽:现在连宕机都有「新御三家」了,Gemini 已经排不上号了么。

更有意思的是,出事以后,不少人的第一反应,是去看 Cloudflare、AWS 和 Azure 的状态页,尤其是 Cloudflare。

只不过,这次锅似乎还真轮不到它背,Cloudflare 状态页并未出现全球性重大事故,目前也没证据表明三家的故障来自同一个源头。

于是问题反而变得更有意思,为什么现代互联网一旦出现大面积服务异常,Cloudflare 总是最先被怀疑的那几个名字之一?

特别是这次明明不是它,但所有人第一时间想到它,本身就说明了很多。

一、为什么一宕机,都想到 Cloudflare?

很多人最早认识 Cloudflare,可能还是因为 CDN、网站加速,或者 DDoS 防护。

但如果今天还只把它理解成一家 CDN 公司,已经有点过时了。

我们日常打开一个网站,看起来无非是「用户 → 网站」。

真实世界里,中间那条链路要复杂得多,更接近于「用户 → 域名 → DNS → Cloudflare → CDN / WAF / DDoS / 身份验证 / 边缘计算 → 网站服务器」。

也就是说,Cloudflare 并不一定拥有你最终访问的那个网站,却可能站在你和网站之间:

  • 网站希望打开得更快,要经过它;
  • 被 DDoS 攻击,希望有人挡在前面,要靠它;
  • API 请求、机器人流量、企业员工访问内部系统,要经过它;
  • 开发者开始把程序直接跑在边缘节点上,又有 Workers;
  • 到了 AI 时代,模型 API、AI Gateway、Agent、MCP,Cloudflare 也开始往这一层延伸;

Cloudflare 自己现在对外的定位,就是一套服务于 apps、agents 和 workforce 的统一平台,而我觉得,把 Cloudflare 理解成互联网的「水电煤」,可能更准确。

平时完全感觉不到它,网页正常打开,API 正常返回,恶意流量在后台被拦掉,但只要一出问题,所有网站会突然一起挂掉。

对一家基础设施公司来说,这是个很奢侈的位置。

关注官方 X,获取美股资讯

二、Cloudflare 宕机,半个互联网一起报错?

当然,位置越重要,出错的代价也越大。

回头翻 Cloudflare 的宕机史,几乎是一部现代分布式网络的故障警示录。

2019 年,一条 WAF 安全规则里的正则表达式出了问题,迅速把处理 HTTP 流量的 CPU 打满,最后核心代理、CDN 和 WAF 一起受到影响,整个互联网开始出现大量 502。

2022 年,一次网络配置调整出了问题,影响了 19 个数据中心,且恰好是最繁忙的一批节点,一度波及了约 50% 的请求量。

到了 2025 年,Cloudflare 自己的产品越来越多,事故也开始出现「内部传染」。

先是 6 月,Workers KV 所依赖的底层存储基础设施发生故障,结果 WARP、Access、Gateway、Workers AI、Turnstile 等一串服务一起被带下去,持续了两个多小时。

更夸张的是 11 月,一次数据库权限修改,导致 Bot Management 使用的一个配置文件突然膨胀到原来的两倍,又被同步到了大量机器上,最后直接把核心网络流量搞出了问题。

以至于 Cloudflare 一开始甚至以为自己遭遇了超大规模 DDoS,排查以后才发现是自己生成了一个太大的文件......

说到底,真正把小错误放大的,是 Cloudflare 所处的位置,它已经嵌进了太多网站、应用和服务的必经之路。

加入官方社群,讨论热点话题

三、NET:AI 时代最容易被忽视的「铲子」

不过,如果把 Cloudflare 看成一家「很重要的互联网基础设施公司」,其实也少看了一层。

过去几年,它的业务路径越来越清晰:从 CDN、DNS 和 DDoS 防护,往 Zero Trust、网络安全、Workers 开发平台不断扩张,现在又开始把 AI Gateway、Workers AI 和 Agent 基础设施接进来。

而 AI,可能正在让它原本就很关键的位置变得更值钱。

原因并不复杂——Agent 越多,网络请求越多,身份越多,安全需求也越多。

这和传统 SaaS 的逻辑还不太一样,以前互联网主要是人访问机器,一个人打开网页、点几个链接、看完退出,一天下来的请求量终归有限。

Agent 完全不是这么回事,它为了完成一个任务,可能连续搜索几十个页面,调用几个 API,背后可能变成几十、几百次机器调用。

如果未来越来越多互联网流量真的从 Human-to-Machine,变成 Machine-to-Machine,那 Cloudflare 就是它们运行的平台,也是它们需要经过的网络,理论上只会越来越忙。

最新财报也验证了这个趋势,Q2 营收达到 6.96 亿美元,同比增长 36%,且增速是从去年四季度和今年一季度的 34% 左右继续往上走的。

对一家年收入已经超过 20 亿美元的公司来说,这种体量还能重新加速,本身就不容易,这也是为什么 8 月初财报出来以后,NET 一度冲到 330 美元上方。

不过,基本面很好,但市场也已经知道它很好,因此 8 月高点之后,股价一度回落不少。

那接下来就看,Agent 带来的机器流量、安全需求和开发平台收入,能不能跑得足够快,继续消化今天已经很高的预期。

写在最后

昨晚 ChatGPT、Claude 和 Grok 集体故障,虽然不是 Cloudflare 导致的。

但这个乌龙本身,反而很适合拿来认识 Cloudflare。

我们平时看到的都是最上面那一层,今天是 ChatGPT,明天是 Claude,再过几年,也许又换成一批新的 Agent。

应用会换,入口也会换。

但只要它们还需要联网,需要访问数据,需要验证身份,需要调用 API,也需要有人挡住攻击,下面那层基础设施就不会凭空消失。

甚至,机器越多,这一层可能越忙。

Cloudflare 押的,大概就是这件事。

免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。

分享至:
APP下载

X

Telegram

Facebook

Reddit

复制链接