ChatGPT、Claude、Grok이 동시에 다운됐다, 왜 모두 Cloudflare를 의심하나?
- 핵심 요지: Cloudflare는 CDN 서비스 제공업체에서 인터넷 핵심 인프라로 성장했으며, AI 시대에 머신 트래픽 급증으로 전략적 가치가 부각되고 있다. 최근 ChatGPT 등 애플리케이션의 동시 다운 사태가 Cloudflare 때문에 발생한 것은 아니지만, 시장이 가장 먼저 Cloudflare의 상태 페이지를 확인했다는 점은 ‘인터넷의 수도·전기·통신’이라는 핵심적 지위를 입증한다.
- 핵심 요소:
- Cloudflare의 사업 영역은 CDN, DDoS 보호, 제로 트러스트 보안, Workers 엣지 컴퓨팅, AI Gateway 등으로 확장되어 웹사이트 접속과 API 호출의 필수 경로에 깊숙이 자리 잡고 있어 현대 인터넷의 기반 인프라를 구성한다.
- 과거 다운 사고(예: 2019년 WAF 규칙 정규식 오류, 2022년 네트워크 설정 변경으로 트래픽 50% 영향)는 모두 Cloudflare의 허브적 위치로 인해 파장이 확대되었으며, 이는 ‘한 곳이 흔들리면 전체가 흔들리는’ 시스템적 중요성을 보여준다.
- AI 에이전트가 Machine-to-Machine 트래픽 성장을 견인하며, 단일 태스크가 수백에서 수천 건의 네트워크 호출을 발생시킬 수 있어 기존 Human-to-Machine 패턴과 달리 Cloudflare의 네트워크·보안 서비스에 대한 수요가 크게 증가했다.
- 2025년 2분기 실적에서 매출 6.96억 달러, 전년 동기 대비 36% 성장을 기록했으며, 성장률은 직전 두 분기의 34%보다 가속화되어 AI가 주도하는 사업 재가속을 입증했다. 실적 발표 후 주가는 한때 330달러까지 상승했다.
- 6월과 11월의 내부 장애(예: Workers KV 오류, 데이터베이스 구성 확장)가 여러 서비스의 연쇄 중단을 초래하여, 제품 라인 확장 이후 ‘내부 전염’ 효과가 커졌음을 보여주었고 운영 복잡성 증가를 부각시켰다.
既是互联网宕机的「背锅侠」,也是 AI 时代被容易被忽视的「铲子」。
9 月 3 日晚,ChatGPT、Claude、Grok 三家头部 AI,几乎同一时间掉线。
小声吐槽:现在连宕机都有「新御三家」了,Gemini 已经排不上号了么。
更有意思的是,出事以后,不少人的第一反应,是去看 Cloudflare、AWS 和 Azure 的状态页,尤其是 Cloudflare。
只不过,这次锅似乎还真轮不到它背,Cloudflare 状态页并未出现全球性重大事故,目前也没证据表明三家的故障来自同一个源头。
于是问题反而变得更有意思,为什么现代互联网一旦出现大面积服务异常,Cloudflare 总是最先被怀疑的那几个名字之一?
特别是这次明明不是它,但所有人第一时间想到它,本身就说明了很多。

一、为什么一宕机,都想到 Cloudflare?
很多人最早认识 Cloudflare,可能还是因为 CDN、网站加速,或者 DDoS 防护。
但如果今天还只把它理解成一家 CDN 公司,已经有点过时了。
我们日常打开一个网站,看起来无非是「用户 → 网站」。
真实世界里,中间那条链路要复杂得多,更接近于「用户 → 域名 → DNS → Cloudflare → CDN / WAF / DDoS / 身份验证 / 边缘计算 → 网站服务器」。
也就是说,Cloudflare 并不一定拥有你最终访问的那个网站,却可能站在你和网站之间:
- 网站希望打开得更快,要经过它;
- 被 DDoS 攻击,希望有人挡在前面,要靠它;
- API 请求、机器人流量、企业员工访问内部系统,要经过它;
- 开发者开始把程序直接跑在边缘节点上,又有 Workers;
- 到了 AI 时代,模型 API、AI Gateway、Agent、MCP,Cloudflare 也开始往这一层延伸;
Cloudflare 自己现在对外的定位,就是一套服务于 apps、agents 和 workforce 的统一平台,而我觉得,把 Cloudflare 理解成互联网的「水电煤」,可能更准确。

平时完全感觉不到它,网页正常打开,API 正常返回,恶意流量在后台被拦掉,但只要一出问题,所有网站会突然一起挂掉。
对一家基础设施公司来说,这是个很奢侈的位置。
关注官方 X,获取美股资讯
二、Cloudflare 宕机,半个互联网一起报错?
当然,位置越重要,出错的代价也越大。
回头翻 Cloudflare 的宕机史,几乎是一部现代分布式网络的故障警示录。
2019 年,一条 WAF 安全规则里的正则表达式出了问题,迅速把处理 HTTP 流量的 CPU 打满,最后核心代理、CDN 和 WAF 一起受到影响,整个互联网开始出现大量 502。
2022 年,一次网络配置调整出了问题,影响了 19 个数据中心,且恰好是最繁忙的一批节点,一度波及了约 50% 的请求量。
到了 2025 年,Cloudflare 自己的产品越来越多,事故也开始出现「内部传染」。
先是 6 月,Workers KV 所依赖的底层存储基础设施发生故障,结果 WARP、Access、Gateway、Workers AI、Turnstile 等一串服务一起被带下去,持续了两个多小时。
更夸张的是 11 月,一次数据库权限修改,导致 Bot Management 使用的一个配置文件突然膨胀到原来的两倍,又被同步到了大量机器上,最后直接把核心网络流量搞出了问题。
以至于 Cloudflare 一开始甚至以为自己遭遇了超大规模 DDoS,排查以后才发现是自己生成了一个太大的文件......

说到底,真正把小错误放大的,是 Cloudflare 所处的位置,它已经嵌进了太多网站、应用和服务的必经之路。
加入官方社群,讨论热点话题
三、NET:AI 时代最容易被忽视的「铲子」
不过,如果把 Cloudflare 看成一家「很重要的互联网基础设施公司」,其实也少看了一层。
过去几年,它的业务路径越来越清晰:从 CDN、DNS 和 DDoS 防护,往 Zero Trust、网络安全、Workers 开发平台不断扩张,现在又开始把 AI Gateway、Workers AI 和 Agent 基础设施接进来。
而 AI,可能正在让它原本就很关键的位置变得更值钱。
原因并不复杂——Agent 越多,网络请求越多,身份越多,安全需求也越多。
这和传统 SaaS 的逻辑还不太一样,以前互联网主要是人访问机器,一个人打开网页、点几个链接、看完退出,一天下来的请求量终归有限。
Agent 完全不是这么回事,它为了完成一个任务,可能连续搜索几十个页面,调用几个 API,背后可能变成几十、几百次机器调用。
如果未来越来越多互联网流量真的从 Human-to-Machine,变成 Machine-to-Machine,那 Cloudflare 就是它们运行的平台,也是它们需要经过的网络,理论上只会越来越忙。

最新财报也验证了这个趋势,Q2 营收达到 6.96 亿美元,同比增长 36%,且增速是从去年四季度和今年一季度的 34% 左右继续往上走的。
对一家年收入已经超过 20 亿美元的公司来说,这种体量还能重新加速,本身就不容易,这也是为什么 8 月初财报出来以后,NET 一度冲到 330 美元上方。
不过,基本面很好,但市场也已经知道它很好,因此 8 月高点之后,股价一度回落不少。
那接下来就看,Agent 带来的机器流量、安全需求和开发平台收入,能不能跑得足够快,继续消化今天已经很高的预期。
写在最后
昨晚 ChatGPT、Claude 和 Grok 集体故障,虽然不是 Cloudflare 导致的。
但这个乌龙本身,反而很适合拿来认识 Cloudflare。
我们平时看到的都是最上面那一层,今天是 ChatGPT,明天是 Claude,再过几年,也许又换成一批新的 Agent。
应用会换,入口也会换。
但只要它们还需要联网,需要访问数据,需要验证身份,需要调用 API,也需要有人挡住攻击,下面那层基础设施就不会凭空消失。
甚至,机器越多,这一层可能越忙。
Cloudflare 押的,大概就是这件事。


