摘要
2026-08-13 08:35 EDT 起,Namecheap 因 Phoenix(RadiusDC)数据中心冷却失效触发紧急维护,主站、账户面板、共享/VPS/独立主机、EasyWP、DNS 管理、Private Email、支持台相继不可用,约 28–30 小时,部分 EasyWP 站点延至 8/14 03:50 EDT 才恢复。官方确认根因为风暴致冷却系统故障、主动停机保硬件;Namecheap 称将发布复盘。
时间线
2026-08-13 08:35 EDT首发紧急维护通告(Phoenix 数据中心冷却系统失效)
2026-08-13 中午前后陆续出现 hosting/EasyWP/DNS 管理/Private Email/支持台不可用
2026-08-14 13:00 EDT全量恢复确认(自首发约 28 小时)
2026-08-14 03:50 EDT个别 EasyWP 别名记录站点最后恢复
根因
官方确认:一场强风暴影响 Phoenix 设施,导致冷却系统失效、机房温度升至危及硬件水平;数据中心运营商 RadiusDC 指令 Namecheap 主动停机以防设备过热/永久损坏。属外部设施环境故障,非 Namecheap 自身软件缺陷。Namecheap 称 25 年来该设施首次此类事件。
放大因素
- 控制平面(认证/API/流量路由)集中在该 Phoenix 单点;冷却失效→主动停机→主站、主机、DNS 管理、邮件、支持台全瘫。
- DNS 解析(zone resolution)在整个事件中保持在线,故指向 Namecheap NS 的域名多数仍能解析;但 DNS 管理面不可用,且 Namecheap 托管的站点本身离线。
- 支持台(邮件/在线聊天)随主站一同瘫痪,临时转 Microsoft Teams,沟通受阻。
- 影响面外溢:凡域名 NS 指向 Namecheap 的站点(即便托管别处)在管理面瘫痪期间无法改 DNS。
缓解措施
- 受控恢复:先恢复物理网络设备 → 虚拟网络 → 客户面服务;先核心库/虚拟化/负载均衡,再逐步拉起主站、主机、邮件。
- RadiusDC 用临时冷机降温,待温度回安全值后有序重启。
- CEO 全程在 X 实时更新并署名致歉;状态页约每 1–2 小时时间戳更新;及时更正设施为 RadiusDC(非 PhoenixNAP)。
- 计划在欧洲、亚洲等增加冗余,降低单设施依赖。
经验教训
- 注册商/主机商的权威 DNS 与主机托管同处单设施失败域,会使「域名在别处托管」的站点也因 NS 管理面瘫痪而失控。
- 冷却失效这类「环境级」故障可在分钟级击穿全部冗余路径;Tier 3 认证不保证抗极端外部事件。
- 主动停机是正确决策,但恢复顺序与跨设施冗余决定 downtime 长度。
检查清单
- 权威 DNS 与主站/主机是否同处单设施失败域?是否跨设施分离?
- 冷却冗余(N+1 冷机、临时冷机预案)是否覆盖极端外部事件?
- 支持/沟通通道是否独立于主生产设施(避免一同瘫痪)?
- 恢复是否定义「先网络 → 虚拟化 → 客户面」受控顺序?
- 是否计划跨区冗余以降低单 DC 依赖?