本周末,Notion与Anthropic的集成出现临时服务中断,导致Anthropic旗下Opus 4.7和4.8模型在Notion AI中失败率升高,Notion随即暂停了所有Anthropic模型的使用。约12小时后,Notion产品负责人Max Schoening澄清,此次问题仅为临时性基础设施故障,并非模型质量问题,目前已恢复正常访问。Anthropic方面也确认,短暂的基础设施故障已修复,感谢用户耐心等待。
苹果官方系统状态页面显示,Apple Music自美东时间上午11:40起在澳大利亚、巴西、法国、印度、意大利、日本、韩国、西班牙及美国等多个国家出现服务中断。苹果将此次事件定性为"故障",称部分用户可能遭遇间歇性服务异常。这是Apple Music两个月内第三次出现中断问题,其中一次部分故障持续时间超过一天。
亚马逊确认将免收受伊朗无人机袭击影响的两个中东数据中心整月使用费用。3月1日的袭击损坏了阿联酋和巴林的数据中心,导致结构损坏、断电和消防活动造成的水损。多项AWS服务受到影响,包括EC2、S3等。亚马逊已通过邮件通知客户免收3月费用,这一举措前所未有。专家指出此举可能影响成本使用报告数据的完整性。
亚马逊云服务AWS中东地区数据中心遭不明物体撞击,引发火灾并导致电力中断,造成大规模服务中断。事故影响了EC2实例、EBS存储卷和RDS数据库等核心服务,近60项AWS服务受到波及。消防部门为扑灭火灾切断了设施电源和发电机。AWS表示电力恢复和完全修复需要数小时,建议客户使用备用可用区或转移至其他区域。
微软Azure西部美国数据中心因意外断电导致多项服务中断,包括Windows更新和Microsoft Store。事故发生在2月7日至8日期间,影响了Azure Kubernetes服务、Azure机密计算等多个服务。虽然启动了备用电源系统,但直到2月8日才完全恢复。此次事故让管理员们获得了近三小时的更新"休息时间"。微软近期频繁出现服务中断问题,引发了对其工程质量的关注。
Verizon网络发生大规模故障,影响美国东西海岸用户。受影响的iPhone用户状态栏显示"SOS",表示无法连接蜂窝网络但仍可拨打紧急电话。故障从周三中午开始,AT&T和T-Mobile用户也受到跨网络通信问题影响。Verizon已在社交媒体确认故障,但未提供额外信息。
2025年IT领域发生多起重大事故,包括Cognizant员工向网络犯罪分子泄露密码、Zimmer Biomet起诉德勤ERP部署失败、韩国政府数据中心火灾导致858TB数据丢失、以及Google、AWS、Azure和Cloudflare等多家云服务提供商的大规模服务中断。这些事件暴露了网络安全培训不足、项目管理失误、备份策略缺陷和云服务依赖风险等问题。
全球最大云服务提供商亚马逊云服务(AWS)遭遇大规模故障,影响政府机构、AI公司和金融平台等众多客户。尽管AWS称已基本恢复,但仍有用户无法连接租用服务器。故障源于关键数据库服务的数字目录故障,导致依赖该数据库的软件无法获取信息而出现连锁反应。受影响服务包括Venmo、苹果音乐、Zoom等数百个网站和应用。