ChatGPT全球故障凸显AI服务稳定性挑战
「OpenAI旗下ChatGPT近日出现全球范围服务故障,用户无法登录、加载聊天记录或发送消息,Codex及API端点也受影响。OpenAI已确认问题并采取缓解措施,事件再次凸显AI基础设施稳定性的重要性。」
OpenAI旗下ChatGPT近日遭遇全球范围服务故障,大量用户反映无法正常登录账号、加载历史聊天记录或发送消息。此次故障从美国东部时间8月19日晚间开始,受影响范围覆盖美国、欧洲等多个地区,引发广泛关注。
根据用户反馈,故障期间打开ChatGPT后,页面可能长时间停留在侧边栏加载动画界面,并出现“并发请求过多”等错误提示,导致用户无法继续对话。与此同时,chatgpt.com的新用户注册和账号登录功能也出现异常,部分用户无法访问此前保存的历史会话记录。对于依赖ChatGPT进行日常工作的个人用户和团队而言,这一中断带来了明显的不便。
除ChatGPT主服务外,OpenAI旗下的编码平台Codex也受到此次故障波及。开发者在使用Codex进行代码生成和辅助编程时遇到连接问题,影响了部分开发工作流。OpenAI随后通过官方状态页面确认了相关问题,表示已发现部分用户遭遇登录异常,并正在采取措施缓解服务中断。
此次事件还波及了OpenAI API服务。根据状态页面信息,多个API端点出现异常,导致开发者调用相关人工智能服务时遇到延迟或错误。API服务的不稳定直接影响依赖OpenAI模型构建应用的第三方开发者,进一步放大了故障的影响面。
截至美国东部时间当晚8点15分左右,OpenAI确认故障仍在持续,并表示工程团队正在处理相关问题。尽管OpenAI未在第一时间披露具体原因,但这类大规模服务中断再次将AI基础设施的稳定性问题推向台前。
随着ChatGPT等生成式AI工具逐渐成为个人用户和企业开发流程中的核心服务,平台可用性、故障响应速度以及系统韧性正在成为AI服务商竞争的重要指标。用户对AI服务的依赖程度越高,对稳定性的要求也就越严苛。一次全球性的故障不仅影响用户体验,也可能削弱市场对服务商的信任。
从行业角度看,AI服务的规模化运营远比传统软件复杂,涉及模型推理资源调度、负载均衡、多区域容灾等多个环节。此次ChatGPT故障提醒所有AI服务提供商,在追求模型能力和功能迭代的同时,必须同步加强基础设施的可观测性、冗余设计和故障应急机制。对于企业用户而言,将关键业务完全绑定在单一AI服务上存在一定风险,建立多云或混合架构的备用方案或许将成为后续技术选型的重要考量。
来源:Heooo AI工具导航