星光澄海 | BLOG

OpenAI靠Habitat支撑ChatGPT服务10亿用户的门道

ChatGPT现在服务10亿用户,每秒处理2200万请求——这套庞大流量的底层支撑,是OpenAI的Habitat存储平台。

从Python库到分布式存储平台的蜕变
Habitat的起点很简单,它最初只是OpenAI内部的一个Python库,用来处理特定场景下的数据存储需求。但随着ChatGPT用户规模爆发,这个工具不得不从库升级成覆盖全球的分布式存储平台。别小看这个转变,从面向特定场景的轻量工具,到服务10亿用户的全球存储基础设施,中间的迭代工作量远超预期——本质是要把一个只懂小范围数据处理的工具,改造成能应对全球多节点、高并发、低延迟要求的系统。

扛住高并发的核心在哪
每秒2200万请求,还要支撑10亿用户的稳定访问,Habitat的分布式架构是核心。它没有把所有数据存在单一节点,而是把存储能力分散到全球多个节点:用户每次跟ChatGPT的对话记录、模型推理的中间数据,都能就近存储和调取,既降低了不同地区用户的访问延迟,也能在某一个节点出现故障时,快速切换到其他节点,保证服务不中断。换做最初的Python库,根本扛不住这么大的请求量——架构的重构,才是它能支撑ChatGPT大流量的关键。

给AI产业的一个信号
之前很多大模型公司,资源大多砸在模型训练和推理上,对存储的投入和重视程度相对有限。但OpenAI的做法说明,当AI应用的用户规模突破10亿级,存储体系的能力会直接决定服务的可用性和体验。Habitat的演化,其实是在给整个AI产业提了个醒:AI应用的竞争力,除了模型本身,配套的基础设施(尤其是存储)也是绕不开的核心环节。

其他做通用大模型的公司,会不会也得把存储体系的重构提上核心日程?


素材来源:OpenAI News · AI情报、大模型、AI基础设施、消费级AI
查看报道原文

发表第一条评论吧

支持 Markdown