#AI
OpenAI 把 Habitat 从 Python 库做成分布式存储平台
OpenAI 罕见地把自家存储底层的账摊开了。官方工程博客披露,在线存储平台 Habitat 现在每秒处理超过 7000 万次请求,支撑每周超 10 亿人使用的产品,分布在近 40 个地理区域,累计服务数据量超过 500 PB。
Habitat 最早是 2023 年 DevDay 为 GPTs 写的一个 Python 客户端库,直连单个 Azure Cosmos DB 数据库;到 2025 年年中,它被拆成一个独立的服务层。
💡 为什么值得看OpenAI 周活 1 亿,每秒请求 7 千万,明知 Python 慢仍先用。
查证
来源档案
OpenAI 官方博客(openai.com/index/…
官方一手工程博客,属两篇系列文章的第一篇,由 OpenAI 基础设施团队自述 Habitat 的演进路径与运行指标。
官方一手源,指标口径由 OpenAI 自己给出,可信度高;但这是叙事性复盘而非可外部验证的审计数据,「每秒 7000 万次请求」「500 PB」「近 40 个区域」等口径的统计方式未说明,文中也明确第二篇才展开多租户可靠性与 Azure Cosmos DB 的合作细节。
延伸阅读
文中把「为什幺明知 Python 慢还要用」讲得比大多数工程复盘都直白:先拿性能换速度,再赌自家编码模型能把迁移成本降下来。想看技术债怎幺被主动计入预算,这篇是少见的坦白样本。