AI快讯OpenAI Habitat在线存储Rust 迁移尾延迟

OpenAI Habitat|70M+ RPS 的在线存储如何从 Python 迁往 Rust

OpenAI 披露集中式存储平台的扩展路径:先收拢控制面,再以灰度流量验证 Rust 重写的效率与延迟。

ENHE AI5 min0 views
OpenAI Habitat|70M+ RPS 的在线存储如何从 Python 迁往 Rust

本文核心看点

OpenAI 于 9 月 11 日披露在线存储平台 Habitat 的扩展历程。官方称,该平台目前每秒处理超过 7000 万次请求,服务每周逾 10 亿用户、近 40 个地区并承载超过 500 PB 数据。Habitat 从 Python 客户端库演变为集中式服务;2026 年第二季度,两名工程师借助 Codex 与 GPT‑5.5 完成 Rust 重写,目前承接 95% 生产请求。文中数据是 OpenAI 的内部测量,团队应借鉴迁移方法,而不是直接套用性能结论。

OpenAI 称 Habitat 每秒处理超过 7000 万次请求,为每周逾 10 亿用户使用的产品提供服务,覆盖近 40 个地区并承载超过 500 PB 数据。
Habitat 于 2023 年 DevDay 为 GPTs 启动,最初是连接 Azure Cosmos DB 的 Python 客户端库;后来拆成独立服务,以集中部署、可观测性、安全与平台改进。
OpenAI 表示,2026 年第二季度两名工程师借助 Codex 与 GPT‑5.5 完成 Rust 重写;新服务现处理 95% 的生产请求,内部测得 CPU 效率提高 6 倍、内存效率提高 15 倍。

直接回答

OpenAI 于 9 月 11 日披露在线存储平台 Habitat 的扩展历程。官方称,该平台目前每秒处理超过 7000 万次请求,服务每周逾 10 亿用户、近 40 个地区并承载超过 500 PB 数据。Habitat 从 Python 客户端库演变为集中式服务;2026 年第二季度,两名工程师借助 Codex 与 GPT‑5.5 完成 Rust 重写,目前承接 95% 生产请求。文中数据是 OpenAI 的内部测量,团队应借鉴迁移方法,而不是直接套用性能结论。

事实来源

OpenAI 称 Habitat 每秒处理超过 7000 万次请求,为每周逾 10 亿用户使用的产品提供服务,覆盖近 40 个地区并承载超过 500 PB 数据。

Habitat 于 2023 年 DevDay 为 GPTs 启动,最初是连接 Azure Cosmos DB 的 Python 客户端库;后来拆成独立服务,以集中部署、可观测性、安全与平台改进。

OpenAI 表示,2026 年第二季度两名工程师借助 Codex 与 GPT‑5.5 完成 Rust 重写;新服务现处理 95% 的生产请求,内部测得 CPU 效率提高 6 倍、内存效率提高 15 倍。

OpenAI Habitat|70M+ RPS 的在线存储如何从 Python 迁往 Rust 封面信息图
ENHE AI 原创合成图:主题匹配的真实工作场景背景与事实核验文案。

核心变化

  • 存储逻辑从分散客户端收拢到统一服务控制面
  • 尾延迟、连接复用和下游保护成为独立运营指标
  • 简单、可预测的 NoSQL 请求被保留为扩展边界
  • Rust 重写通过逐步承接流量验证,而非一次性切换
OpenAI Habitat|70M+ RPS 的在线存储如何从 Python 迁往 Rust 团队操作流程图
把公告转成可测试、可回滚、可审计的四步流程。

对普通 AI 用户的影响

这篇工程复盘说明,用户感知速度取决于整个请求链的尾部,而不只是数据库平均延迟。对建设高并发 AI 产品的团队,最可迁移的经验是先统一协议、权限、审计和观测,再替换运行时;同时用影子流量、逐级比例和明确回滚点验证新实现。OpenAI 的规模与内部工具不可直接复制,效率倍数也应视为该系统下的测量结果。

给团队的操作清单

  1. 记录当前吞吐、p95/p99 延迟、事件循环等待、连接数和下游错误率,形成迁移前基线。
  2. 先把路由、授权、审计与限流收敛到稳定协议,并用回放流量验证兼容性。
  3. 以影子请求和小比例真实流量比较 Python 与 Rust,逐级扩大并保留自动停止阈值。
  4. 为每一阶段保存版本、指标、异常样本与回滚命令,确认旧路径可用后再继续迁移。

AI 前沿资讯与趋势解读AI 软件应用与模型工具AI 技能教程与验证方法AI 账号服务与权限说明

FAQ

Habitat 是 OpenAI 对外提供的数据库产品吗?

不是。官方文章把 Habitat 描述为支撑 OpenAI 产品的内部在线存储平台,本次发布是工程复盘。

OpenAI 是否已经完全停用 Python 版本?

尚未。文章称 Rust 服务处理 95% 的生产请求,并计划在随后数周逐步停用 Python。

6 倍和 15 倍效率提升能否直接套用到其他系统?

不能。它们是 OpenAI 对 Habitat 的内部测量,硬件、负载、协议和实现差异都会改变结果。

总结

Habitat 的关键并非单纯换用 Rust,而是先建立统一控制面,再让新实现以真实指标逐步证明自己;这套迁移顺序比任何单个效率数字更值得复用。

本文由 AI 辅助撰写;发布前由 ENHE AI 自动化审计核对官方来源、双语字段、图片权利、页面安全与历史去重。

这对普通用户意味着什么?

这篇工程复盘说明,用户感知速度取决于整个请求链的尾部,而不只是数据库平均延迟。对建设高并发 AI 产品的团队,最可迁移的经验是先统一协议、权限、审计和观测,再替换运行时;同时用影子流量、逐级比例和明确回滚点验证新实现。OpenAI 的规模与内部工具不可直接复制,效率倍数也应视为该系统下的测量结果。

你可能会用到这些工具

相关教程

相关工具/教程

你可以从下面的 ENHE AI 栏目继续把资讯信号转成工具选择、账号服务判断或实操学习路径。

相关阅读

NVIDIA × Skild AI S1|机器人从单段视频学习陌生的长流程任务

NVIDIA 于 9 月 10 日介绍 Skild AI 的 S1 机器人基础模型。操作者录制任务视频作为提示,模型解析意图、物体与步骤,在不更新权重或进行任务专项后训练的情况下映射为机器人动作。官方文章称,S1 可执行最长 10 分钟的陌生多步骤任务;Skild 自测中每步成功率约 66%,对比系统为 9%。这些是厂商披露的演示与测试结果,并不等于所有环境已可无人值守。落地时仍需在仿真、隔离工位和真实产线逐级验证碰撞、故障恢复与人工停机。

Structured Outputs 上线门禁|把 Schema、拒答与截断纳入发布验收

Structured Outputs 让兼容模型按受支持的 JSON Schema 返回数据,比仅保证合法 JSON 的 JSON mode 更适合业务流程。它可用于函数调用或结构化响应;严格模式要求对象关闭额外属性、字段全部必填,可空值通常用含 null 的联合类型表达。Schema 通过只证明结构符合约束,不代表事实正确、业务规则满足或调用完整。上线前应固定模型与 Schema 版本,覆盖正常、拒答、输出截断、内容过滤和不受支持 Schema,并在解析后执行语义校验与安全失败处理。

Salesforce Slackforce Surfaces|让 Slackbot 把业务上下文变成共享实时界面

Salesforce 于 9 月 11 日推出 Slackforce Surfaces,让用户通过 Slackbot 把对话、Salesforce 记录、Slack 历史和已连接企业数据生成仪表盘、报告、演示或其他交互界面。Surface 可固定在频道供团队筛选、讨论和继续行动,并沿用现有访问权限。该功能已面向启用 Slackbot 的多类 Slack 套餐提供,但官方明确说明实时数据功能从 10 月开始推出;当前使用前应核对工作区资格、数据刷新状态与可追溯来源。

AWS OpenAI 模型评测|从每 Token 价格转向每个正确结果的真实成本

AWS 于 9 月 11 日发布一套开源评测方法,比较 Amazon Bedrock 上的 GPT‑5.6 Luna、Terra、Sol 与 OpenAI API 上的 GPT‑5.4 mini、nano。它不只看每百万 Token 价格,而是测量每个正确答案、通过的多轮研究结果和合格专业交付物的成本。文章公开了样本量、评分器、配置与局限,并强调 Bedrock 模型关闭推理、API 基线使用默认设置,因此结果不是模型固有能力排名。团队应在自己的 50 至 100 个任务上重跑,并同时核算失败、返工、轮次与延迟。

Google 100 ZEROS 威尼斯 XR 首映|Gemini 对话、空间影像与 2D 转 3D 同台

Google 于 9 月 11 日介绍 100 ZEROS 团队支持的三部扩展现实作品,它们在第 83 届威尼斯国际电影节首映,并面向 Android XR。NEVATARS 以 Gemini 驱动角色对话和互动;《Galápagos: The Last Eden》让观众与 Gemini 驱动的数字达尔文互动;Sedona 则使用 Google 的 2D 转 3D XR 自动空间化技术在 YouTube 呈现悬疑预告。官方把这些项目定位为技术与创作者协作的探索,未宣称生成式工具替代编剧、导演或表演者。

NVIDIA 供应链 Nemotron 案例|把专家分配决策变成受治理的训练闭环

NVIDIA 于 9 月 10 日发布与 Palantir Foundry 的供应链案例:将专家的物料分配决策、理由与实际结果写入受治理 Ontology,再以点时回测训练 Nemotron 3.5 Lightning。后训练 30B 专用模型在开发基准取得 86.7% 分配决策准确率,但该结果只适用于受限任务与该评测;人工规划师仍作最终决定,不能推断其通用推理能力更强。

参考来源

文章目录

最新资讯