A OpenAI revelou a arquitetura que atende mais de 70 milhões de requisições por segundo. Veja lições de escala, latência, governança e custo para produtos de IA.

Resposta direta

A OpenAI informou em 11 de setembro de 2026 que o Habitat, sua plataforma de armazenamento online, atende mais de 70 milhões de requisições por segundo, mais de 1 bilhão de pessoas por semana e mais de 500 petabytes de dados. A principal lição empresarial não é copiar essa escala, mas separar a camada de dados do produto, limitar consultas imprevisíveis e tratar autorização, residência, observabilidade e latência de cauda como requisitos de arquitetura.

Escala começa por uma interface previsível

O Habitat expõe operações NoSQL restritas em vez de consultas arbitrárias. Esse desenho torna custo e fan-out mais previsíveis, reduzindo o risco de uma consulta cara degradar uma rota crítica. Em produtos empresariais, contratos simples também facilitam auditoria e limites por cliente.

Centralizar controles reduz coordenação

A OpenAI moveu a lógica de armazenamento de uma biblioteca cliente para um serviço central. Assim, roteamento, autorização, criptografia, auditoria, residência de dados e limitação de tráfego podem evoluir sem coordenar atualizações em dezenas de aplicações.

Latência de cauda é a que o usuário sente

Uma única resposta pode depender de muitas leituras. Por isso, média de latência esconde o problema: p95, p99, atraso do event loop, saturação e concentração de conexões precisam ser observados por rota, região e dependência.

Eficiência deve seguir estabilidade

A equipe aceitou temporariamente o custo do Python para estabilizar interfaces e depois migrou o serviço para Rust. Segundo a OpenAI, a nova implementação ficou seis vezes mais eficiente em CPU e quinze vezes em memória. O ponto estratégico é sequenciar risco, não adotar uma linguagem por moda.

Leitura Nexus

Produtos de IA confiáveis dependem tanto da camada de dados quanto do modelo. Um piloto corporativo deve testar isolamento, autorização, recuperação e custo sob carga desde o início, mesmo quando a escala inicial é pequena.

Perguntas frequentes

O que é o Habitat da OpenAI?

É a plataforma interna de armazenamento online usada por produtos como ChatGPT, API e Codex para acessar dados com baixa latência e controles centralizados.

Toda empresa precisa de uma plataforma desse porte?

Não. O padrão útil é separar responsabilidades e tornar custo, acesso e falhas previsíveis na escala real do produto.

Qual métrica técnica merece atenção?

Latência de cauda, taxa de erro, saturação e impacto de dependências são mais informativos que apenas a latência média.

Guias essenciais para aprofundar a decisão

Fontes primárias e referências

Esta análise editorial foi produzida pela Nexus a partir das fontes oficiais abaixo, consultadas em 12 de setembro de 2026. O texto é original e interpreta implicações práticas para empresas.

Data informada pela fonte principal: 11 de setembro de 2026.