OpenAI reveló la arquitectura que atiende más de 70 millones de solicitudes por segundo. Vea lecciones de escala, latencia, gobernanza y costos para productos de IA.
respuesta directa
OpenAI informó el 11 de septiembre de 2026 que Habitat, su plataforma de almacenamiento en línea, atiende más de 70 millones de solicitudes por segundo, más de mil millones de personas por semana y más de 500 petabytes de datos. La lección empresarial clave es no copiar esta escala, sino separar la capa de datos del producto, limitar las consultas impredecibles y tratar la autorización, la residencia, la observabilidad y la latencia de cola como requisitos arquitectónicos.
La escala comienza con una interfaz predecible
Habitat expone operaciones NoSQL estrictas en lugar de consultas arbitrarias. Este diseño hace que el costo y la distribución sean más predecibles, lo que reduce el riesgo de que una consulta costosa degrade una ruta crítica. En los productos empresariales, los contratos simples también facilitan la auditoría y los límites por cliente.
Centralizar los controles reduce la coordinación
OpenAI trasladó la lógica de almacenamiento de una biblioteca cliente a un servicio central. Por lo tanto, el enrutamiento, la autorización, el cifrado, la auditoría, la residencia de datos y la limitación del tráfico pueden evolucionar sin coordinar las actualizaciones entre docenas de aplicaciones.
La latencia de cola es lo que siente el usuario.
Una única respuesta puede depender de muchas lecturas. Por lo tanto, la latencia promedio oculta el problema: p95, p99, el retraso del bucle de eventos, la saturación y la concentración de conexiones deben observarse por ruta, región y dependencia.
La eficiencia debe seguir a la estabilidad
El equipo aceptó temporalmente el costo de Python para estabilizar las interfaces y luego migró el servicio a Rust. Según OpenAI, la nueva implementación fue seis veces más eficiente en CPU y quince veces en memoria. El punto estratégico es secuenciar el riesgo, no adoptar un lenguaje para la moda.
Lectura del nexo
Los productos de IA confiables dependen tanto de la capa de datos como del modelo. Un piloto empresarial debe probar el aislamiento, la autorización, la recuperación y el costo bajo carga desde el principio, incluso cuando la escala inicial sea pequeña.
Preguntas frecuentes
¿Qué es OpenAI Hábitat?
Es la plataforma interna de almacenamiento en línea utilizada por productos como ChatGPT, API y Codex para acceder a datos con baja latencia y controles centralizados.
¿Todas las empresas necesitan una plataforma de este tamaño?
No. El patrón útil es separar responsabilidades y hacer que los costos, el acceso y las fallas sean predecibles a la escala real del producto.
¿Qué métrica técnica merece atención?
La latencia de cola, la tasa de error, la saturación y el impacto de la dependencia son más informativos que la latencia promedio.
Guías imprescindibles para profundizar en la decisión
Este análisis editorial fue elaborado por Nexus a partir de las fuentes oficiales a continuación, consultadas el 12 de septiembre de 2026. El texto es original e interpreta implicaciones prácticas para las empresas.
- OpenAI: escalamiento rápido del almacenamiento en línea para atender a más de mil millones de usuarios de ChatGPT: arquitectura, volumen, evolución del servicio y métricas oficiales de Habitat.
- Microsoft Learn: descripción general de Azure Cosmos DB: documentación oficial del servicio de base de datos citado por la arquitectura.
Fecha reportada por la fuente principal: 11 de septiembre de 2026.

