Respuesta corta
OpenAI no publica un recuento oficial en tiempo real de las consultas diarias de ChatGPT. Las señales públicas de adopción sugieren que el servicio puede procesar desde cientos de millones hasta posiblemente miles de millones de prompts al día, según los usuarios activos, la frecuencia de uso, el enrutamiento de modelos y el uso del producto.
ChatGPT opera a escala mundial
Millones de usuarios interactúan diariamente con ChatGPT para tareas de codificación, escritura, investigación, productividad y conversación. Cada interacción puede contener múltiples preguntas y respuestas, lo que genera cargas de trabajo de inferencia extremadamente grandes en toda la infraestructura de OpenAI.
Las indicaciones y las consultas no son exactamente lo mismo
A menudo se utilizan los términos «prompt», «consulta» y «pregunta» indistintamente al buscar cifras sobre el uso de ChatGPT. En la práctica, un «prompt» suele referirse a la entrada del usuario enviada al modelo, mientras que una «consulta» también puede incluir llamadas a la API, solicitudes al sistema o interacciones con el producto. Por lo tanto, las estimaciones públicas deben considerarse orientativas y no exactas.
Los usuarios habituales son el punto de partida
Dado que OpenAI no publica un contador de solicitudes en tiempo real, la estimación pública más útil se basa en los indicadores de adopción: cuántas personas utilizan ChatGPT, con qué frecuencia vuelven a utilizarlo, cuántas solicitudes envían por sesión y cómo influyen en el uso las funciones del producto, como la voz, la generación de imágenes y la programación.
Servir consultas requiere una infraestructura masiva
Cada consulta procesada por ChatGPT consume recursos informáticos en GPU y aceleradores de IA. Para atender esta demanda se necesitan grandes centros de datos, infraestructuras de red, sistemas de almacenamiento y capacidad de refrigeración que funcionen continuamente en todo el mundo.
Por qué es importante el volumen de consultas
Los grandes volúmenes de consultas influyen directamente en la demanda de electricidad, los requisitos de hardware, los costes operativos y el impacto medioambiental. Incluso pequeños incrementos en la complejidad media de las consultas pueden aumentar significativamente el uso total de computación a escala.
Por qué varían las estimaciones públicas
Las estimaciones públicas varían porque OpenAI no publica métricas oficiales en tiempo real sobre el tráfico de prompts o consultas de ChatGPT. Los analistas se apoyan en señales públicas indirectas como usuarios activos, adopción del producto, precios de modelos, suministro de GPU, eficiencia de inferencia y crecimiento observado del tráfico. Consulta el Metodología.
