Resposta curta
A OpenAI não publica uma contagem oficial em tempo real das consultas diárias do ChatGPT. Sinais públicos de adoção sugerem que o serviço pode processar de centenas de milhões a potencialmente bilhões de prompts por dia, dependendo de usuários ativos, frequência de prompts, roteamento de modelos e uso do produto.
ChatGPT opera à escala mundial
Milhões de utilizadores interagem diariamente com o ChatGPT para tarefas de codificação, escrita, investigação, produtividade e conversação. Cada interação pode conter vários pedidos e respostas, criando cargas de trabalho de inferência extremamente grandes na infraestrutura OpenAI.
As instruções e as perguntas não são exatamente a mesma coisa
É frequente as pessoas utilizarem os termos «prompt», «consulta» e «pergunta» de forma intercambiável quando procuram dados sobre a utilização do ChatGPT. Na prática, um «prompt» refere-se normalmente à entrada do utilizador enviada ao modelo, enquanto uma «consulta» pode também incluir chamadas à API, pedidos ao sistema ou interações com o produto. As estimativas públicas devem, por isso, ser consideradas orientativas e não exatas.
Os utilizadores diários são o ponto de partida
Uma vez que a OpenAI não publica um contador de prompts em tempo real, a estimativa pública mais útil baseia-se nos indicadores de adoção: quantas pessoas utilizam o ChatGPT, com que frequência voltam a utilizá-lo, quantos prompts enviam por sessão e de que forma as funcionalidades do produto, tais como a voz, a geração de imagens e a programação, afetam a utilização.
O serviço de consultas requer uma infraestrutura maciça
Cada consulta processada pelo ChatGPT consome recursos de computação em GPUs e aceleradores de IA. Para suportar esta procura, são necessários grandes centros de dados, infra-estruturas de rede, sistemas de armazenamento e capacidade de refrigeração a funcionar continuamente em todo o mundo.
Porque é que o volume de consultas é importante
Os elevados volumes de consulta influenciam diretamente a procura de eletricidade, os requisitos de hardware, os custos operacionais e o impacto ambiental. Mesmo pequenos aumentos na complexidade média dos pedidos podem aumentar significativamente a utilização total de computação à escala.
Porque é que as estimativas públicas variam
As estimativas públicas variam porque a OpenAI não publica métricas oficiais em tempo real sobre o tráfego de prompts ou consultas do ChatGPT. Analistas usam sinais públicos indiretos como usuários ativos, adoção do produto, preços de modelos, oferta de GPUs, eficiência de inferência e crescimento observado do tráfego. Veja o Metodologia.
