Krótka odpowiedź
OpenAI nie publikuje oficjalnej liczby zapytań ChatGPT dziennie w czasie rzeczywistym. Publiczne sygnały adopcji sugerują, że usługa może przetwarzać od setek milionów do potencjalnie miliardów promptów dziennie, zależnie od aktywnych użytkowników, częstotliwości promptów, routingu modeli i użycia produktu.
ChatGPT działa w skali globalnej
Miliony użytkowników codziennie wchodzą w interakcję z ChatGPT w celu kodowania, pisania, badań, produktywności i zadań konwersacyjnych. Każda interakcja może zawierać wiele podpowiedzi i odpowiedzi, tworząc niezwykle duże obciążenia związane z wnioskowaniem w infrastrukturze OpenAI.
Podpowiedzi i zapytania to nie do końca to samo
Podczas wyszukiwania danych dotyczących wykorzystania ChatGPT ludzie często używają terminów „prompt”, „zapytanie” i „pytanie” zamiennie. W praktyce termin „prompt” zazwyczaj odnosi się do danych wprowadzanych przez użytkownika i przesyłanych do modelu, natomiast termin „zapytanie” może obejmować również wywołania API, żądania systemowe lub interakcje z produktem. Publiczne szacunki należy zatem traktować raczej jako orientacyjne, a nie dokładne.
Punktem wyjścia są codzienni użytkownicy
Ponieważ OpenAI nie publikuje aktualnego licznika zapytań, najbardziej przydatne publiczne szacunki opierają się na wskaźnikach popularności: ilu użytkowników korzysta z ChatGPT, jak często do niego wracają, ile zapytań wysyłają podczas jednej sesji oraz w jaki sposób funkcje produktu, takie jak obsługa głosu, generowanie obrazów i kodowanie, wpływają na sposób korzystania z niego.
Obsługa zapytań wymaga ogromnej infrastruktury
Każde zapytanie przetwarzane przez ChatGPT zużywa zasoby obliczeniowe na procesorach graficznych i akceleratorach AI. Obsługa tego zapotrzebowania wymaga dużych centrów danych, infrastruktury sieciowej, systemów pamięci masowej i wydajności chłodzenia działających nieprzerwanie na całym świecie.
Dlaczego liczba zapytań ma znaczenie
Wysokie wolumeny zapytań mają bezpośredni wpływ na zapotrzebowanie na energię elektryczną, wymagania sprzętowe, koszty operacyjne i wpływ na środowisko. Nawet niewielki wzrost średniej złożoności zapytań może znacząco zwiększyć całkowite wykorzystanie mocy obliczeniowej na dużą skalę.
Dlaczego publiczne szacunki się różnią
Publiczne szacunki różnią się, ponieważ OpenAI nie publikuje oficjalnych metryk ruchu w czasie rzeczywistym dla promptów ani zapytań ChatGPT. Analitycy opierają się na pośrednich publicznych sygnałach, takich jak aktywni użytkownicy, adopcja produktu, ceny modeli, podaż GPU, wydajność inferencji i obserwowany wzrost ruchu. Zobacz Metodologia.
