GLM-5.3-Flash: koszt użycia
Cena katalogowa, którą Z.ai podaje dla modelu GLM-5.3-Flash, koszt odpowiedzi dla klienta, streszczenia dokumentu i zadania agenta oraz pozycja tego modelu wśród 37 modeli.
Dolary amerykańskie za milion tokenów, stawka standardowa, najkrótszy zakres kontekstu.
- 1,000 odpowiedzi wsparcia
- $0.65
- Tokeny wejściowe z pamięci podręcznej
- $0.03
- Okno kontekstowe
- 1 000 000 tokenów
- Data wydania
- 26 sie 2026
- Wagi
- Otwórz
Według stron Z.ai, 22 września 2026.
W API Z.ai model GLM-5.3-Flash kosztuje $0.15 za milion tokenów wejściowych, $0.50 za milion tokenów wyjściowych i $0.03 za milion tokenów wejściowych odczytanych z pamięci podręcznej. Przy tych cenach koszt 1,000 odpowiedzi dla klientów wynosi $0.65. Pozycja na naszej liście: pozycja: 2.. najtańszy wśród 33 modeli z podaną ceną.
Koszt zadania
Trzy zadania, każde wykonane 1,000 razy według powyższej ceny katalogowej, oraz pozycja modelu GLM-5.3-Flash wśród 33 modeli z ceną katalogową.
| Zadanie | 1,000 prób | Wśród 33 modeli |
|---|---|---|
| Odpowiedź klientowi3,000 na wejściu, 400 na wyjściu. | $0.65 | 2.. najtańszy |
| Streszczenie dokumentu25,000 na wejściu, 1,000 na wyjściu. | $4.25 | 2.. najtańszy |
| Zadanie agenta80,000 na wejściu (w tym 70,000 z pamięci podręcznej), 3,000 na wyjściu. | $5.10 | najtańszy |
Liczbę tokenów dobraliśmy sami tak, by odpowiadała rzeczywistym zadaniom. Ceny pochodzą od Z.ai. Żadne z trzech zadań nie przekracza 200,000 tokenów na żądanie, więc nie podlega żadnej dopłacie za długi kontekst z naszej listy.
GLM-5.3-Flash w rzeczywistych zadaniach małych firm
Co zmierzono w benchmarku AIGROW, gdy model GLM-5.3-Flash otrzymał 20 zadań biurowych, z których każde oceniono jako zaliczone lub niezaliczone według stałych kryteriów.
- Odsetek zaliczonych prób
- Zaliczono 90% z 20 prób (95% przedział ufności: od 70% do 97%). Pozycja: 4. wśród 36 modeli.
- Koszt 1 000 zaliczonych prób
- $0.831, z uwzględnieniem niezaliczonych prób.
- Czas odpowiedzi
- Mediana: 15 s, 90. percentyl: 31 s.
- Najlepszy i najsłabszy wynik
- Umawianie wizyt (100% zaliczonych prób) i Opisy produktów (0%).
Szczegóły cennika
Czego nie uwzględnia powyższa stawka podstawowa, według stron twórcy modelu: dopłat, rabatów, promocji i cen za korzystanie z pamięci podręcznej.
Łącznie 320B parametrów, z czego 18B aktywnych. Przechowywanie wejścia w pamięci podręcznej jest „bezpłatne przez ograniczony czas”. Z.ai oferuje też GLM-5.3-FlashX ($0.37 / $1.25), którego tu nie uwzględniono. Otwarte wagi na Hugging Face (zai-org/GLM-5.3-Flash).
GLM-5.3-Flash na tle porównywanych modeli
W każdym porównaniu zestawiamy ceny katalogowe obu modeli i obliczamy koszt tych samych trzech zadań dla każdego z nich.
- kontra Qwen3.8 Flash
- Dwa nowe chińskie modele budżetowe, których ceny różnią się o zaledwie kilka centów.
Inne modele Z.ai
| Model | Tokeny wejściowe | Tokeny wyjściowe | Kontekst | 1,000 odpowiedzi |
|---|---|---|---|---|
| GLM-5.3Z.ai · otwarte wagi | $1.40 | $4.40 | 1M | $5.96 |
Źródło ceny
Sprawdzono 22 września 2026. Każda cena to stawka standardowa dla najkrótszego zakresu kontekstu, bez rabatu za przetwarzanie wsadowe ani priorytet. Dopłaty za długi kontekst, stawki wsadowe i promocje opisano w szczegółach każdego modelu. Żadna cena nie pochodzi od pośrednika.
Płać jedną czwartą ceny katalogowej
Środki na API AIGROW są rozliczane według cen katalogowych twórców modeli. Za $25 otrzymujesz środki na wykorzystanie o wartości $100. Lista objętych nimi modeli znajduje się na stronie środków na API. Jeśli interesuje cię inny model, zapytaj przed zakupem.
Ceny sprawdzone 22 września 2026