GLM: ceny API dla 2 modeli, w przeliczeniu na token i zadanie
Ceny katalogowe wszystkich modeli Z.ai w naszym zestawieniu, zaczerpnięte z cennika Z.ai, oraz koszt zaliczonej odpowiedzi w benchmarku AIGROW dla małych firm i koszt trzech codziennych zadań w każdym modelu.
Dolary amerykańskie za milion tokenów, według stawki standardowej. Bez cen pośredników.
- GLM-5.3
- $1.40 / $4.40
- GLM-5.3-Flash
- $0.15 / $0.50
Cena katalogowa za milion tokenów wejściowych / wyjściowych.
Z.ai podaje ceny 2 modeli z naszej listy. Najtańszy model: GLM-5.3-Flash, $0.15 na wejściu i $0.50 na wyjściu za milion tokenów. Najdroższy: GLM-5.3, $1.40 na wejściu i $4.40 na wyjściu za milion tokenów. W benchmarku AIGROW dla małych firm model GLM-5.3-Flash osiągnął ex aequo najlepszy wynik: 18 zaliczonych zadań z 20 zadań, przy najniższym koszcie: $0.831 za tysiąc zaliczonych zadań.
Za token i za zaliczoną próbę
Cena katalogowa za milion tokenów, liczba zaliczonych przez każdy model z 20 zadań biurowych benchmarku oraz koszt 1,000 zaliczonych odpowiedzi, z uwzględnieniem niezaliczonych prób.
| Model | Tokeny wejściowe | Tokeny wyjściowe | Tokeny wejściowe z pamięci podręcznej | Kontekst | Zaliczone zadania | 1,000 zaliczonych prób |
|---|---|---|---|---|---|---|
| GLM-5.3Modele flagowe | $1.40 | $4.40 | $0.26 | 1M | 18 z 20 | $7.02 |
| GLM-5.3-FlashMałe i szybkie | $0.15 | $0.50 | $0.03 | 1M | 18 z 20 | $0.831 |
Koszt trzech codziennych zadań
1,000 prób każdego zadania według cen katalogowych. Liczby tokenów pochodzą z naszych pomiarów, a ceny podaje Z.ai.
| Model | 1,000 × odpowiedź klientowi | 1,000 × streszczenie dokumentu | 1,000 × zadanie agenta |
|---|---|---|---|
| GLM-5.3 | $5.96 | $39.40 | $45.40 |
| GLM-5.3-Flash | $0.65 | $4.25 | $5.10 |
- Odpowiedź klientowi
- Prompt o długości 3,000 tokenów (zgłoszenie, dotychczasowa korespondencja i fragment zasad) oraz odpowiedź o długości 400 tokenów.
- Streszczenie dokumentu
- Dokument liczący 40 stron, czyli około 25,000 tokenów wejściowych, oraz streszczenie o długości 1,000 tokenów.
- Zadanie agenta
- Dziesięć kroków, w których model odczytuje łącznie 80,000 tokenów, z czego 70,000 to kontekst powtarzany między krokami i pobierany z pamięci podręcznej, oraz generuje 3,000 tokenów.
Szczegóły cennika
Dodatkowe informacje z cenników Z.ai, których nie widać w podstawowych stawkach.
- GLM-5.3
- Przechowywanie wejścia w pamięci podręcznej jest „bezpłatne przez ograniczony czas”. Maksymalna liczba tokenów wyjściowych: 128K. Otwarte wagi na Hugging Face (zai-org/GLM-5.3).
- GLM-5.3-Flash
- Łącznie 320B parametrów, z czego 18B aktywnych. Przechowywanie wejścia w pamięci podręcznej jest „bezpłatne przez ograniczony czas”. Z.ai oferuje też GLM-5.3-FlashX ($0.37 / $1.25), którego tu nie uwzględniono. Otwarte wagi na Hugging Face (zai-org/GLM-5.3-Flash).
Bezpośrednie porównania
Porównania modelu GLM z innymi modelami, obejmujące ceny obu oraz koszt trzech zadań w każdym z nich.
Źródła cen
Sprawdzono 22 września 2026. Każda cena to stawka standardowa dla najkrótszego zakresu kontekstu, bez rabatu za przetwarzanie wsadowe ani priorytet. Dopłaty za długi kontekst, stawki wsadowe i promocje opisano w szczegółach każdego modelu. Żadna cena nie pochodzi od pośrednika.
Płać jedną czwartą ceny katalogowej
Środki na API AIGROW są rozliczane według cen katalogowych twórców modeli, takich jak powyżej, a za $25 otrzymujesz środki na użycie o wartości $100. Listę objętych nimi modeli znajdziesz na stronie środków na API.
Ceny sprawdzone 22 września 2026