Gemini 3.1 Flash-Lite: koszt użycia
Cena katalogowa, którą Google podaje dla modelu Gemini 3.1 Flash-Lite, koszt odpowiedzi dla klienta, streszczenia dokumentu i zadania agenta oraz pozycja tego modelu wśród 37 modeli.
Dolary amerykańskie za milion tokenów, stawka standardowa, najkrótszy zakres kontekstu.
- 1,000 odpowiedzi wsparcia
- $1.35
- Tokeny wejściowe z pamięci podręcznej
- $0.025
- Okno kontekstowe
- 1 048 576 tokenów
- Data wydania
- 7 maj 2026
- Wagi
- Zamknięte
Według stron Google, 22 września 2026.
W API Google model Gemini 3.1 Flash-Lite kosztuje $0.25 za milion tokenów wejściowych, $1.50 za milion tokenów wyjściowych i $0.025 za milion tokenów wejściowych odczytanych z pamięci podręcznej. Przy tych cenach koszt 1,000 odpowiedzi dla klientów wynosi $1.35. Pozycja na naszej liście: pozycja: 7.. najtańszy wśród 33 modeli z podaną ceną.
Koszt zadania
Trzy zadania, każde wykonane 1,000 razy według powyższej ceny katalogowej, oraz pozycja modelu Gemini 3.1 Flash-Lite wśród 33 modeli z ceną katalogową.
| Zadanie | 1,000 prób | Wśród 33 modeli |
|---|---|---|
| Odpowiedź klientowi3,000 na wejściu, 400 na wyjściu. | $1.35 | 7.. najtańszy |
| Streszczenie dokumentu25,000 na wejściu, 1,000 na wyjściu. | $7.75 | 7.. najtańszy |
| Zadanie agenta80,000 na wejściu (w tym 70,000 z pamięci podręcznej), 3,000 na wyjściu. | $8.75 | 5.. najtańszy |
Liczbę tokenów dobraliśmy sami tak, by odpowiadała rzeczywistym zadaniom. Ceny pochodzą od Google. Żadne z trzech zadań nie przekracza 200,000 tokenów na żądanie, więc nie podlega żadnej dopłacie za długi kontekst z naszej listy.
Gemini 3.1 Flash-Lite w rzeczywistych zadaniach małych firm
Co zmierzono w benchmarku AIGROW, gdy model Gemini 3.1 Flash-Lite otrzymał 20 zadań biurowych, z których każde oceniono jako zaliczone lub niezaliczone według stałych kryteriów.
- Odsetek zaliczonych prób
- Zaliczono 45% z 20 prób (95% przedział ufności: od 26% do 66%). Pozycja: 28. wśród 36 modeli.
- Koszt 1 000 zaliczonych prób
- $1.41, z uwzględnieniem niezaliczonych prób.
- Czas odpowiedzi
- Mediana: 1.7 s, 90. percentyl: 3.2 s.
- Najlepszy i najsłabszy wynik
- Sortowanie wiadomości e-mail (100% zaliczonych prób) i Odpowiedzi na opinie (0%).
Szczegóły cennika
Czego nie uwzględnia powyższa stawka podstawowa, według stron twórcy modelu: dopłat, rabatów, promocji i cen za korzystanie z pamięci podręcznej.
Dźwięk na wejściu kosztuje $0.50 (z pamięci podręcznej $0.05). Batch jest tańszy o 50%. Przechowywanie pamięci podręcznej kosztuje $1.00 za MTok na godzinę.
Gemini 3.1 Flash-Lite na tle porównywanych modeli
W każdym porównaniu zestawiamy ceny katalogowe obu modeli i obliczamy koszt tych samych trzech zadań dla każdego z nich.
- kontra GPT-5.6 Luna
- Model OpenAI z serii nano na tle najtańszego Gemini od Google, w zbliżonej cenie.
- kontra Gemini 3.5 Flash-Lite
- Dwie generacje Flash-Lite od Google. Nowsza kosztuje więcej za generowanie odpowiedzi.
Inne modele Google
| Model | Tokeny wejściowe | Tokeny wyjściowe | Kontekst | 1,000 odpowiedzi |
|---|---|---|---|---|
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
| Gemma 4 31BGoogle · otwarte wagi | Brak ceny katalogowej | · | 256K | · |
Źródło ceny
Sprawdzono 22 września 2026. Każda cena to stawka standardowa dla najkrótszego zakresu kontekstu, bez rabatu za przetwarzanie wsadowe ani priorytet. Dopłaty za długi kontekst, stawki wsadowe i promocje opisano w szczegółach każdego modelu. Żadna cena nie pochodzi od pośrednika.
Płać jedną czwartą ceny katalogowej
Środki na API AIGROW są rozliczane według cen katalogowych twórców modeli. Za $25 otrzymujesz środki na wykorzystanie o wartości $100. Lista objętych nimi modeli znajduje się na stronie środków na API. Jeśli interesuje cię inny model, zapytaj przed zakupem.
Ceny sprawdzone 22 września 2026