Was 37 KI-Modelle kosten, laut den Preislisten ihrer Anbieter
Die Listenpreise der Modelle, die für kleine Unternehmen infrage kommen, von 11 Anbietern. Dazu die Kosten für drei alltägliche Aufgaben mit jedem Modell: eine Supportantwort, eine Dokumentzusammenfassung und eine Agentenaufgabe.
Preise in US-Dollar pro Million Token zum Standardtarif. Keine Preise von Wiederverkäufern.
- Modelle
- 37
- Anbieter
- 11
- Offene Modellgewichte
- 15
- Kein Listenpreis
- 4
Jeweils 3.000 Eingabe- und 400 Ausgabe-Tokens zum Listenpreis.
Wir haben am 22. September 2026 die Listenpreise von 37 KI-Modellen bei 11 Anbietern auf deren eigenen Preisseiten geprüft. Für 1,000 Antworten auf Supportanfragen kostet das günstigste Modell, Qwen3.8 Flash, $0.64 und das teuerste, GPT-6 Astra, $50.00: ein Kostenunterschied um den Faktor 78 für dieselbe Aufgabe.
Flaggschiffmodelle
Das leistungsfähigste Modell jedes Anbieters, das für die anspruchsvollsten Aufgaben vorgesehen ist.
| Modell | Eingabe | Ausgabe | Kontext | 1,000 Antworten |
|---|---|---|---|---|
| MiniMax M3MiniMax · offene Modellgewichte | $0.30 | $1.20 | 1M | $1.38 |
| Muse Spark 1.3Meta | $1.25 | $4.25 | 1.05M | $5.45 |
| DeepSeek V4 ProDeepSeek · offene Modellgewichte | $1.32 | $3.96 | 1M | $5.54 |
| GLM-5.3Z.ai · offene Modellgewichte | $1.40 | $4.40 | 1M | $5.96 |
| Mistral Medium 3.5Mistral · offene Modellgewichte | $1.50 | $7.50 | 256K | $7.50 |
| Grok 4.7xAI | $2.00 | $6.00 | 500K | $8.40 |
| Qwen3.8 MaxAlibaba (Qwen) | $2.00 | $6.00 | 1M | $8.40 |
| Gemini 3.1 Pro (preview)Google | $2.00 | $12.00 | 1.05M | $10.80 |
| Kimi K3Moonshot AI · offene Modellgewichte | $3.00 | $15.00 | 1.05M | $15.00 |
| GPT-5.6 SolOpenAI | $4.00 | $20.00 | 1.05M | $20.00 |
| Claude Opus 5Anthropic | $5.00 | $25.00 | 1M | $25.00 |
| GPT-5.5OpenAI | $5.00 | $30.00 | 1.05M | $27.00 |
| Claude Fable 5.1Anthropic | $10.00 | $50.00 | 1M | $50.00 |
| GPT-6 AstraOpenAI | $10.00 | $50.00 | 1.05M | $50.00 |
Allrounder
Die Mittelklasse im Angebot jedes Anbieters: das Modell, das die meisten Produkte im Alltag nutzen.
| Modell | Eingabe | Ausgabe | Kontext | 1,000 Antworten |
|---|---|---|---|---|
| Qwen3.7 PlusAlibaba (Qwen) | $0.40 | $1.60 | 1M | $1.84 |
| Gemini 3.8 FlashGoogle | $0.75 | $3.75 | 1.05M | $3.75 |
| Kimi K2.6Moonshot AI · offene Modellgewichte | $0.95 | $4.00 | 262K | $4.45 |
| Claude Sonnet 5Anthropic | $2.00 | $10.00 | 1M | $10.00 |
| GPT-5.6 TerraOpenAI | $2.00 | $12.00 | 1.05M | $10.80 |
| Claude Sonnet 4.6Anthropic | $3.00 | $15.00 | 1M | $15.00 |
| gpt-oss-120bOpenAI · offene Modellgewichte | Kein Listenpreis | · | 131K | · |
| Llama 4 MaverickMeta · offene Modellgewichte | Kein Listenpreis | · | 1M | · |
Klein und schnell
Das günstigste und schnellste Modell jedes Anbieters, für große Mengen und einfache Schritte.
| Modell | Eingabe | Ausgabe | Kontext | 1,000 Antworten |
|---|---|---|---|---|
| Qwen3.8 FlashAlibaba (Qwen) | $0.15 | $0.47 | 1M | $0.64 |
| GLM-5.3-FlashZ.ai · offene Modellgewichte | $0.15 | $0.50 | 1M | $0.65 |
| Ministral 3 14BMistral · offene Modellgewichte | $0.20 | $0.20 | 256K | $0.68 |
| Mistral Small 4Mistral · offene Modellgewichte | $0.15 | $0.60 | 256K | $0.69 |
| GPT-5.6 LunaOpenAI | $0.20 | $1.20 | 1.05M | $1.08 |
| GPT-5.4 nanoOpenAI | $0.20 | $1.25 | 400K | $1.10 |
| Gemini 3.1 Flash-LiteGoogle | $0.25 | $1.50 | 1.05M | $1.35 |
| DeepSeek V4.1 FlashDeepSeek · offene Modellgewichte | $0.30 | $1.20 | 1M | $1.38 |
| Gemini 3.5 Flash-LiteGoogle | $0.30 | $2.50 | 1.05M | $1.90 |
| Qwen3.8 27BAlibaba (Qwen) · offene Modellgewichte | $0.50 | $3.00 | 1M | $2.70 |
| GPT-5.4 miniOpenAI | $0.75 | $4.50 | 400K | $4.05 |
| Grok 4.3xAI | $1.25 | $2.50 | 1M | $4.75 |
| Claude Haiku 4.5Anthropic | $1.00 | $5.00 | 200K | $5.00 |
| Gemma 4 31BGoogle · offene Modellgewichte | Kein Listenpreis | · | 256K | · |
| Muse Glimmer 30BMeta · offene Modellgewichte | Kein Listenpreis | · | 128K | · |
Die drei Aufgaben, auf denen alle Kostenberechnungen beruhen
Die Tokenzahlen stammen von uns und sind so gewählt, dass sie realistischen Aufgaben entsprechen. Die Preise stammen von den Anbietern. Auf jeder Modellseite werden alle drei Aufgaben durchgerechnet.
- Support-Antwort
- Eine Anfrage mit 3.000 Tokens (das Ticket, der bisherige Nachrichtenverlauf und ein Auszug aus den Richtlinien) und eine Antwort mit 400 Tokens. 3,000 Eingabe-Token, 400 Ausgabe-Token.
- Dokumentenzusammenfassung
- Ein 40-seitiges Dokument mit etwa 25.000 Eingabe-Tokens und eine Zusammenfassung mit 1.000 Ausgabe-Tokens. 25,000 Eingabe-Token, 1,000 Ausgabe-Token.
- Agentenaufgabe
- Zehn Schritte, die zusammen 80.000 Tokens lesen, davon 70.000 Tokens als von Schritt zu Schritt wiederholter Kontext aus dem Cache, und 3.000 Tokens schreiben. 80,000 Eingabe-Token (davon 70,000 aus dem Cache), 3,000 Ausgabe-Token.
Die Kategorien richten sich nach dem jeweiligen Modellangebot der Anbieter, nicht nach Preisgruppen. Deshalb kann das Spitzenmodell eines Anbieters günstiger sein als das Alltagsmodell eines anderen. Für 4 Modelle mit offenen Gewichten gibt es keinen Listenpreis, weil ihre Anbieter dafür keine API verkaufen. Ihre Kosten hängen vom Hosting-Anbieter ab.
Direkter Vergleich
Die 52 Vergleiche, nach denen Menschen suchen, jeweils mit beiden Preisen und den Kosten für die drei Aufgaben mit jedem Modell.
- GPT-6 Astra vs. Claude Fable 5.1
- GPT-6 Astra vs. Gemini 3.1 Pro (preview)
- Claude Fable 5.1 vs. Gemini 3.1 Pro (preview)
- GPT-6 Astra vs. GPT-5.6 Sol
- Claude Fable 5.1 vs. Claude Opus 5
- GPT-5.5 vs. GPT-5.6 Sol
- Claude Opus 5 vs. GPT-5.6 Sol
- Claude Opus 5 vs. Gemini 3.1 Pro (preview)
- GPT-5.6 Sol vs. Gemini 3.1 Pro (preview)
- Grok 4.7 vs. GPT-5.6 Sol
- Grok 4.7 vs. Claude Opus 5
- Grok 4.7 vs. Gemini 3.1 Pro (preview)
- DeepSeek V4 Pro vs. Claude Opus 5
- DeepSeek V4 Pro vs. GPT-5.6 Sol
- Kimi K3 vs. Claude Opus 5
- Qwen3.8 Max vs. DeepSeek V4 Pro
- GLM-5.3 vs. DeepSeek V4 Pro
- GLM-5.3 vs. Kimi K3
- MiniMax M3 vs. DeepSeek V4 Pro
- Muse Spark 1.3 vs. GPT-5.6 Sol
- Muse Spark 1.3 vs. Grok 4.7
- Mistral Medium 3.5 vs. Claude Sonnet 5
- Claude Sonnet 5 vs. GPT-5.6 Terra
- Claude Sonnet 5 vs. Gemini 3.8 Flash
- GPT-5.6 Terra vs. Gemini 3.8 Flash
- Claude Sonnet 5 vs. Claude Sonnet 4.6
- Claude Sonnet 5 vs. Claude Opus 5
- GPT-5.6 Sol vs. GPT-5.6 Terra
- Qwen3.7 Plus vs. Gemini 3.8 Flash
- Kimi K2.6 vs. GPT-5.6 Terra
- Mistral Medium 3.5 vs. Gemini 3.8 Flash
- Grok 4.3 vs. Gemini 3.8 Flash
- Llama 4 Maverick vs. gpt-oss-120b
- gpt-oss-120b vs. DeepSeek V4.1 Flash
- GPT-5.6 Luna vs. Gemini 3.5 Flash-Lite
- GPT-5.6 Luna vs. Gemini 3.1 Flash-Lite
- Claude Haiku 4.5 vs. GPT-5.6 Luna
- Claude Haiku 4.5 vs. Gemini 3.8 Flash
- Claude Haiku 4.5 vs. GPT-5.4 mini
- GPT-5.4 mini vs. GPT-5.6 Luna
- GPT-5.4 nano vs. GPT-5.6 Luna
- Gemini 3.5 Flash-Lite vs. Gemini 3.1 Flash-Lite
- DeepSeek V4.1 Flash vs. GPT-5.6 Luna
- DeepSeek V4.1 Flash vs. Gemini 3.5 Flash-Lite
- Qwen3.8 Flash vs. DeepSeek V4.1 Flash
- GLM-5.3-Flash vs. Qwen3.8 Flash
- Mistral Small 4 vs. GPT-5.6 Luna
- Grok 4.3 vs. DeepSeek V4.1 Flash
- Ministral 3 14B vs. Gemma 4 31B
- Gemma 4 31B vs. Muse Glimmer 30B
- Muse Glimmer 30B vs. Qwen3.8 27B
- Qwen3.8 27B vs. Gemma 4 31B
Preise nach Anbieter
Eine Seite pro Anbieter: seine Modelle mit Kosten pro Token, pro Alltagsaufgabe und pro bestandener Antwort im Benchmark.
Woher die Preise stammen
Jeder Preis stammt von der Preisseite oder aus der Modelldokumentation des jeweiligen Anbieters. Hier sind die Quellen.
- Mistral
- docs.mistral.ai/models/mistral-medium-3-5-26-04 · docs.mistral.ai/models/mistral-small-4-0-26-03 · docs.mistral.ai/models/ministral-3-14b-25-12
- Alibaba (Qwen)
- alibabacloud.com/help/en/model-studio/model-pricing
- Moonshot AI
- platform.kimi.ai/docs/pricing/chat
Abgerufen am 22. September 2026. Jeder Preis gilt für den Standardtarif in der kürzesten Kontextstufe, ohne Batch- oder Priority-Rabatt. Aufschläge für langen Kontext, Batch-Tarife und Aktionen stehen im Kleingedruckten der jeweiligen Modellseite. Es wurden keine Preise von Wiederverkäufern übernommen.
Nur ein Viertel dieser Preise zahlen
AIGROW API-Guthaben wird zu den Listenpreisen der Anbieter abgerechnet, wie oben gezeigt. Für $25 erhalten Sie ein Nutzungsguthaben von $100. Auf der Seite zum Guthaben stehen die abgedeckten Modelle.
Preise geprüft am 22. September 2026