Schnelle Antworten

AIGrow bietet Monitoring der KI-Sichtbarkeit, einen Business-Assistenten, Blog-Veröffentlichungen und klar abgegrenzte Automatisierungsleistungen. Starten Sie mit dem kostenlosen Scan, um das Ergebnis vor einer Zahlung zu prüfen.

Kostenlosen Scan starten

Der Scan ist kostenlos, und die Monitoring-Tarife beginnen bei $29 pro Monat. Das Betriebsaudit kostet $290, das Sichtbarkeitsaudit kostet $490. Für individuelle Umsetzungen erhalten Sie vor Beginn der Arbeit einen schriftlich mitgeteilten Preis.

Tarife ansehen

Starten Sie den kostenlosen Scan. Er liest Ihre Website aus, fragt mehrere KI-Assistenten, wonach Ihre Kunden fragen, und weist Sie auf eine Sache hin. Eine Registrierung ist nicht erforderlich, und Sie erfahren, wenn Sie uns nicht brauchen.

Jetzt starten

Ja. Nutzen Sie das Kontaktformular für Fragen zu Produkten, Abrechnung, Support oder Projekten. Beschreiben Sie das Ziel und das beteiligte System, damit die erste Antwort konkret sein kann.

AIGrow kontaktieren
Benchmark · 6 Aufgaben · Ausgabe Oktober 2026

Bestes KI-Modell für Steuerberatungs- und Buchhaltungsfirmen

Die Aufgaben des AIGROW-Benchmarks für kleine Unternehmen, die eine Steuer- oder Wirtschaftsprüfungskanzlei an KI vergeben würde, und die Ergebnisse aller 36 Modelle bei jeder Aufgabe, bewertet als bestanden oder nicht bestanden anhand schriftlich festgelegter Prüfkriterien.

Ausgabe Oktober 2026, Pilotphase, 1 Durchlauf pro Modell und Aufgabe.

Bei den meisten der 6 Aufgaben bestanden
6/615 Modelle
Qwen3.8 Flash
6 von 6
Kimi K3
6 von 6
Gemini 3.1 Pro (preview)
6 von 6
GLM-5.3-Flash
6 von 6
DeepSeek V4.1 Flash
6 von 6
GLM-5.3
6 von 6

Bei Gleichstand entscheidet die bessere Bilanz über alle 20 Aufgaben hinweg.

Der AIGROW-Benchmark für kleine Unternehmen umfasst 6 Aufgaben, die eine Steuer- oder Wirtschaftsprüfungskanzlei an KI vergeben würde. In der Ausgabe vom Oktober 2026 bestand 15 Modelle alle 6. Unter diesen lieferte gpt-oss-120b die günstigsten erfolgreichen Durchläufe im gesamten Benchmark, für $0.422 pro tausend. Jede Aufgabenseite zeigt die Fallstricke und die Fehler aller Modelle.

Alle Modelle bei diesen Aufgaben

Die meisten bestandenen Durchläufe zuerst. Bei Gleichstand entscheidet die bessere Bilanz über alle 20 Aufgaben hinweg. Die Kosten für 1.000 bestandene Durchläufe beruhen auf dem gesamten Benchmark, einschließlich fehlgeschlagener Durchläufe.

Das Ergebnis jedes Modells bei den Aufgaben, die eine Steuer- oder Wirtschaftsprüfungskanzlei vergibt
ModellEinen italienischen Kontoauszug kategorisierenBanktransaktionen kategorisierenRechnungsdaten extrahierenDaten aus italienischen Lieferantenrechnungen extrahierenItalienische Freiberuflerrechnungen berechnenÜberstundenvergütung berechnenBestanden1.000 erfolgreiche Durchläufe
Qwen3.8 FlashBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$1.09
Kimi K3BestandenBestandenBestandenBestandenBestandenBestanden6 von 6$18.44
Gemini 3.1 Pro (preview)BestandenBestandenBestandenBestandenBestandenBestanden6 von 6$29.67
GLM-5.3-FlashBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$0.831
DeepSeek V4.1 FlashBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$1.05
GLM-5.3BestandenBestandenBestandenBestandenBestandenBestanden6 von 6$7.02
Grok 4.7BestandenBestandenBestandenBestandenBestandenBestanden6 von 6$9.41
Qwen3.7 PlusBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$3.58
Claude Sonnet 5BestandenBestandenBestandenBestandenBestandenBestanden6 von 6$6.70
GPT-5.6 SolBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$11.33
GPT-6 AstraBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$27.91
Muse Glimmer 30BBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$3.10
Grok 4.3BestandenBestandenBestandenBestandenBestandenBestanden6 von 6$4.10
Qwen3.8 27BBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$7.30
gpt-oss-120bBestandenBestandenBestandenBestandenBestandenBestanden6 von 6$0.422
DeepSeek V4 ProBestandenNicht bestandenBestandenBestandenBestandenBestanden5 von 6$5.14
Gemini 3.8 FlashBestandenBestandenNicht bestandenBestandenBestandenBestanden5 von 6$7.17
Qwen3.8 MaxBestandenBestandenNicht bestandenBestandenBestandenBestanden5 von 6$16.32
Claude Opus 5BestandenBestandenBestandenBestandenBestandenNicht bestanden5 von 6$16.89
GPT-5.5BestandenBestandenBestandenBestandenBestandenNicht bestanden5 von 6$17.02
Claude Fable 5.1BestandenBestandenBestandenBestandenBestandenNicht bestanden5 von 6$33.11
GPT-5.6 TerraBestandenBestandenBestandenBestandenBestandenNicht bestanden5 von 6$6.68
MiniMax M3BestandenBestandenBestandenNicht bestandenBestandenBestanden5 von 6$1.82
Claude Sonnet 4.6BestandenBestandenBestandenBestandenBestandenNicht bestanden5 von 6$11.24
Kimi K2.6BestandenBestandenBestandenBestandenBestandenNicht bestanden5 von 6$11.68
GPT-5.6 LunaBestandenNicht bestandenBestandenBestandenBestandenNicht bestanden4 von 6$0.677
Gemini 3.5 Flash-LiteBestandenNicht bestandenBestandenBestandenBestandenNicht bestanden4 von 6$2.47
Gemma 4 31BNicht bestandenNicht bestandenBestandenBestandenBestandenNicht bestanden3 von 6$0.558
Gemini 3.1 Flash-LiteNicht bestandenNicht bestandenBestandenBestandenBestandenNicht bestanden3 von 6$1.41
GPT-5.4 miniNicht bestandenNicht bestandenBestandenBestandenBestandenNicht bestanden3 von 6$3.35
Claude Haiku 4.5Nicht bestandenNicht bestandenBestandenBestandenBestandenNicht bestanden3 von 6$6.62
GPT-5.4 nanoNicht bestandenNicht bestandenBestandenBestandenBestandenNicht bestanden3 von 6$1.51
Llama 4 MaverickNicht bestandenNicht bestandenBestandenNicht bestandenBestandenNicht bestanden2 von 6$0.665
Mistral Medium 3.5Nicht bestandenNicht bestandenBestandenNicht bestandenBestandenNicht bestanden2 von 6$7.40
Ministral 3 14BNicht bestandenNicht bestandenBestandenNicht bestandenBestandenNicht bestanden2 von 6$1.07
Mistral Small 4Nicht bestandenNicht bestandenBestandenNicht bestandenBestandenNicht bestanden2 von 6$1.33

Die Aufgaben

Jede Seite zeigt die Aufgabe so, wie die Modelle sie erhalten haben, ihre Fallstricke, alle Prüfkriterien in Worten und die Fehler jedes Modells.

Diese Arbeit einem Agenten übertragen

Ein AIGROW-Agent erledigt solche Aufgaben in Ihren eigenen Tools nach Regeln, die Sie schriftlich freigegeben haben. Was die Regeln nicht abdecken, gibt er zur Klärung weiter, statt zu raten.

Ausgabe Oktober 2026