Raske svar

AIGrow tilbyr overvåking av synlighet i KI, en assistent for bedriften, publisering av blogginnlegg og avgrensede automatiseringstjenester. Start med den kostnadsfrie skanningen for å se resultatet før du betaler.

Kjør den kostnadsfrie skanningen

Skanningen er kostnadsfri, og overvåkingsplanene starter på $29 i måneden. Driftsanalysen koster $290, synlighetsanalysen koster $490, og for spesialtilpassede løsninger får du en skriftlig pris før arbeidet starter.

Se planene

Kjør den kostnadsfrie skanningen. Den leser nettstedet ditt, spør flere KI-assistenter hva kundene dine spør om, og peker på én ting. Du trenger ikke å registrere deg, og den forteller deg hvis du ikke trenger oss.

Start nå

Ja. Bruk kontaktskjemaet hvis du har spørsmål om produktet, fakturering, brukerstøtte eller et prosjekt. Beskriv målet og hvilket system det gjelder, slik at du får et konkret svar med en gang.

Kontakt AIGrow
Benchmark · 4 oppgaver · oktober 2026-utgaven

Beste KI-modell for butikker

Oppgavene i AIGROWs referansetest for småbedrifter som en butikk ville gitt til KI, og hvordan hver av 36 modeller klarte hver oppgave, vurdert som bestått eller ikke bestått etter skriftlige kriterier.

oktober 2026-utgaven, pilot, 1 kjøring per modell på hver oppgave.

Bestått på flest av de 4 oppgavene
4/412 modeller
Qwen3.8 Flash
4 av 4
Gemini 3.1 Pro (preview)
4 av 4
DeepSeek V4.1 Flash
4 av 4
DeepSeek V4 Pro
4 av 4
Gemini 3.8 Flash
4 av 4
Claude Sonnet 5
4 av 4

Ved delt plassering avgjør resultatet på tvers av alle 20 oppgavene.

AIGROWs referansetest for småbedrifter har 4 oppgaver som en butikk ville gitt til KI: svar på refusjonsforespørsler, svar på garantikrav på italiensk, skriving av italienske produktbeskrivelser og skriving av møtereferater. I oktober 2026-utgaven besto 12 modeller alle 4. Blant dem hadde DeepSeek V4.1 Flash lavest pris per tusen beståtte kjøringer på tvers av referansetesten: $1.05.

Alle modellenes resultater på disse oppgavene

Flest beståtte først. Ved delt plassering avgjør resultatet på tvers av alle 20 oppgavene. Kostnaden for 1,000 beståtte kjøringer beregnes for hele benchmarken, inkludert kjøringer som ikke besto.

Resultatene for hver modell på oppgavene som en butikk gir dem
ModellSvar på refusjonsforespørslerSvar på garantikrav på italienskSkriving av italienske produktbeskrivelserSkriving av møtereferaterBestått1,000 beståtte kjøringer
Qwen3.8 FlashBeståttBeståttBeståttBestått4 av 4$1.09
Gemini 3.1 Pro (preview)BeståttBeståttBeståttBestått4 av 4$29.67
DeepSeek V4.1 FlashBeståttBeståttBeståttBestått4 av 4$1.05
DeepSeek V4 ProBeståttBeståttBeståttBestått4 av 4$5.14
Gemini 3.8 FlashBeståttBeståttBeståttBestått4 av 4$7.17
Claude Sonnet 5BeståttBeståttBeståttBestått4 av 4$6.70
Qwen3.8 MaxBeståttBeståttBeståttBestått4 av 4$16.32
Claude Opus 5BeståttBeståttBeståttBestått4 av 4$16.89
GPT-5.5BeståttBeståttBeståttBestått4 av 4$17.02
GPT-6 AstraBeståttBeståttBeståttBestått4 av 4$27.91
GPT-5.6 TerraBeståttBeståttBeståttBestått4 av 4$6.68
Kimi K2.6BeståttBeståttBeståttBestått4 av 4$11.68
Kimi K3BeståttBeståttIkke beståttBestått3 av 4$18.44
GLM-5.3-FlashBeståttBeståttIkke beståttBestått3 av 4$0.831
GLM-5.3BeståttBeståttIkke beståttBestått3 av 4$7.02
Grok 4.7BeståttBeståttIkke beståttBestått3 av 4$9.41
Qwen3.7 PlusIkke beståttBeståttBeståttBestått3 av 4$3.58
GPT-5.6 SolIkke beståttBeståttBeståttBestått3 av 4$11.33
Claude Fable 5.1Ikke beståttBeståttBeståttBestått3 av 4$33.11
GPT-5.6 LunaIkke beståttBeståttBeståttBestått3 av 4$0.677
MiniMax M3BeståttBeståttIkke beståttBestått3 av 4$1.82
Claude Sonnet 4.6Ikke beståttBeståttBeståttBestått3 av 4$11.24
Gemma 4 31BIkke beståttBeståttBeståttBestått3 av 4$0.558
Muse Glimmer 30BIkke beståttBeståttBeståttIkke bestått2 av 4$3.10
Grok 4.3Ikke beståttBeståttIkke beståttBestått2 av 4$4.10
Qwen3.8 27BIkke beståttBeståttIkke beståttBestått2 av 4$7.30
gpt-oss-120bIkke beståttBeståttIkke beståttBestått2 av 4$0.422
Llama 4 MaverickIkke beståttIkke beståttBeståttBestått2 av 4$0.665
GPT-5.4 miniIkke beståttBeståttIkke beståttBestått2 av 4$3.35
Mistral Medium 3.5Ikke beståttBeståttIkke beståttBestått2 av 4$7.40
Gemini 3.1 Flash-LiteIkke beståttIkke beståttBeståttIkke bestått1 av 4$1.41
Claude Haiku 4.5Ikke beståttBeståttIkke beståttIkke bestått1 av 4$6.62
GPT-5.4 nanoIkke beståttIkke beståttIkke beståttBestått1 av 4$1.51
Ministral 3 14BIkke beståttBeståttIkke beståttIkke bestått1 av 4$1.07
Gemini 3.5 Flash-LiteIkke beståttIkke beståttIkke beståttIkke bestått0 av 4$2.47
Mistral Small 4Ikke beståttIkke beståttIkke beståttIkke bestått0 av 4$1.33

Oppgavene

Hver side viser oppgaven slik modellene fikk den, fallgruvene, alle vurderingskriteriene forklart med ord og hva hver modell gjorde feil.

La en agent gjøre dette arbeidet

En AIGROW-agent gjør slikt arbeid i dine egne verktøy, etter regler du har godkjent skriftlig. Den eskalerer det reglene ikke dekker, i stedet for å gjette.

oktober 2026-utgaven