Hurtige svar

AIGrow tilbyder overvågning af AI-synlighed, en virksomhedsassistent, blogudgivelse og afgrænsede automatiseringstjenester. Start med den gratis scanning for at se resultatet, før du betaler.

Kør den gratis scanning

Scanningen er gratis, og overvågningsplanerne starter ved $29 om måneden. Driftsauditten koster $290, synlighedsauditten koster $490, og specialbyggede løsninger får en skriftlig pris, før arbejdet begynder.

Se planerne

Kør den gratis scanning. Den læser dit website, spørger flere AI-assistenter, hvad dine kunder spørger om, og peger på én ting. Du behøver ikke at oprette dig, og den fortæller dig, hvis du ikke har brug for os.

Start nu

Ja. Brug kontaktformularen til spørgsmål om produktet, fakturering, support eller projekter. Beskriv målet og det involverede system, så det første svar kan blive konkret.

Kontakt AIGrow
Benchmark · 4 opgaver · oktober 2026-udgaven

Bedste AI-model til butikker

Opgaverne i AIGROWs benchmark for små virksomheder, som en butik ville give til AI, og hvordan hver af 36 modeller klarede hver enkelt opgave, bedømt som bestået eller ikke bestået efter skriftlige kriterier.

oktober 2026-udgaven, pilotforsøg, 1 gennemførsel pr. model på hver opgave.

Bestod flest af de 4 opgaver
4/412 modeller
Qwen3.8 Flash
4 af 4
Gemini 3.1 Pro (preview)
4 af 4
DeepSeek V4.1 Flash
4 af 4
DeepSeek V4 Pro
4 af 4
Gemini 3.8 Flash
4 af 4
Claude Sonnet 5
4 af 4

Ved uafgjort vinder modellen med det bedste resultat på tværs af alle 20 opgaver.

AIGROWs benchmark for små virksomheder indeholder 4 opgaver, som en butik ville give til AI: besvarelse af anmodninger om refusion, besvarelse af reklamationer på italiensk, skrivning af italienske produktbeskrivelser og skrivning af mødereferater. I oktober 2026-udgaven bestod 12 modeller alle 4. Blandt dem havde DeepSeek V4.1 Flash de billigste beståede forsøg på tværs af benchmarken til $1.05 pr. tusind.

Alle modeller på disse opgaver

Flest beståede opgaver først. Ved uafgjort vinder modellen med det bedste resultat på tværs af alle 20 opgaver. Prisen for 1.000 beståede opgaver beregnes ud fra hele benchmarken, inklusive mislykkede gennemførsler.

Hver models resultat på de opgaver, som en butik giver videre
ModelBesvarelse af anmodninger om refusionBesvarelse af reklamationer på italienskSkrivning af italienske produktbeskrivelserSkrivning af mødereferaterBeståede1.000 beståede opgaver
Qwen3.8 FlashBeståetBeståetBeståetBestået4 af 4$1.09
Gemini 3.1 Pro (preview)BeståetBeståetBeståetBestået4 af 4$29.67
DeepSeek V4.1 FlashBeståetBeståetBeståetBestået4 af 4$1.05
DeepSeek V4 ProBeståetBeståetBeståetBestået4 af 4$5.14
Gemini 3.8 FlashBeståetBeståetBeståetBestået4 af 4$7.17
Claude Sonnet 5BeståetBeståetBeståetBestået4 af 4$6.70
Qwen3.8 MaxBeståetBeståetBeståetBestået4 af 4$16.32
Claude Opus 5BeståetBeståetBeståetBestået4 af 4$16.89
GPT-5.5BeståetBeståetBeståetBestået4 af 4$17.02
GPT-6 AstraBeståetBeståetBeståetBestået4 af 4$27.91
GPT-5.6 TerraBeståetBeståetBeståetBestået4 af 4$6.68
Kimi K2.6BeståetBeståetBeståetBestået4 af 4$11.68
Kimi K3BeståetBeståetIkke beståetBestået3 af 4$18.44
GLM-5.3-FlashBeståetBeståetIkke beståetBestået3 af 4$0.831
GLM-5.3BeståetBeståetIkke beståetBestået3 af 4$7.02
Grok 4.7BeståetBeståetIkke beståetBestået3 af 4$9.41
Qwen3.7 PlusIkke beståetBeståetBeståetBestået3 af 4$3.58
GPT-5.6 SolIkke beståetBeståetBeståetBestået3 af 4$11.33
Claude Fable 5.1Ikke beståetBeståetBeståetBestået3 af 4$33.11
GPT-5.6 LunaIkke beståetBeståetBeståetBestået3 af 4$0.677
MiniMax M3BeståetBeståetIkke beståetBestået3 af 4$1.82
Claude Sonnet 4.6Ikke beståetBeståetBeståetBestået3 af 4$11.24
Gemma 4 31BIkke beståetBeståetBeståetBestået3 af 4$0.558
Muse Glimmer 30BIkke beståetBeståetBeståetIkke bestået2 af 4$3.10
Grok 4.3Ikke beståetBeståetIkke beståetBestået2 af 4$4.10
Qwen3.8 27BIkke beståetBeståetIkke beståetBestået2 af 4$7.30
gpt-oss-120bIkke beståetBeståetIkke beståetBestået2 af 4$0.422
Llama 4 MaverickIkke beståetIkke beståetBeståetBestået2 af 4$0.665
GPT-5.4 miniIkke beståetBeståetIkke beståetBestået2 af 4$3.35
Mistral Medium 3.5Ikke beståetBeståetIkke beståetBestået2 af 4$7.40
Gemini 3.1 Flash-LiteIkke beståetIkke beståetBeståetIkke bestået1 af 4$1.41
Claude Haiku 4.5Ikke beståetBeståetIkke beståetIkke bestået1 af 4$6.62
GPT-5.4 nanoIkke beståetIkke beståetIkke beståetBestået1 af 4$1.51
Ministral 3 14BIkke beståetBeståetIkke beståetIkke bestået1 af 4$1.07
Gemini 3.5 Flash-LiteIkke beståetIkke beståetIkke beståetIkke bestået0 af 4$2.47
Mistral Small 4Ikke beståetIkke beståetIkke beståetIkke bestået0 af 4$1.33

Opgaverne

Hver side viser opgaven, som modellerne fik den, faldgruberne, alle kriterierne forklaret med ord, og hvad hver model gjorde forkert.

Lad en agent udføre arbejdet

En AIGROW-agent udfører den slags arbejde i dine egne værktøjer efter regler, du har godkendt skriftligt. Den sender det videre, som reglerne ikke dækker, i stedet for at gætte.

oktober 2026-udgaven