Blinde test

Welk AI-model schrijft het beste Nederlands?

14 modellen schreven dezelfde 12 Nederlandse teksten. Jij leest ze twee aan twee, zonder naam en zonder prijs, en kiest steeds de betere. Aan het eind weet je welk model bij jouw smaak past.

Waarom blind testen

Wie weet dat een tekst van het duurste model komt, leest hem welwillender. Dat is menselijk. Logo en prijs kleuren je oordeel. Haal je die weg, dan blijft alleen de tekst over (en die komt lang niet altijd van het model waar je nu elke maand voor betaalt).

Het type tekst maakt ook uit. Een model dat een sterke blog van 400 woorden schrijft, maakt van een WhatsApp-bericht over een vertraagde verbouwing soms een stijf verhaal waar de klant op zijn telefoon doorheen moet scrollen. Kies daarom de klussen die je echt doet.

Wat de 14 AI-modellen kosten per 1.000 teksten

Bij het maken van de 168 teksten in deze test hebben we per tekst de API-kosten gemeten. Het duurste model, Kimi K3, kost met $26,70 per 1.000 teksten ongeveer 205 keer zoveel als het goedkoopste, GPT-6 Luna, dat op $0,13 uitkomt. Ook de lengte verschilt: bij dezelfde opdracht en hetzelfde woordmaximum schrijft het ene model bijna de helft meer dan het andere.

ModelMakerPer 1.000 tekstenGem. woorden
GPT-6 LunaOpenAI$0,13111
DeepSeek V4.1 FlashDeepSeek$0,80109
Mistral Medium 3.5Mistral$1,75105
GPT-6 SolOpenAI$2,49108
Grok 4.7xAI$3,94107
Gemini 3.8 FlashGoogle$4,74142
Claude Sonnet 5Anthropic$4,96152
Muse Spark 1.3Meta$5,18103
GLM-5.3Z.ai$7,47143
Qwen3.8 MaxQwen$11,83105
GPT-6 AstraOpenAI$12,27136
Claude Opus 5.5Anthropic$23,04145
Claude Fable 5.1Anthropic$24,12149
Kimi K3Moonshot AI$26,70141

Gemiddelde over 12 schrijfklussen, gemeten op 25 september 2026 via OpenRouter, in dollars. Prijzen van AI-modellen veranderen vaak. Gebruik de tabel om modellen onderling te vergelijken. De actuele prijs staat bij de aanbieder.

Zo is de test opgezet

Elk model kreeg dezelfde Nederlandse opdracht, met een fictief bedrijf, concrete feiten en een woordmaximum. De enige vaste instructie was: schrijf in het Nederlands en lever alleen de tekst. Er zijn geen stijlregels meegegeven en niets is achteraf aangepast. Dat zie je terug: sommige modellen strooien met gedachtestreepjes, andere blijven keurig onder het woordmaximum. Maar dat is precies wat je wilt weten voordat je er een abonnement op neemt.

Per klus treden alle 14 modellen aan in willekeurige volgorde. De winnaar van een duel blijft staan tegen het volgende model, en de positie links of rechts wisselt willekeurig. Wie het laatst overblijft, wint de klus. Voor je totaalranglijst tellen we per klus hoe ver elk model kwam. Wil je daarna weten of je eigen tekst als AI herkend wordt, check hem dan met de AI-checker of doe de AI of Mens-test.

FAQ

Vragen? Antwoorden.

Iets niet gevonden? klantenservice team.

Welk AI-model schrijft het beste Nederlands?
Welk AI-model het beste Nederlands schrijft, hangt af van je smaak en van het soort tekst. Een klantenservicemail vraagt iets anders dan een LinkedIn-post of een vacaturetekst. In deze test kies je daarom zelf: per schrijfklus lees je 13 keer twee anonieme teksten van 14 modellen van onder meer OpenAI, Anthropic, Google, Mistral en DeepSeek. Daarna zie je welk model het vaakst jouw voorkeur kreeg.
Hoe werkt de blinde AI-schrijftest?
De blinde AI-schrijftest werkt als een toernooi waarin de winnaar blijft staan. Per schrijfklus zie je twee teksten zonder modelnaam en kies je de betere. De winnaar neemt het op tegen het volgende model, tot alle 14 modellen geweest zijn. Of een tekst links of rechts staat, is elke keer willekeurig. Na het laatste duel tellen we per model hoe ver het kwam en maken daar je ranglijst van.
Is een duur AI-model beter in schrijven?
Een duur AI-model schrijft niet automatisch betere teksten. In deze test kost Kimi K3 $26,70 per 1.000 teksten en GPT-6 Luna $0,13, een verschil van ongeveer 205 keer. Of je dat terugziet, merk je pas als naam en prijs verborgen zijn. Wint een goedkoop model bij jou, dan bespaar je op je schrijfwerk zonder dat de tekst eronder lijdt.
Hoe zijn de teksten in de test gemaakt?
De teksten in de test zijn op 25 september 2026 in één keer gemaakt via OpenRouter, een dienst die alle modellen via dezelfde API aanbiedt. Elk model kreeg precies dezelfde Nederlandse opdracht en systeemprompt, met temperatuur 0,7 en zonder stijlinstructies. We hebben de teksten niet bewerkt. Je leest dus hoe elk model uit zichzelf schrijft, inclusief gedachtestreepjes en andere vaste gewoontes.
Waarom vraagt de test om mijn e-mailadres?
De test vraagt om je e-mailadres voordat je je persoonlijke ranglijst ziet. Zo blijft de test gratis en sturen we je later de uitslag van alle deelnemers: welk model Nederland het beste vindt schrijven, per soort tekst. Je keuzes in de duels tellen anoniem mee in dat totaal. Je adres gebruiken we alleen voor deze test en de uitslag.
Kun je zien of een tekst door AI is geschreven?
Of een tekst door AI is geschreven, zie je met het blote oog steeds lastiger. In deze test merk je dat zelf: alle teksten komen van AI, maar sommige lezen als een gewone mail van een collega. Wil je het zeker weten, plak de tekst dan in de gratis AI-checker van AI-Checker.nl. Die let op Nederlandse AI-signalen, zoals vaste stopzinnen en een opvallend gelijkmatig zinsritme.