AAItekstdetector.nl
Gids

Kan een AI-detector vertaalde tekst herkennen?

Bijgewerkt: 2026-06-16·AItekstdetector.nl

Kort antwoord: nee, niet goed. Als je AI-tekst eerst in het Engels genereert en daarna met Google Translate of DeepL naar het Nederlands vertaalt, dalen de AI-scores dramatisch. Dit is een effectieve (hoewel niet perfecte) manier om detectie te omzeilen — een reden waarom detectie nooit sluitend bewijs kan zijn.

AanbevolenProbeer Winston AI voor vertaalde tekst
Winston AI →

Wat gebeurt er bij vertaling?

Als je AI-gegenereerde tekst vertaalt, verandert veel van wat een detector zoekt:

De oorspronkelijke AI-signalen verdwijnen. AI-modellen schrijven op bepaalde manieren: bepaalde woordkeuzes, bepaalde zinsstructuren, bepaalde niveaus van perplexiteit. Deze signalen zijn taalspesifiek. Wanneer je de tekst naar het Nederlands vertaalt, worden die signalen gefilterd door de vertaalmachine. De vertaalmachine kiest andere woorden, andere grammatica, ander ritme.

Vertaalmachines voegen hun eigen patronen in. Moderne neurale vertalers (Google Translate, DeepL, Microsoft Translator) hebben hun eigen "stijl". Ze vertalen consistent, soms wat onnatuurlijk, soms wat formeel. Deze patronen zijn zelf herkenbaar voor AI-detectoren — maar als "automatisch gegenereerde tekst", niet altijd als "AI-geschreven". Dit maakt de zaak ingewikkelder.

Er ontstaat een hybride handtekening. De uiteindelijke tekst is een mix van AI-signalen (veel verzwakt), vertaalmachine-signalen, en regelmatig Nederlands. Dit hybride patroon is lastig voor detectoren, omdat het niet past in hun trainingsgegevens: ze hebben niet veel voorbeelden van "AI-tekst → vertaald naar Nederlands" getraind.

Hoe erg is het effect?

Tests (onder meer van Copyleaks, originality.ai en meerdere onderzoeksinstituten) tonen aan:

  • Niet-vertaalde AI-tekst (Engels): Detectoren herkennen dit met ~75-85% nauwkeurigheid.
  • Niet-vertaalde AI-tekst (Nederlands): Nauwkeurigheid daalt naar ~60-70% (omdat Nederlands underrepresented is).
  • AI-tekst, vertaald EN→NL met Google Translate: Nauwkeurigheid naar ~40-50%. Veel AI-signalen zijn weg.
  • AI-tekst, vertaald EN→NL met DeepL: Nauwkeurigheid naar ~45-55%. DeepL is beter, maar het verschil is marginaal.

Het verschil is enorm. Je bent niet meer in "moeilijk detecteerbaar" terrein — je bent echt in "ondetecteerbaar" terrein.

Waarom werken detectoren slecht op vertaalde AI-tekst?

Er zijn enkele oorzaken:

1. Trainingsgegevens. Detectoren zijn niet specifiek getraind op "vertaalde AI-tekst". Ze hebben veel voorbeelden van AI-tekst in het Engels, veel voorbeelden van Nederlands menselijk geschreven, maar weinig tot geen voorbeelden van "AI-gegenereerd, vervolgens vertaald". Dit gat is groot.

2. Verlies van perplexiteit. Perplexiteit is een sleutelmetric voor detectoren: hoe voorspelbaar is de volgende token gegeven de voorgaande? AI-tekst heeft lage perplexiteit (voorspelbaar). Vertaalmachines produceren ook lage perplexiteit (formeel, voorspelbaar). Maar deze twee soorten lage perplexiteit zien er statistisch anders uit. Detectoren raken verward.

3. Woordkeuze verdwijnt. AI-modellen hebben voorkeuren voor bepaalde woorden en synoniemen. Dit is één van de sterkste signalen. Vertaallers kiezen hun eigen woorden. Dit sterkste signaal is weg.

4. Vertaalmachines voegen ruis toe. Vertaling is nooit perfect. De uitgangstaal (Engels) en doeltaal (Nederlands) zijn ingewikkeld. Dit maakt het detectie-model minder zeker. Onzekerheid = lagere scores.

Aparte aandacht: direct NL vs. vertaald

Belangrijk nuance: AI die direct in het Nederlands schrijft vs. AI die in het Engels schrijft en daarna vertaalt, zijn twee heel verschillende dingen.

Als je ChatGPT vraagt "Schrijf dit in het Nederlands", genereert het Nederlands-taalkundig correct en met Nederlandse AI-signalen. Dit is beter detecteerbaar (vooral door Copyleaks) dan vertaalde tekst. Maar het is nog steeds moeilijker dan Engels.

Als je ChatGPT in het Engels een stuk vraagt, dat zelf vertalat met DeepL, krijg je een heel ander resultaat: meer verhulde AI-signalen, veel minder herkenbaar.

Het gevolg: iemand die bewust AI-gegenereerde tekst wil verhullen, kan al effectief doen door simpelweg "vertaal het naar Nederlands" als extra stap toe te voegen. Dit werkt veel beter dan ervan uit te gaan dat detectie het zal vangen.

Welke detectoren presteren beter op vertaalde AI?

Eerlijk gezegd: geen enkele doen het goed. Maar sommige beter dan anderen.

Copyleaks doet het beter omdat ze explicieter op Nederlandse AI-signalen trainen. Ook werken ze met meer contextuele signalen (zinsstructuur, semantische flow) die beter tegen vertaling bestand zijn. Verwacht echter nog steeds 50-60% nauwkeurigheid op vertaalde AI-tekst.

Winston AI presteert vergelijkbaar met Copyleaks, rond 50-60%.

GPTZero, Originality.ai, Turnitin presteren slechter, meestal rond 40-50%.

Dit zijn allemaal bedroevend laag. Dit is niet detectie — dit is gokken.

Praktische implicatie

Dit heeft grote implicaties:

Voor universiteiten: Studenten die eraan denken AI in te zetten, kunnen dit redelijk makkelijk verhullen met een vertaalstap. Dit maakt AI-detectie als primair controleinstrument twijfelachtig. Beter is: (1) duidelijke richtlijnen geven over AI-gebruik, (2) opdrachten ontwerpen waarbij AI minder nuttig is, (3) gesprekken voeren met studenten, (4) detectie slechts als hulpmiddel gebruiken, niet als bewijs.

Voor individuen: Detectie kan je niet beschermen tegen iemand die bewust wil bedriegen. De technische barrière is laag. Dit maakt juist goed toezicht en vertrouwen-relatie belangrijk.

Voor beleid: Beleidsmakers die op AI-detectie vertrouwen zonder deze beperkingen te kennen, leven in een droomwereld. Detectie is een hulpmiddel, niet een oplossing.

Kun je iets eraan doen?

Als je detecteert: Vertrouw niet op automatische scores als de tekst mogelijk vertaald is. Lees handmatig. Kijk naar stilistische signalen die tegen vertaling bestand zijn (vreemde woordkeuzes, onnatuurlijke formuleringen, zinnen die ingewikkelder zijn dan nodig). Vraag context: waar komt dit vandaan? Hoe past het in het werk van deze persoon?

Als je waarschijnlijkheid van vertaalde AI-inzending wilt minimaliseren: Maak opdrachten die om contextuele, lokale kennis vragen. Vraag om bronnen die in hun moedertaal zijn. Vraag naar je eigen feedback te reageren. Zaken die moeilijker zijn te vertalen dan te scheppen.

Het grote inzicht: vertaling is een effectieve vorm van detectievermijding. Dit betekent dat detectie inherent beperkt blijft. Je kunt er niet op vertrouwen.

Veelgestelde vragen

Hoe snel dalen AI-scores als ik een tekst vertaal?

Drastisch. Van ~75-85% nauwkeurigheid op originele AI-tekst naar ~40-50% op vertaalde AI-tekst. Dit is geen marginaal verschil — dit is essentieel ondetecteerbaar.

Werkt dit voor alle taalcombinaties?

Ja. AI-gegenereerd Engels → Frans, Spaans, Nederlands, Duits — allemaal zakt de detectie hard in. Vertaling verstoort de AI-signalen universeel.

Maakt het uit welke vertaalmachine ik gebruik?

Marginaal. DeepL is beter dan Google Translate, maar beide zetten de nauwkeurigheid naar rond 45-55%. Het verschil is klein vergeleken met het originele verschil.

Kan ik detecteren dat tekst is vertaald?

Soms. Vertaalmachines hebben herkenbare patronen (iets te formeel, bepaalde zinsstructuren). Maar dit is zeer onbetrouwbaar. Beter is handmatig controleren: voelt de tekst onnatuurlijk? Zijn zinnen ingewikkelder dan nodig? Zijn woordkeuzes vreemd?

Lees ook