Statistisch watermerk in AI-tekst
Een statistisch watermerk is geen enkel teken. Het is een patroon in de woorden die een model heeft gekozen tijdens het schrijven – onzichtbaar op de pagina en per definitie onmogelijk te verwijderen door de tekst te bewerken zonder deze woord voor woord opnieuw te schrijven. Dit is iets heel anders dan "onzichtbare tekens", die de onderstaande tool met één klik verwijdert. Het door elkaar halen van deze twee concepten leidt ertoe dat een tekstopschoningsprogramma iets belooft wat het niet kan waarmaken. Hieronder leest u wat een statistisch watermerk precies is, welke van de belangrijkste AI-aanbieders er vandaag de dag een gebruiken en sinds wanneer, hoe goed het bestand is tegen bewerking volgens onafhankelijk onderzoek, en precies waar de tool op deze pagina stopt.
De schoner loopt in uw browser — niets wat je plakt wordt geüpload, en er is geen account of dagelijkse limiet. Herschrijven is de enige uitzondering: het stuurt uw tekst naar onze server om de formulering te wijzigen, die in de onderstaande paragraaf volledig wordt toegelicht.
Hoe de cleaner werkt
- Plak de tekst in het vakje hierboven. Niets uploadt — de scan draait op het moment Je stopt met typen, helemaal op je eigen machine.
- Bekijk precies wat erin zit. Een draaiend totaal en een tabel naam elke onzichtbaar of typografische karakter gevonden, en het voorbeeld toont elk op zijn plaats als zijn codepunt zodat je kunt zien waar het zit.
- Maak het schoon en kopieer het resultaat. Druk op Schone tekst en de doos wordt vervangen door een versie die opnieuw gecontroleerd wordt op zijn eigen uitvoer, niet één keer geteld op de invoer — Die tweede pas is wat "geverifieerd schoon" hier eigenlijk betekent.
Wat "statistisch watermerk" eigenlijk betekent
Mensen gebruiken de term "AI-watermerk" voor twee heel verschillende doeleinden, en bijna elke uitleg van de term vermengt deze. Het eerste is een bijproduct: een model dat is getraind op professioneel opgemaakte tekst, neemt tekens over die een persoon zelden met de hand typt, zoals een lange streep, een krulcitaatteken of af en toe een spatie die niet automatisch wordt afgebroken. Dit is een schrijfstijl, geen watermerk, en dat is precies wat onzichtbare tekens cleaner van deze site verwijdert Kom vandaan. Het tweede is een echt statistisch watermerk: een patroon in welke woorden een model selecteert, niet welke tekens het gebruikt; dit is onzichtbaar voor de lezer, maar kan worden achterhaald door degene die de detectiesleutel heeft.
Tijdens het genereren van de tekst wordt een statistisch watermerk toegevoegd, niet achteraf. Het model beoordeelt verschillende mogelijke volgende woorden met een functie die alleen de eigenaar van het watermerk kent, en kiest consequent voor één van deze woorden boven andere, even vloeiende opties. Wanneer dit herhaaldelijk wordt toegepast in een hele tekst, ontstaat er een meetbaar statistisch signaal. Omdat geen enkel woord, geen enkele zin of geen enkel teken dit signaal op zichzelf draagt, blijft het watermerk behouden, zelfs als de tekst wordt opgemaakt, gekopieerd en geplakt, of zelfs tot op zekere hoogte wordt vertaald.
Wie heeft er eigenlijk een aangezet, en sinds wanneer
Van de drie grootste tekstleveranciers heeft er slechts één gepubliceerd hoe zijn watermerk werkt.
| Aanbieder | Tekst watermerk | Leven sinds | Mechanisme publiek? |
|---|---|---|---|
| Google (Gemini) | SynthID-tekst | mei 2024 | Ja. Natuurpapier, open source sinds oktober 2024 |
| Antropisch (Claude) | Niet benoemd, vereist volgens de EU-AI-wet | 2 augustus 2026 | Nee — bestaat, niet openbaar gemaakt |
| OpenAI (ChatGPT/API) | Geen voor tekst | — | NB — gecontroleerd 10 sept. 2026 |
SynthID-tekst van Google is degene met een technisch document erachter: kandidaat tokens worden gescoord in rondes de onderzoekers noemen "toernooi bemonstering," en de winnende token wordt uitgezonden zonder extra karakter. Het heeft live uitgevoerd in de Gemini app en op het web sinds mei 2024, werd beschreven in een Natuur papier, en de referentieuitvoering is open source onder Apache 2.0 sinds 2024 oktober — zie ook Google's eigen SynthID-documentatie.
Antropisch heeft de uitvoer van Claude op dezelfde manier gemarkeerd — statistisch, niet met zichtbare tekens — sinds 2 augustus 2026, over de Claude app, de API, Claude Code en de andere oppervlakken, om te voldoen aan de gedragscode van de EU-AI-wet inzake transparantie. Antropic's eigen uitleg bevestigt het teken bestaat en waarschuwt dat detectie kan mislukken op tekst die zwaar is bewerkt, vertaald of gemengd met andere teksten — Maar het mechanisme zelf wordt niet gepubliceerd. Dat betekent dat het niet eerlijk kan worden omschreven als "hetzelfde als SynthID," alleen als het aanpakken van dezelfde wettelijke verplichting; alleen Antropic weet of de onderliggende methode overeenkomt.
OpenAI van toepassing op tekst. Direct gecontroleerd op OpenAI's eigen content-provenance blz. Vanaf 10 september 2026 wordt de volgende technologie gebruikt om de herkomst van content te verifiëren: SynthID en C2PA voor afbeeldingen (vanaf 19 mei 2026) en voor audio (vanaf 31 juli 2026). Tekst wordt hier niet genoemd. Er wordt gemeld dat OpenAI jaren geleden al een functionerend cryptografisch watermerk voor tekst heeft ontwikkeld, maar dit nooit heeft geactiveerd. De reden hiervoor zou zijn dat het merkbaar de kwaliteit van andere talen aantastte en schrijvers die de taal niet als moedertaal hebben, benadeelde.interview, ex-OpenAI veiligheidsteam).
Hoe goed het overleeft wordt bewerkt — onafhankelijk gemeten
De robuustheid nummers de moeite waard vertrouwen zijn degenen die niemand de verkoop van het watermerk geproduceerd. Onafhankelijke onderzoekers die SynthID Text testten vonden dat een enkele parafrase pass — de watermerk tekst terug via een ander model om het te herwinnen — liet de echte positieve detectie vallen tarief van 0,998 op schone, niet-uitgegeven tekst tot 0,498 op de geparafraseerde versie (ArXiv:2508.20228). Laten we dat duidelijk zeggen: door een tekst anders te formuleren, wordt de kans dat een detectiesysteem de tekst correct als zodanig herkent, ruwweg gehalveerd, maar de kans wordt niet volledig uitgeschakeld. Dit is een daadwerkelijke vermindering, geen volledige verwijdering, en dit gebeurt alleen omdat het anders formuleren de daadwerkelijke woorden verandert – en dat is precies wat een tekstopruimingsprogramma, inclusief het onze, nooit doet.
Waarom "strip het watermerk" stil verandert zijn onderwerp
Bijna alle tools voor het opschonen van tekst hebben een vergelijkbaar kenmerk: ze beloven de "statistische watermerk" te verwijderen, wat in één korte zin wordt uitgelegd naast een lijst met tekens die ze ook verwijderen. Als je goed leest, blijkt dat dit kenmerk in feite Unicode-tekens scant en verwijdert – precies de onzichtbare en typografische tekens die deze pagina's eigen tool detecteert. Een statistische watermerk is echter geen van die tekens. Dat kan het ook niet zijn, gezien de manier waarop het is opgebouwd: het is verspreid over de woordkeuzes van een model op het moment van generatie, en het verwijderen van een spatie van nul breedte of het corrigeren van een krulquote heeft geen invloed op de woordkeuze. Een tool die "statistische watermerken verwijdert" als een van de functies vermeldt, naast een telling van tekens, beschrijft dus wat het met tekens doet, terwijl de gebruiker denkt dat het iets anders aanpakt – namelijk de woordkeuze waarop een detector daadwerkelijk let.
Dit is geen klein technisch detail. Het is het hele verschil tussen de twee soorten ‘AI-watermerken’ die hierboven worden beschreven: de ene is een teken, dat door elke competente gebruiker kan worden verwijderd; de andere is een statistische waarde over een hele tekst, die alleen kan worden verwijderd door voldoende woorden te wijzigen, waardoor de statistische waarde zelf geen betekenis meer heeft – wat neerkomt op herschrijven, een andere en veel grotere handeling dan het opschonen van de tekst. Niemand heeft een truc op tekenniveau gepubliceerd die het tweede type watermerk kan omzeilen, omdat zoiets niet bestaat.
Wat dit betekent voor een hulpmiddel als de onze
De beschrijving van deze pagina is bewust summier gehouden. De tool hierboven zoekt en verwijdert het verwijdert onzichtbare en typografische tekens – het soort ‘AI-watermerk’ dat achterblijft na het kopiëren en plakken – en controleert vervolgens zijn eigen uitvoer om te bewijzen dat er geen van deze tekens meer aanwezig zijn, in plaats van alleen een telling te geven van de tekens vóór de bewerking. Het verandert geen enkel woord. De afzonderlijke Herschrijven knop verandert uw formulering, met behulp van een taalmodel op onze server, en onafhankelijk onderzoek hierboven toont dat het herschrijven is het enige dat verzwakt meetbaar een statistisch watermerk — van 0,998 tot 0,498, niet tot nul, en alleen omdat het woorden verandert, wat de schoonmaker bewust nooit op zichzelf doet.
Vragen
Wat is een statistisch watermerk in AI-tekst?
Het is een patroon in de woordkeuze van een model tijdens het genereren van tekst, en geen extra letter of iets dat de betekenis van de zin verandert. Mogelijke woorden worden tijdens het genereren beoordeeld aan de hand van een verborgen criterium, waarbij één woord consequent de voorkeur krijgt boven andere, even goede opties. Daarom is het patroon alleen statistisch zichtbaar, over een groot aantal woorden tegelijk. Een lezer kan het niet zien en geen enkel woord bewijst dat het er is.
Wat is SynthID-tekst?
SynthID Text is een statistisch watermerk van Google DeepMind voor tekst, dat sinds mei 2024 live is in de Gemini-app en op het web. Het beoordeelt potentiële tekstfragmenten in rondes, die we ‘toernooimonstering’ noemen, en kiest de beste uit. Dit laat een statistisch spoor achter zonder zichtbare tekens. Het is gepubliceerd in Nature en in oktober 2024 als open source beschikbaar gesteld onder de Apache 2.0-licentie – als enige van de drie grote aanbieders die we hebben onderzocht, is het mechanisme daadwerkelijk openbaar.
Is er een AI tekst watermerk in ChatGPT?
Nee. Vanaf 10 september 2026 vermeldt de officiële documentatie van OpenAI over de herkomst van content een watermerk voor afbeeldingen (SynthID en C2PA, sinds 19 mei 2026) en voor audio (sinds 31 juli 2026), maar niet voor tekst die is gegenereerd door ChatGPT of de API. Er wordt gemeld dat OpenAI intern een cryptografisch tekstwatermerk heeft ontwikkeld, maar dit nooit heeft geactiveerd, vermoedelijk vanwege kwaliteitsverlies voor andere talen en een negatieve invloed op niet-native schrijvers.
Bevat de tekst die door Claude is gegenereerd een watermerk?
Ja. Anthropic heeft vanaf 2 augustus 2026 een markering aangebracht op de output van Claude, in de Claude-app, de API, Claude Code en andere toepassingen, om te voldoen aan de EU-AI-wet. De eigen documentatie van Anthropic bevestigt dat de markering bestaat en dat detectie mogelijk niet werkt bij sterk bewerkte, vertaalde of omgeschreven teksten, maar het bedrijf maakt niet bekend hoe het mechanisme precies werkt. Daarom kan niet worden aangenomen dat het overeenkomt met het ontwerp van SynthID, ook al richt het zich op hetzelfde probleem.
Kan het verwijderen van onzichtbare tekens een statistisch watermerk verwijderen?
Nee. Een statistische watermerktechniek zoals SynthID is gebaseerd op de keuze van woorden, niet op individuele Unicode-tekens, dus er is geen specifiek teken dat een gebruiker kan vinden en verwijderen. Een tool die is ontworpen om tekens te scannen en te verwijderen, inclusief dit teken, kan slechts oppervlakkige opmaak aanpassen, maar nooit het patroon dat in de woorden zelf is verwerkt.
Verwijdert parafrasering een statistisch watermerk?
Het verzwakt de tekst, wat anders is dan het volledig verwijderen ervan. Onafhankelijk onderzoek heeft aangetoond dat een enkele bewerking waarbij de tekst wordt herschreven, de detectiekans van SynthID van 0,998 naar 0,498 verlaagt – een aanzienlijke, maar niet totale, vermindering – en dat dit resultaat is verkregen door elk woord opnieuw te formuleren, niet door tekens te verwijderen. Daarom houdt deze website de tool voor het herschrijven van tekst gescheiden van de tool voor het verwijderen van tekens: het herschrijven is een expliciete bewerking van uw tekst, en geen verborgen bijwerking van het opschonen ervan.
Gerelateerde tools
Achter elke pagina op deze website zit dezelfde tool – dezelfde genaamd karakters, dezelfde knop. Deze verklaart alleen het soort watermerk dat ze niet aanraken.
- Tekst schoonmaken De belangrijkste tool, met de volledige lijst van alles wat het verwijdert.
- Onzichtbare tekens, uitgelegd Het karakter soort "AI watermerk," genoemd en geteld.
- AI watermerkcontrole — bekijk wat er verborgen zit in een tekst voordat je besluit deze op te schonen.
- ChatGPT watermerk remover voor gekopieerde tekst van ChatGPT.
- Claude watermerk remover voor tekst die is gekopieerd uit Claude.
- Gemini watermerk remover voor tekst die is gekopieerd uit Gemini.
- Prijzen Wat blijft gratis en wat een pass voegt, en die dit bouwt.
Wat deze tool niet kan verwijderen
Er zijn twee verschillende dingen die mensen een "AI watermerk" noemen.
- Onzichtbare en typografische karakters. Deze tool verwijdert benoemde tekens die helemaal geen zichtbare glyph bevatten, zoals gedefinieerd door de Unicode standaard — Geen nummer dat we verzonnen hebben. Het draait ook verschillende ruimtevarianten, waaronder de smalle no-break ruimte, in een gewone ruimte. Curly citaten en streepjes gaan door een aparte, optionele stap typografische vervangingen zijn standaard ingeschakeld; schakel deze optie uit om de tekst ongewijzigd te laten. De tool verwijdert ook de drie Unicode-bereiken voor privégebruik, inclusief het bereik U+E0000–U+E007F, dat wordt gebruikt om gegevens in platte tekst te verbergen. Deze bereiken bevatten geen standaardtekens, dus we beschrijven ze in plaats van ze als een tekentelling weer te geven.
- Een statistisch watermerk in de woordkeuze zelf. Google's SynthID-Text, dat sinds mei 2024 in Gemini is geïmplementeerd, verandert volgens de documentatie geen enkel teken, dus geen enkele tekengewijziging, ook niet die van onze tool, is nodig. Anthropic heeft de output van Claude op dezelfde manier gemarkeerd sinds 2 augustus 2026, om te voldoen aan de EU-AI-wet, maar hun eigen uitleg issupport.claude.com) bevestigt alleen dat het watermerk bestaat, niet hoe het werkt – dus we kunnen niet garanderen dat het op dezelfde manier is opgebouwd als SynthID. Wat we wel kunnen zeggen: een tekengereinigingstool zoals deze, raakt alleen Unicode-tekens aan, en elk watermerk dat daarop zou vertrouwen, zou niet overleven bij een normale kopieer- en plakactie, dus er is hier niets dat het zou kunnen verwijderen. Vanaf 10 september 2026 zal OpenAI's eigen content-provenance blz. biedt geen tekstwatermerk voor ChatGPT of de bijbehorende API.
Als een tool belooft het “AI-watermerk” te verwijderen zonder dit onderscheid te maken, dan beschrijft het in feite het eerste, terwijl het je laat geloven dat het het tweede doet.