Tekstvergelijking

Advertentie

Plak twee versies van een tekst in de onderstaande vakken om de verschillen ertussen te markeren.

0 tekens | 0 woorden
0 tekens | 0 woorden
0 van 0
Vergelijkingsresultaten verschijnen hier...

Sneltoetsen

Teksten vergelijkenCtrl+Enter
Vorige wijzigingAlt+↑
Volgende wijzigingAlt+↓
Teksten wisselenCtrl+Shift+X
Naast elkaar schakelenCtrl+Shift+S
Bestand openenCtrl+O
Modus wisselenCtrl+1-4
Volledig scherm afsluitenEsc
Toon deze hulp?
Advertentie

Over deze tool

Tekstvergelijking is een van de meest fundamentele bewerkingen in de informatica, essentieel voor versiebeheer, documentrevisie en contentmanagementworkflows wereldwijd. Elke keer dat een ontwikkelaar code commit, een redacteur een manuscript herziet of een jurist een contract wijzigt, werkt een diff-algoritme achter de schermen om precies te identificeren wat er is veranderd. Deze tool brengt diezelfde kracht naar uw browser, zodat u twee teksten direct kunt vergelijken en elke toevoeging, verwijdering en wijziging duidelijk gemarkeerd kunt zien. Het concept van diff ontstond in Unix in 1974, toen Douglas McIlroy bij Bell Labs het eerste diff-hulpprogramma maakte om broncodebestanden te vergelijken. Die innovatie werd de basis van elk versiebeheersysteem dat volgde, van CVS en SVN tot de Git-workflows die vandaag door miljoenen ontwikkelaars worden gebruikt. Onder de motorkap gebruikt deze tool Googles diff-match-patch-bibliotheek, die Eugene Myers' efficiënte verschilalgoritme uit 1986 implementeert, een wiskundig optimale benadering om de kortste reeks bewerkingen tussen twee teksten te vinden. De praktische toepassingen zijn breed: proeflezers gebruiken tekstdiff om te verifiëren dat alleen beoogde correcties in een manuscript zijn aangebracht, juridische teams vergelijken contractversies om ervoor te zorgen dat er geen ongeautoriseerde wijzigingen zijn binnengeslopen, ontwikkelaars beoordelen codewijzigingen voordat ze pull requests samenvoegen, en vertalers controleren de nauwkeurigheid van gelokaliseerde inhoud ten opzichte van het origineel. Docenten vergelijken studenteninzendingen om overeenkomsten te identificeren, en contentmanagers volgen hoe webteksten evolueren gedurende revisiecycli. Omdat alle verwerking volledig in uw browser plaatsvindt, worden uw teksten nooit naar een server verzonden, waardoor deze tool veilig is voor gevoelige of vertrouwelijke inhoud. Of u nu een enkele alinea of een heel document vergelijkt, de teken- en regelmodi laten u de juiste granulariteit kiezen voor uw taak.

De wetenschap van tekstvergelijking

In het hart van elk tekstvergelijkingstool ligt het probleem van de langste gemeenschappelijke deelreeks (LCS): gegeven twee reeksen tekens, vind de langste reeks die in beide voorkomt, in dezelfde volgorde maar niet noodzakelijk aaneengesloten. Alles wat niet in deze gemeenschappelijke deelreeks zit, is ofwel een invoeging of een verwijdering. Het efficiënt oplossen van LCS is wat realtime diff mogelijk maakt. Douglas McIlroy creëerde het eerste diff-hulpprogramma voor Unix in 1974 bij Bell Labs, oorspronkelijk ontworpen om broncodebestanden te vergelijken in de begindagen van collaboratieve softwareontwikkeling. Zijn tool werd een essentieel onderdeel van de Unix-toolchain en zette de standaard voor alle toekomstige vergelijkingshulpmiddelen. In 1986 publiceerde Eugene Myers een baanbrekend artikel over efficiënte tekstvergelijking, dat een algoritme beschreef dat het kortste bewerkingsscript tussen twee reeksen vindt in optimale tijd evenredig met het aantal verschillen. Dit algoritme vormt de basis van de meeste moderne diff-implementaties, inclusief de diff-match-patch-bibliotheek die deze tool gebruikt. Git, gecreëerd door Linus Torvalds in 2005, maakte diff populair als dagelijks werkflowtool voor miljoenen ontwikkelaars. Platformen zoals GitHub verwerken dagelijks miljoenen diffs. Buiten het programmeren vinden diff-algoritmen toepassingen in verrassende gebieden: bio-informatica gebruikt sequentie-alignmentalgoritmen voor DNA- en eiwitvergelijking, plagiaatdetectiesystemen vergelijken studenteninzendingen met databases, juridische teams gebruiken documentvergelijking om contractwijzigingen bij te houden, en spellingcorrectiesuggesties zijn gebaseerd op vergelijkbare bewerkingsafstandberekeningen. Het concept van bewerkingsafstand, geformaliseerd door Vladimir Levenshtein in 1965, meet het minimale aantal bewerkingen van één teken (invoegingen, verwijderingen of vervangingen) dat nodig is om de ene string in de andere om te zetten. Deze Levenshtein-afstand is de wiskundige basis voor fuzzy matching, autocorrectie en zoeksuggestiesystemen die door miljarden mensen dagelijks worden gebruikt.

Hoe te gebruiken

  1. Plak de originele tekst in het linkervak en de gewijzigde versie in het rechtervak. U kunt twee willekeurige tekstversies vergelijken.
  2. Selecteer de vergelijkingsmodus: Teken voor het gedetailleerd opsporen van typefouten, of Regel voor code- en documentreviews. Klik op Vergelijken om te analyseren.
  3. Bekijk de kleurgecodeerde resultaten: groen toont toevoegingen, rood toont verwijderingen. Deel een link met beide teksten erin voor samenwerking.

Methodologie

Deze tool wordt aangedreven door Eugene Myers' verschilalgoritme, gepubliceerd in een baanbrekend artikel uit 1986 over efficiënte tekstvergelijking. Het algoritme vindt het kortste bewerkingsscript—het minimale aantal invoegingen en verwijderingen dat nodig is om de ene tekst in de andere om te zetten. Dit is wiskundig equivalent aan het vinden van de langste gemeenschappelijke deelreeks tussen de twee invoerteksten. In de tekenmodus wordt elk individueel teken als vergelijkingseenheid behandeld, wat het de beste keuze maakt voor het opsporen van typefouten, spellingcorrecties en kleine bewerkingen. In de regelmodus wordt elke regel als atomaire eenheid behandeld, ideaal voor gestructureerde tekst zoals broncode, CSV-bestanden of juridische documenten. Het algoritme draait zeer snel wanneer de teksten vergelijkbaar zijn en schaalt evenredig naarmate de verschillen toenemen. Na het berekenen van de ruwe diff groepeert een semantische opschoonstap gerelateerde wijzigingen voor betere leesbaarheid, zodat een enkele logische wijziging niet wordt opgesplitst in meerdere kleine bewerkingen. De uiteindelijke uitvoer is een reeks van drie bewerkingstypen: gelijk (tekst aanwezig in beide versies), invoegen (tekst toegevoegd) en verwijderen (tekst verwijderd).

Je resultaten begrijpen

De diff-uitvoer gebruikt een eenvoudig kleurcodesysteem: groene markeringen geven toegevoegde tekst aan die alleen in de nieuwe versie aanwezig is, rode markeringen met doorhaling geven verwijderde tekst aan die alleen in het origineel voorkwam, en ongewijzigde tekst wordt in de standaardkleur weergegeven als context. Bij het kiezen tussen modi moet u bedenken wat u zoekt. De tekenmodus is essentieel voor proeflezen omdat het subtiele wijzigingen binnen woorden detecteert—bijvoorbeeld het verschil tussen "hun" en "hen" op letterniveau. De regelmodus is beter geschikt voor het vergelijken van gestructureerde documenten zoals broncode, configuratiebestanden of juridische contracten, waarbij wijzigingen doorgaans hele regels betreffen. Wanneer u een groot blok rode tekst ziet gevolgd door een groot blok groene tekst, duidt dit meestal op een herschreven sectie in plaats van incrementele bewerkingen. Het statistiekoverzicht toont het totale aantal toegevoegde, verwijderde en ongewijzigde tekens, zodat u snel een indruk krijgt van hoe uitgebreid het document is gewijzigd. De diff wordt altijd van links naar rechts berekend, waarbij de linkertekst als origineel en de rechtertekst als gewijzigde versie wordt beschouwd.

Praktische voorbeelden

Proeflezen: plak de originele zin "Het team ontving een prijs voor hun uitsekende werk" en de gecorrigeerde versie "Het team ontving een prijs voor hun uitstekende werk" — de tekendiff markeert direct de spellingcorrecties. Contractrevisie: vergelijk versie 1 en versie 2 van een contract om gewijzigde betalingsvoorwaarden, toegevoegde aansprakelijkheidsclausules of verwijderde voorwaarden te identificeren. Codereview: gebruik de regelmodus om toegevoegde functies, gewijzigde logica en verwijderde dode code te zien tussen twee versies van een bronbestand. Vertaalverificatie: vergelijk de output van machinevertaling met de door mensen bewerkte versie om precies te zien wat de vertaler heeft gewijzigd, gecorrigeerd of herformuleerd voor natuurlijke vloeiendheid.

Tips voor effectieve tekstvergelijking

Gebruik de tekenmodus voor proeflezen en het opsporen van typefouten—het markeert individuele tekenverschillen die de regelmodus mogelijk mist. Gebruik de regelmodus voor het vergelijken van gestructureerde documenten zoals code, CSV-bestanden of juridische contracten waarbij wijzigingen van hele regels betekenisvoller zijn. Normaliseer witruimte voordat u vergelijkt als opmakverschillen niet relevant zijn—extra spaties en tabs kunnen ruis in de diff-uitvoer veroorzaken. Scroll bij lange documenten door de diff op zoek naar gekleurde markeringen—ongewijzigde tekst kan snel worden doorgescand. Bij het vergelijken van code geeft de regelmodus met semantische opschoning het duidelijkste beeld van logische wijzigingen. Als u slechts een specifiek gedeelte hoeft te vergelijken, plak dan alleen dat deel in plaats van het hele document om de overzichtelijkheid te verbeteren. Gebruik de wisselknop om om te keren welke tekst als origineel en welke als gewijzigd wordt behandeld—dit kan de wijzigingen soms vanuit een ander perspectief beter begrijpelijk maken.

Alle berekeningen worden lokaal in je browser uitgevoerd. Er worden geen gegevens naar een server gestuurd.

Hoe te gebruiken

Plak uw originele tekst links en de gewijzigde versie rechts, en klik vervolgens op Vergelijken om de verschillen gemarkeerd te zien.

Vergelijkingsmodi

  • Teken: Toont elke afzonderlijke tekenwijziging, perfect voor het opsporen van typefouten.
  • Woord: Vergelijkt woord voor woord, ideaal voor proza en documentbewerkingen.
  • Zin: Vergelijkt zin voor zin, handig voor het herschrijven van alinea's.
  • Regel: Vergelijkt regel voor regel, beter geschikt voor code of gestructureerde documenten.

Deze tool insluiten

Code ophalen

Was deze tool nuttig?
Wil je ons meer vertellen?
0/500
Wil je dat we contact opnemen?
Bedankt voor je feedback!

Veelgestelde vragen

Wat is het verschil tussen de teken- en regelmodus?
De tekenmodus toont elke afzonderlijke tekenwijziging, ideaal voor het opsporen van typefouten. De regelmodus vergelijkt hele regels, beter geschikt voor code of gestructureerde documenten waar u wilt zien welke regels zijn toegevoegd of verwijderd.
Is er een limiet voor de tekstlengte?
De tool werkt met teksten van elke lengte, hoewel zeer grote teksten (meer dan 100 KB) even kunnen duren om te verwerken. Voor de beste prestaties vergelijkt u teksten van minder dan 50 KB.
Wat betekenen de kleuren?
Groen markeert tekst die is toegevoegd in de gewijzigde versie. Rood met doorhaling toont tekst die uit het origineel is verwijderd. Ongewijzigde tekst verschijnt zonder markering.
Kan ik de vergelijkingsresultaten delen?
Ja! Gebruik de deelknop om een link te kopiëren met beide teksten erin. Teksten worden gecomprimeerd voor efficiënt delen en ondersteunen teksten tot enkele duizenden tekens. U kunt resultaten ook exporteren als HTML- of tekstbestanden.
Welke vergelijkingsmodus moet ik gebruiken?
Gebruik de tekenmodus voor gedetailleerde wijzigingen zoals typefoutcorrecties of kleine bewerkingen. Gebruik de regelmodus voor het vergelijken van code, configuratiebestanden of documenten waarbij wijzigingen doorgaans hele regels betreffen.
Kan ik bestanden direct vergelijken?
Ja! U kunt tekstbestanden direct uploaden door op het uploadpictogram naast elk tekstlabel te klikken, of bestanden naar een van de tekstvelden te slepen. De tool ondersteunt veelgebruikte tekstformaten zoals .txt, .md, .json, .xml, .html, .css, .js, .py, .csv, .log, .yml en meer.
Hoe interpreteer ik de diff-resultaten?
Groene markering toont tekst die is toegevoegd in de tweede versie. Rode markering toont tekst die uit de eerste versie is verwijderd. Niet-gemarkeerde tekst is ongewijzigd in beide versies.
Negeert de vergelijking witruimte?
Standaard detecteert de vergelijking alle witruimtewijzigingen. U kunt echter 'Witruimte negeren' inschakelen om u te richten op inhoudelijke verschillen. Er is ook een optie 'Hoofdletters negeren' voor hoofdletterongevoelige vergelijking.