Wat deze checker kan - en kan - detecteren

Elke plagiaatscontrole heeft blinde vlekken. De meeste begraven ze. Deze pagina is volledig van ons, omdat een rapport dat je niet kunt ondervragen een rapport is dat je niet kunt vertrouwen.

Hoe werkt de motor?

De controle loopt in twee fasen. Ten eerste, ophalen: we nemen onderscheidende 8-12 woordreeksen uit elke regio van uw tekst - liever zeldzame woorden, die veel beter dan gewone openers ophalen - en zoeken elk op het live web als een exacte geciteerde zin. Dat produceert een set van kandidaat pagina's.

Ten tweede, verificatie: we downloaden elke kandidaat pagina en passen elke zin van uw tekst aan op de werkelijke inhoud van de pagina, lokaal. Woord-voor-woord overlapping wordt gedetecteerd met rollend woord-venster vergelijking; sluit parafrase met token-overlap en bewerken-gelijkwaardigheid drempels. Een zoekmachine rangschikking een pagina wordt nooit behandeld als bewijs door zichzelf - alleen geverifieerde tekstvergelijking telt, en elke match draagt een vertrouwenscijfer in het rapport.

Voordat dat gebeurt, is je tekst genormaliseerd: Unicode lookalike karakters (een standaard truc voor het misleiden van dammen) worden teruggeklapt naar hun gewone equivalenten, dus geruild Cyrillische letters verbergen geen lucifers.

Wanneer missen we lucifers (valse negatieven)

  • Paywalled en abonnement bronnen: academische tijdschriften, nieuwsarchieven achter logins.
  • Privé databases - inclusief academische inzending archieven zoals Turnitin's. Geen openbaar hulpmiddel kan ze zien; elke gratis controleer die anders impliceert is liegen tegen u.
  • Offline bronnen: gedrukte boeken en papieren die nooit op het web zijn gezet.
  • Zeer verse inhoud: pagina's die minuten of uren geleden zijn gepubliceerd en die nog niet zijn geïndexeerd.
  • Zware parafrase: herschrijven dat de meeste woorden verandert valt onder de drempel van de bijna-match. Het detecteren van ideeën (in plaats van formulering) is voorbij elke tekstmatcher.

Wanneer zullen we de vlag onschuldige tekst (valse positieven)

  • Correct geciteerd materiaal - een citaat zou moeten overeenkomen met de bron. Controleer de aanhaling, niet het hoogtepunt.
  • Gemeenschappelijke zinnen en ketelplaat: stamuitdrukkingen, juridische formules, methodologische beschrijvingen herhaald over een hele veld.
  • Bibliografieën en referentielijsten, die natuurlijk overeenkomen met de werken die ze citeren.
  • Toevallige formulering in korte, feitelijke zinnen.

Daarom toont het rapport de corresponderende brontekst naast de jouwe, zin voor zin, met exacte en bijna-matches afzonderlijk gemarkeerd: het gereedschap vindt overlapping; een persoon beoordeelt wat het betekent.

Wat de score betekent

Het overeenkomende percentage is het aandeel van je woorden dat in zinnen zit die zijn uitgelijnd op een opgehaalde bron. De meterbanden - 0,5% ziet er origineel uit, 6-20% sommige wedstrijden, 21%+ significante matching - zijn review guideline gekalibreerd voor typische proza, niet beschuldiging drempels. Een 4% rapport kan nog steeds een volledig gekopieerde paragraaf bevatten die de moeite waard is vast te stellen; een 25% verslag van goed geciteerd materiaal kan perfect eerlijk werk zijn.

We vertellen u ook hoeveel bronnen er daadwerkelijk zijn onderzocht voor uw cheque - het echte nummer, afgedrukt op het rapport, omdat dekking claims die u niet kunt controleren zijn marketing, niet nauwkeurigheid.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Veelgestelde vragen

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.