Vad denna kontroll kan - och inte - upptäcka

Varje plagiatkontroll har blinda fläckar, de flesta begraver dem. Den här sidan är vår, helt och hållet, eftersom en rapport som du inte kan förhöra är en rapport du inte kan lita på.

Hur motorn fungerar

Checken går i två faser. Först, hämtning: vi provskiljer distinkta 8-12 ord sekvenser från varje region i din text - föredrar sällsynta ord, som hämtar mycket bättre än vanliga öppnare - och söka var och en på live webben som en exakt citerad fras. Det ger en uppsättning kandidatsidor.

För det andra, verifiering: vi hämtar varje kandidatsida och justerar varje mening i din text mot sidans faktiska innehåll, lokalt. Ord för ord överlappar upptäcks med rullande ord-fönster jämförelse, slut parafras med token-overlap och redigera-similarity trösklar. En sökmotor ranking en sida aldrig behandlas som bevis av sig själv - endast verifierad text jämförelse räknas, och varje match bär en förtroende siffra i rapporten.

Innan något av det, din text är normaliserad: Unicode lookaliknande tecken (ett vanligt trick för lura pjäser) kollapsas tillbaka till sina vanliga motsvarigheter, så bytte kyrilliska bokstäver inte dölja matcher.

När vi missar matcher (falska negativa)

  • Paywalled och prenumerationskällor: akademiska tidskrifter, nyhetsarkiv bakom inloggningar.
  • Privata databaser - inklusive akademiska arkiv som Turnitins. Inget offentligt verktyg kan se dem; alla fria kontroller antyder annat ljuger för dig.
  • Offlinekällor: tryckta böcker och papper som aldrig lades ut på nätet.
  • Mycket färskt innehåll: sidor publicerade för några minuter eller timmar sedan som sökmotorer inte har indexerat ännu.
  • Tung parafras: skriva om att ändra de flesta ord faller under tröskeln för närmatch. Att upptäcka idéer (snarare än ord) är bortom alla textmatchare.

När vi kommer att flagga oskyldig text (falska positiva)

  • Korrekt citerat material - ett citat ska matcha källan. Kontrollera citatet, inte höjdpunkten.
  • Vanliga fraser och pannplattor: lageruttryck, juridiska formler, metodbeskrivningar som upprepas över ett helt fält.
  • Bibliografier och referenslistor, som naturligtvis motsvarar de verk de citerar.
  • En tillfällighet i korthet, med faktiska meningar.

Det är därför rapporten visar den matchade källtexten bredvid din, mening för mening, med exakta och nära matchningar markerade separat: verktyget finner överlappning; en person bedömer vad det betyder.

Vad poängen betyder

Den matchade procentandelen är den andel av dina ord som sitter i meningar som är anpassade till en hämtad källa. Mätbanden - 0-5% ser original, 6-20% vissa matcher, 21% + betydande matchning - är granskningsvägledning kalibrerad för typiska prosa, inte anklagelser tröskelvärden. En 4% rapport kan fortfarande innehålla en helt kopierad punkt värt att fixa; en 25% rapport av korrekt citerade material kan vara helt ärligt arbete.

Vi berättar också hur många källor som faktiskt undersöktes för din kontroll - det verkliga numret, tryckt på rapporten, eftersom täckning hävdar att du inte kan verifiera är marknadsföring, inte noggrannhet.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Vanliga frågor

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.