Hvad denne kontrollør kan - og kan - opdage

Hver plagiatkontrol har blinde pletter. De fleste begrave dem. Denne side er vores, i fuld udstrækning, fordi en rapport, du ikke kan afhøre er en rapport, du ikke kan stole på.

Hvordan motoren fungerer

Kontrollen kører i to faser. Først hentning: vi prøve karakteristiske 8-12 ord sekvenser fra alle regioner af din tekst - foretrækker sjældne ord, som henter langt bedre end almindelige oplukkere - og søge hver på live web som en præcis citeret sætning. Det producerer et sæt af kandidatsider.

For det andet, verifikation: Vi downloader hver kandidatside og tilpasser hver sætning i din tekst til sidens faktiske indhold, lokalt. Overlapning af ord for ord registreres med rullende word-vindue sammenligning; tæt parafrase med token-overlap og rediger-lighed tærskler. En søgemaskine rangering en side bliver aldrig behandlet som bevis af sig selv - kun verificeret tekst sammenligning tæller, og hver kamp bærer en tillidsfigur i rapporten.

Før noget af det, din tekst er normaliseret: Unicode lookalike tegn (et standard trick for narre dam) er kollapset tilbage til deres almindelige ækvivalenter, så byttede Kyrilliske bogstaver ikke skjule kampe.

Når vi vil savne tændstikker (falske negativer)

  • Paywalled og abonnement kilder: akademiske tidsskrifter, nyhedsarkiver bag logins.
  • Private databaser - herunder akademiske indsendelse arkiver som Turnitins. Intet offentligt værktøj kan se dem; enhver gratis checker antyder ellers lyver for dig.
  • Offline kilder: trykte bøger og papirer, der aldrig blev sat på nettet.
  • Meget frisk indhold: sider offentliggjort minutter eller timer siden, at søgemaskinerne ikke har indekseret endnu.
  • Kraftig omskrivning: omskrivning, der ændrer de fleste ord falder under den nærkamp tærskel. Detektering ideer (snarere end formulering) er ud over enhver tekst matcher.

Når vi vil markere uskyldig tekst (falske positive)

  • Korrekt citeret materiale - et citat formodes at matche sin kilde. Tjek citation, ikke højdepunktet.
  • Almindelige sætninger og kedelplade: lagerudtryk, juridiske formler, metodologiske beskrivelser gentaget på tværs af et helt felt.
  • Bibliografier og referencelister, som naturligvis matcher de værker, de citerer.
  • Sammenfaldende formulering i korte, faktuelle sætninger.

Derfor viser rapporten den tilsvarende kildetekst ved siden af din, sætning for sætning, med nøjagtige og nær matches markeret separat: værktøjet finder overlapning; en person dømmer, hvad det betyder.

Hvad pointen betyder

Den matchede procentdel er den andel af dine ord, der sidder i sætninger, der er tilpasset en hentet kilde. Målebåndene - 0-5% ser originale, 6-20% nogle kampe, 21% + signifikant matching - er gennemgå vejledning kalibreret for typisk prosa, ikke beskylde tærskler. En 4% rapport kan stadig indeholde en fuldt kopieret afsnit værd fastsættelse; en 25% rapport af korrekt citeret materiale kan være helt ærligt arbejde.

Vi fortæller også, hvor mange kilder der faktisk blev undersøgt til din kontrol - det reelle tal, der er trykt på rapporten, fordi dækningskrav, du ikke kan verificere, er markedsføring, ikke nøjagtighed.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Ofte stillede spørgsmål

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.