Hva denne sjekkeren kan - og ikke - oppdage

Hver plugiarisme har blinde flekker. De fleste begraver dem. Denne siden er i sin helhet vår, fordi en rapport du ikke kan forhøre er en rapport du ikke kan stole på.

Hvordan motoren virker

Sjekken kjøres i to faser. Først henter vi forskjellige 8- 12 ordsekvenser fra alle områder av teksten – foretrekker sjeldne ord som henter langt bedre enn vanlige åpnere – og søker etter hver på nettet som en nøyaktig sitert frase. Det gir et sett av kandidatsider.

For det andre, verifisering: Vi laster ned hver kandidatside og justerer hver setning i teksten mot selve innholdet på siden, lokalt. Ord for ord overlapper med rullende ordvindu sammenliknelse, lukk parafrase med terskler for symboloverlapping og redigering. En rangering av en side blir aldri behandlet som dokumentasjon av seg selv – bare bekreftet sammenlikning av tekst, og hvert treff har en konfidensverdi i rapporten.

Før noe av det er teksten normalisert: Unicode- lignende tegn (et standard trick for å lure brikker) blir kollapset tilbake til sine enkle ekvivalenter, så byttede kyrilliske bokstaver skjuler ikke treff.

Når vi kommer til å savne treff (falske negative)

  • Betalde kilder og abonnementskilder: akademiske tidsskrifter, nyhetsarkiv bak innlogginger.
  • Private databaser – inkludert akademisk innsendingsarkiver som Turnitin. Ingen offentlige verktøy kan se dem. Ingen gratis sjekker antyder ellers lyver for deg.
  • Frakoblet kilder: bøker og papirer som aldri ble satt på nettet.
  • Svært ferskt innhold: sider publisert for minutter eller timer siden som søkemotorer ikke har indeksert ennå.
  • Tunge parafraser: omskriving som endrer de fleste ord faller under terskelen for nærmeste ord. Det kan ikke finnes ord som passer med teksten.

Når vi flagger uskyldig tekst (falske positive)

  • Korrekt sitert materiale – et sitat skal passe med kilden. Kontroller siteringen, ikke fremhevingen.
  • Felles uttrykk og kjeler: stamuttrykk, juridiske formler, metodebeskrivelser gjentatte ganger på tvers av et helt felt.
  • Bibliografier og referanselister som naturlig samsvarer med de verkene de viser til.
  • Sammenhengende formuleringer i korte, faktiske setninger.

Derfor viser rapporten kildeteksten ved siden av din, setning for setning, med nøyaktig og nære treff merket separat: verktøyet finner overlappende; en person vurderer hva det betyr.

Hva poenget betyr

Prosentdelen av ordene som står i setninger som er innrettet etter en hentet kilde. Profilbåndene – 0-5% ser opprinnelige ut, 6-20% noen samsvarer, 21%+ betydelig samsvar – er veiledningen kalibrert for typiske proser, ikke beskyldningsterskler. En 4% rapport kan fremdeles inneholde en fullstendig kopiert avsnittsverdi som kan fikses. En 25% rapport med riktig sitert materiale kan være helt ærlig.

Vi forteller dere også hvor mange kilder som faktisk ble undersøkt for sjekken - det reelle nummeret, skrevet på rapporten, fordi dekning hevder at du ikke kan verifisere er markedsføring, ikke nøyaktighet.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Ofte stilte spørsmål

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.