Hvað þetta skoðunartæki getur - og getur ekki - greint

Öll plagađsskoðunarforrit hafa blinda bletti sem flestir grafa. Ūessi síða er okkar, í heild sinni, ūví skýrsla sem ūú getur ekki spurt um er skýrsla sem ūú getur ekki treyst.

Hvernig vél virkar

Athugunin fer fram í tveimur áföngum. Í fyrsta lagi, leit: við tökum sýni úr 8-12 orða röðum frá öllum svæðum textans - helst sjaldgæfum orðum, sem eru leitað mun betur en algengra opnunarorða - og leitum í hverju orði á vefnum sem nákvæmlega tilvitnuðum setningum.

Í öðru lagi, staðfesting: við sækjum hverja tilnefnda síðu og samræmum hverja setningu textans við raunverulegt efni síðunnar, staðbundið. Orð-fyrir-orð skarast er greind með rúllandi orð-glugga samanburði; loka umsögn með token-skarast og edit-líkindi þröskuld. Leitarvél staða síðu er aldrei tekið sem sönnun í sjálfu sér - aðeins staðfest texta samanburður telst, og hver samsvörun ber traust tölfræði í skýrslunni.

Áður en þetta gerist er textinn þinn staðlaður: Unicode-lík stafir (venjuleg bragð fyrir að blekkja skákara) eru felldir saman aftur í venjuleg samsvarandi stafi, þannig að skipt kyrillísk stafi fela ekki samsvörun.

Þegar við munum missa af samsvörun (falsar neikvæðar)

  • Paywalled og áskriftarheimildir: fræðileg tímarit, fréttasafn á bak við innskráningar.
  • Einka gagnagrunnar - þar á meðal fræðileg innsendingar skjalasafn eins og Turnitin.Engin opinber tól geta séð þá; hver ókeypis skoðun sem gefur til kynna annað er að ljúga að þér.
  • Offline heimildir: prentuð bækur og blaðsíður sem voru aldrei sett á vefnum.
  • Mjög ferskt efni: síður birtar mínútum eða klukkustundum síðan sem leitarvélar hafa ekki enn vísitölu.
  • Þung umskrift: endurskrifun sem breytir flestum orðum fellur undir nánast samsvarandi þröskuld. Að greina hugmyndir (frekar en orðalag) er utan allra texta samsvarandi.

Þegar við munum flagga saklaust texta (falsar jákvæðar)

  • Rétt tilvitnað efni - tilvitnun ætti að passa við uppruna sinn. Athugaðu tilvísunina, ekki hápunktinn.
  • Algengar setningar og boilerplate: hlutabréfa tjáning, lagaleg formúlur, aðferðafræðilegar lýsingar endurteknar yfir allt sviðið.
  • Bókmenntir og tilvísunarlistar, sem náttúrulega passa við verkin sem þeir vitna í.
  • Tilviljun orðalag í stuttum, staðreyndum setningar.

Þess vegna sýnir skýrsla samsvarandi upprunatexta við hliðina á þínum, setning fyrir setningu, með nákvæmum og nálægum samsvörunum merktum sérstaklega: tólið finnur skarast; maður dæmir hvað það merkir.

Hvað skorið merkir

Hlutfall samsvarandi er hlutfall af orðum þínum sem sitja í setningum sem eru í samræmi við upprunalegan texta. Mælikvarðinn - 0-5% lítur út fyrir að vera frumlegt, 6-20% lítur út fyrir að vera samsvarandi, 21% + marktækur samsvarandi - er endurskoðunarleiðbeiningar sem eru stilltar fyrir dæmigerða ritgerð, ekki ásökunarmörk. 4% skýrsla getur samt innihaldið eina málsgrein sem er alveg afrituð og þess virði að laga; 25% skýrsla af rétt vitnað efni getur verið fullkomlega heiðarleg vinna.

Við segjum þér einnig hversu margir heimildir voru í raun skoðuð fyrir athugun þína - raunveruleg tala, prentuð á skýrslunni, vegna þess að umfjöllun kröfur sem þú getur ekki staðfest eru markaðssetning, ekki nákvæmni.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Algengar spurningar

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.