Amit ez a dáma képes - és nem - érzékelni

Minden plágiumos checkernek vannak vakfoltjai, a legtöbbjük elássa őket. Ez az oldal a miénk, teljes egészében, mert a jelentés, amit nem lehet kihallgatni, olyan jelentés, amiben nem bízhatsz.

Hogyan működik a motor?

A csekk két szakaszban fut. Először is, visszakeresés: a szöveg minden egyes régiójából vettünk mintát jellegzetes 8-12 szószekvenciákból - a ritka szavak helyett -, amelyek sokkal jobbak, mint a közönséges nyitók -, és mindegyiküket az élő weben egy pontos idézett mondatként keressük. Ez egy sor jelölt oldalt eredményez.

Másodszor, ellenőrzés: letöltjük az egyes jelölt oldalakat és a szöveg minden mondatát a helyi oldal tényleges tartalmához igazítjuk. A word-for-word átfedést a gördülő word-window összehasonlítással érzékeljük; a szöveg-áttéti és szerkesztési hasonlósági küszöbértékeket zárjuk be. Egy oldal rangsorolását önmagában soha nem tekintik bizonyítéknak - csak a hitelesített szöveg-összehasonlítás számít, és minden mérkőzésen van egy-egy bizalmi adat a jelentésben.

Mielőtt bármit, a szöveg normalizálódik: Unicode néz ki, mint karakterek (egy standard trükk a bolond dáma) összeomlott vissza a sima egyenértékű, így cserélt cirill betűk nem rejti el a gyufát.

Mikor fogunk kihagyni egy gyufát (hamis negatívok)

  • Paywalled és előfizetési források: tudományos folyóiratok, hírarchívumok a bejelentkezések mögött.
  • Magánadatbázisok - beleértve a tananyag archívumokat, mint a Turnitin. Nincs nyilvános eszköz nem látja őket; minden ingyenes ellenőrző, amely egyébként hazudik neked.
  • Offline források: nyomtatott könyvek és papírok, amelyek soha nem kerültek fel a webre.
  • Nagyon friss tartalom: olyan percekkel vagy órákkal ezelőtt megjelent oldalak, amelyek még nem indexeltek keresőmotorokat.
  • Nehéz parafrázis: a legtöbb szót megváltoztató átírás a közel meccsküszöb alá esik. Az ötletek (nem csak a szövegszövegek) meghatározása túlmutat minden szövegezőn.

Amikor megjelöljük az ártatlan szöveget (hamis pozitívum)

  • Helyesen idézett anyag - egy idézetnek meg kell egyeznie a forrásával. Ellenőrizze a feliratot, ne a fénypontot.
  • Közös kifejezések és kazánlap: készletkifejezések, jogi képletek, módszertani leírások, amelyek az egész területen ismétlődnek.
  • Bibliográfiák és referencialisták, amelyek természetesen megfelelnek az általuk idézett műveknek.
  • A véletlen kifejezés rövid, tényszerű mondatokban.

Ezért mutatja a jelentés a megfelelő forrásszöveget az Ön mellett, mondatonként, pontos és közel mérkőzések külön jelölve: az eszköz átfedést talál; az ember megítéli, hogy mit jelent.

Mit jelent a pontozás?

A mérkőzések száma megegyezik a szavakban lévő egy letöltött forráshoz igazodó mondatok arányával. A mérősávok - 0-5% eredetinek, 6-20%-os párosnak, 21%-os plusz jelentős egyezésnek - a tipikus prózára kalibrált útmutató, nem pedig vádküszöbre. A 4% -os jelentés még mindig tartalmazhat egy teljesen másolt bekezdést, amit érdemes rögzíteni; a megfelelően idézett anyag 25%-os jelentése tökéletesen őszinte munka lehet.

Azt is elmondjuk, hogy hány forrást vizsgáltak meg az Ön számára - a jelentésre nyomtatott valódi számot, mert a lefedettségi állításokat nem lehet ellenőrizni, az marketing, nem a pontosság.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Gyakran feltett kérdések

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.