Čo táto kontrola dokáže - a nedokáže - zistiť

Každý plagiátorský kontrolór má svoje slepé miesta, ktoré väčšina z nich zakopáva. Táto stránka je naša, v plnom rozsahu, pretože správa, ktorú nemôžete preskúmať, je správa, ktorej nemôžete veriť.

Ako funguje motor

Kontrola prebieha v dvoch fázach. Prvá fáza je vyhľadávanie: z každej oblasti vášho textu vyberieme 8-12 slovných sekvencií - uprednostňujeme zriedkavé slová, ktoré sa vyhľadávajú oveľa lepšie ako bežné otváracie slová - a prehľadáme ich na webe ako presné citované frázy.

Po druhé, overenie: stiahneme si každú kandidátsku stránku a zarovname každú vetu vášho textu s aktuálnym obsahom stránky, lokálne. Prekrývanie slov sa zisťuje pomocou porovnania s pohyblivým slovom; blízka parafráza s prekrývaním tokenov a prahovými hodnotami podobnosti úprav. Hodnotenie stránky vyhľadávačom sa nikdy nepovažuje za dôkaz samo osebe - počíta sa len overené porovnanie textu a každá zhoda nesie v správe číslo spoľahlivosti.

Predtým, ako sa to stane, je váš text normalizovaný: Unicode znaky podobné znakom (štandardný trik pre zmätených kontrolórov) sú zbalené späť na ich obyčajné ekvivalenty, takže zameniteľné cyriliky neskrývajú zhody.

Keď nám chýbajú zápasy (falošné negatívy)

  • Paywalled a predplatené zdroje: akademické časopisy, spravodajské archívy za loginmi.
  • Súkromné databázy - vrátane archívov akademických príspevkov ako Turnitin. Žiadny verejný nástroj ich nemôže vidieť. Každý bezplatný kontrolór, ktorý naznačuje inak, vám klame.
  • Offline zdroje: tlačené knihy a články, ktoré neboli nikdy umiestnené na webe.
  • Veľmi čerstvý obsah: stránky zverejnené pred niekoľkými minútami alebo hodinami, ktoré vyhľadávacie nástroje ešte neindexovali.
  • Ťažká parafráza: prepis, ktorý mení väčšinu slov, patrí pod hranicu takmer zhody, pretože detekcia myšlienok (skôr ako formulácií) je mimo dosahu akéhokoľvek textového párovača.

Kedy označíme nevinný text (falošné pozitívne výsledky)

  • Správne citovaný materiál - citácia by mala zodpovedať zdroju, skontrolujte citáciu, nie zvýraznenie.
  • Bežné frázy a boilerplate: zásobné výrazy, právne vzorce, metodické opisy sa opakujú v celom odbore.
  • Bibliografie a zoznamy referencií, ktoré prirodzene zodpovedajú dielam, ktoré citujú.
  • Náhodné znenie v krátkych, faktických vetách.

Preto správa zobrazuje zodpovedajúci zdrojový text vedľa vášho textu, vetu po vete, s presnými a blízkymi zhodami označenými samostatne: nástroj nájde prekrytie, človek posúdi, čo to znamená.

Čo znamená skóre

Percento zhody je podiel vašich slov, ktoré sa nachádzajú vo vetách zarovnaných s získaným zdrojom. Rozsahy - 0-5% vyzerá originálne, 6-20% niektoré zhody, 21% + významné zhody - sú usmernenia pre recenziu kalibrované pre typickú prózu, nie hranice obvinenia. 4% správa môže stále obsahovať jeden úplne skopírovaný odsek, ktorý stojí za opravu; 25% správa správne citovaného materiálu môže byť úplne čestná práca.

Taktiež vám povieme, koľko zdrojov bolo skutočne preskúmaných pre vašu kontrolu - skutočné číslo, vytlačené na správe, pretože tvrdenia o pokrytí, ktoré nemôžete overiť, sú marketingové, nie presné.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Často kladené otázky

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.