Šta ovaj kontrolor može - a ne može otkriti

Svaki kontrolor plagijata ima slijepe tačke, većina ih zakopa, ova stranica je naša, u cijelosti, jer izvještaj koji ne možete ispitati je izvještaj kojem ne možete vjerovati.

Kako motor radi

Provjera se odvija u dvije faze. Prva, dohvaćanje: mi uzorkujemo karakteristične 8-12 riječi sekvence iz svakog područja vašeg teksta - preferiramo rijetke riječi, koje se dohvaćaju mnogo bolje od uobičajenih početnih - i pretražujemo svaku od njih na živom webu kao tačno citiranu frazu. To proizvodi skup kandidata stranica.

Drugo, provjera: preuzimame svaku stranicu kandidata i poravnavamo svaku rečenicu vašeg teksta sa stvarnim sadržajem stranice, lokalno. Preklapanje riječ po riječ detektuje se sa pomicanjem riječi-prozora; blizu parafraze sa token-preklapanjem i edit-sličnosti pragovima. Pretraživačka mašina rangiranje stranice se nikada ne tretira kao dokaz sam po sebi - samo provjerena usporedba teksta računa, i svaki podudaranja nosi pouzdanu figuru u izvještaju.

Prije bilo čega od toga, vaš tekst je normaliziran: Unicode znakovi slični (standardni trik za zavaravanje kontrolora) su sažeti natrag na njihove obične ekvivalente, tako da zamijenjena ćirilična slova ne skrivaju podudaranja.

Kad propustimo utakmicu (lažni negativni)

  • Paywalled and subscription sources: academic journals, news archives behind logins.
  • Privatne baze podataka - uključujući akademske arhive kao što je Turnitin. Niti jedan javni alat ih ne može vidjeti; bilo koji slobodni provjerivač koji sugerira drugačije laže vas.
  • Offline izvori: štampane knjige i papiri koji nikad nisu stavljeni na web.
  • Vrlo svježi sadržaj: stranice objavljene prije nekoliko minuta ili sati koje tražilice još nisu indeksirale.
  • Teška parafraza: prepisivanje koje mijenja većinu riječi pada ispod praga blizu podudaranja. Otkrivanje ideja (umjesto riječi) je izvan bilo kojeg teksta koji podudara.

Kada ćemo označiti nevin tekst (lažno pozitivni)

  • Ispravno citirani materijal - citat bi trebao odgovarati izvoru. Provjerite citat, a ne istaknuti dio.
  • Uobičajene fraze i boilerplate: stock izrazi, pravne formule, metodološki opisi ponavljaju se kroz cijelo polje.
  • Bibliografije i reference liste, koje se prirodno poklapaju sa djelima koja citiraju.
  • Slučajni tekst u kratkim, stvarnim rečenicama.

To je razlog zašto izvještaj prikazuje usklađeni izvorni tekst pored vašeg, rečenicu po rečenicu, sa tačnim i bliskim podudaranjima označenim odvojeno: alat pronalazi preklapanje; osoba prosuđuje šta to znači.

Šta znači rezultat?

Postotak podudaranja je udio vaših riječi koje se nalaze u rečenicama poravnatim sa preuzetim izvorom. Pojasi - 0-5% izgleda originalno, 6-20% neke podudarnosti, 21% + značajne podudarnosti - su smjernice za pregled kalibrirane za tipičnu prozu, a ne za pragove optužbe. Izvještaj od 4% još uvijek može sadržavati jedan potpuno kopirani paragraf vrijedan popravljanja; izvještaj od 25% pravilno citiranih materijala može biti savršeno pošten rad.

Također vam kažemo koliko je izvora stvarno ispitano za vašu provjeru - pravi broj, štampan na izvještaju, jer tvrdnje o pokrivenosti koje ne možete provjeriti su marketing, a ne tačnost.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Često postavljana pitanja

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.