Çfarë mund të zbulojë ky kontrollues dhe çfarë nuk mund të zbulojë

Çdo kontrollues plagjiati ka pika të verbër, shumica i varrosin ato, kjo faqe është e jona, e plotë, sepse një raport që nuk mund ta pyesësh është një raport që nuk mund t'i besosh.

Si funksionon motori

Kontrolli kryhet në dy faza. Së pari, marrja: ne marrim 8-12 fjalë të veçanta nga çdo rajon i tekstit tënd - duke preferuar fjalët e rralla, të cilat marrin shumë më mirë se hapësit e zakonshëm - dhe kërkojmë secilën nga to në web si një frazë të cituar. Kjo prodhon një grup faqesh kandidate.

Së dyti, verifikimi: ne shkarkojmë çdo faqe kandidate dhe drejtojmë çdo fjali të tekstit tuaj kundër përmbajtjes aktuale të faqes, lokalisht. Mbivendosja fjalë për fjalë zbulohet me krahasimin e fjalës-dritares; parafrazimi i ngushtë me mbivendosjen e token dhe pragun e ngjashmërisë së editimit. Një motor kërkimi rendit një faqe kurrë nuk trajtohet si provë në vetvete - vetëm krahasimi i verifikuar i tekstit llogaritet, dhe çdo përputhje mban një figurë besimi në raport.

Para se të ndodhë kjo, teksti juaj normalizohet: karakteret e ngjashme me Unicode (një trik standard për të mashtruar kontrolluesit) zhyten në ekuivalentet e tyre të thjeshta, kështu që shkronjat cirilike të shkëmbyera nuk fshehin përputhje.

Kur do të humbim ndeshjet (negative të rreme)

  • Burime të pagesës dhe abonimi: revista akademike, arkiva të lajmeve pas logins.
  • Baza të dhënash private - duke përfshirë arkivat e dorëzimeve akademike si Turnitin's. Asnjë mjet publik nuk mund t'i shohë ato; çdo kontrollues i lirë që sugjeron ndryshe është gënjeshtër.
  • Burime jashtë linjës: libra të shtypur dhe artikuj që nuk janë vënë kurrë në web.
  • Përmbajtja shumë e freskët: faqe të publikuara minuta apo orë më parë që motorët e kërkimit nuk i kanë indeksuar ende.
  • Parafrazimi i rëndë: rishkrimi që ndryshon shumicën e fjalëve bie nën pragun e përafërt të përputhjes. Zbulimideve (në vend të fjalimit) është përtej çdo përputhjeje teksti.

Kur do të flamurizojmë tekstin e pafajshëm (pozitivë të rremë)

  • Materiali i cituar korrektisht - një citim duhet të përputhej me burimin e tij. Kontrollo citimin, jo theksimin.
  • Fjalët e zakonshme dhe boilplate: shprehje të stokut, formulat ligjore, përshkrimet metodologike të përsëritura në të gjithë fushën.
  • Bibliografitë dhe listat e referencave, të cilat natyrisht përputhen me veprat që citojnë.
  • Fjalë të përshtatshme në fjali të shkurtra, fakte.

Kjo është arsyeja pse raporti tregon tekstin e përshtatshëm burimor pranë tekstit tuaj, fjali për fjali, me përputhje të saktë dhe të afërta të shënuara më vete: instrumenti gjen mbivendosje; një person gjykon se çfarë do të thotë.

Çfarë do të thotë rezultati?

Përqindja e përputhjes është pjesa e fjalëve tuaja që janë në fjali të lidhura me një burim të marrë. Bandat e matjes - 0-5% duket origjinale, 6-20% disa përputhje, 21% + përputhje e rëndësishme - janë udhëzime për shqyrtim të kalibruara për prozën tipik, jo pragun e akuzës. Një raport 4% mund të përmbajë ende një paragraf të kopjuar plotësisht që vlenë të rregullohet; një raport 25% i materialit të cituar siç duhet mund të jetë punë krejtësisht e ndershme.

Ne gjithashtu të themi sa burime janë shqyrtuar aktualisht për kontrollin tënd - numri i vërtetë, i shtypur në raport, sepse pretendimet e mbulimit që nuk mund t'i verifikosh janë marketing, jo saktësi.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Pyetja e shpeshtë

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.