Che cosa questo pedinatore può - e non può - rilevare

Ogni pedina del plagio ha punti ciechi, la maggior parte li seppellisce. Questa pagina è nostra, in pieno, perché un rapporto di cui non si può interrogare è un rapporto di cui non si può fidarsi.

Come funziona il motore

Il controllo è eseguito in due fasi. Primo, il recupero: campionamo sequenze di parole distintive 8-12 da ogni regione del testo - preferendo parole rare, che recuperano molto meglio degli apritori comuni - e cerchiamo ognuno sul web live come una frase citata esatta. Questo produce un insieme di pagine candidate.

Secondo, verifica: scarichiamo ogni pagina candidato e allineiamo ogni frase del testo rispetto al contenuto effettivo della pagina, localmente. La sovrapposizione Word-for-word viene rilevata con il confronto word-window rolling; la parafrasi ravvicinata con token-overlap e soglie di modifica-similarità. Un motore di ricerca classifica una pagina non viene mai trattata come prova da sola - conta solo il confronto testi verificato, e ogni partita porta una figura di fiducia nel rapporto.

Prima di tutto, il testo è normalizzato: Unicode caratteri lookalike (un trucco standard per ingannare le pedine) sono crollati indietro ai loro equivalenti semplici, in modo da scambiato lettere cirilliche non nascondono le partite.

Quando mancheremo le partite (falsi negativi)

  • Fonti Paywalled e abbonamenti: riviste accademiche, archivi di notizie dietro login.
  • Database privati - inclusi gli archivi di presentazione accademica come Turnitin. Nessun strumento pubblico può vederli; qualsiasi controllo gratuito che implica altrimenti sta mentendo.
  • Sorgenti non in linea: libri stampati e carte che non sono mai stati messi sul web.
  • Contenuti molto freschi: pagine pubblicate minuti o ore fa che i motori di ricerca non hanno ancora indicizzato.
  • Parafrasi pesante: riscrivere che cambia la maggior parte delle parole cade sotto la soglia quasi-match. Rilevare idee (anziché la formulazione) è al di là di qualsiasi matcher di testo.

Quando batteremo bandiera testo innocente (falsi positivi)

  • Materiale citato correttamente - una citazione dovrebbe corrispondere alla sua fonte. Controllare la citazione, non il punto culminante.
  • Frasi comuni e targa caldaia: espressioni stock, formule giuridiche, descrizioni metodologiche ripetute in un intero campo.
  • Bibliografie e liste di riferimento, che corrispondono naturalmente alle opere che citano.
  • La formulazione coincidente in breve, frasi di fatto.

Per questo motivo il rapporto mostra il testo sorgente accanto al tuo, frase per frase, con corrispondenze esatte e vicine contrassegnate separatamente: lo strumento trova sovrapposizione; una persona giudica ciò che significa.

Cosa significa il punteggio

La percentuale corrispondente è la percentuale delle tue parole che si trovano in frasi allineate a una fonte recuperata. Le bande di misura - 05% sembra originale, 6-20% alcune partite, 21% + corrispondenza significativa - sono recensioni calibrate per la prosa tipica, non soglie di accusa. Un rapporto del 4% può ancora contenere un paragrafo completamente copiato da fissare; un rapporto del 25% di materiale correttamente citato può essere perfettamente onesto.

Vi diciamo anche quante fonti sono state effettivamente esaminate per il vostro controllo - il numero reale, stampato sul rapporto, perché le affermazioni di copertura non è possibile verificare sono di marketing, non precisione.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Domande frequenti

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.