Lo que este verificador puede detectar - y no puede detectar

Cada verificador de plagio tiene puntos ciegos, la mayoría los entierra, esta página es nuestra, en su totalidad, porque un informe que no se puede interrogar es un informe en el que no se puede confiar.

Cómo funciona el motor

La comprobación se ejecuta en dos fases. Primero, recuperación: muestra secuencias de 8-12 palabras distintivas de cada región de su texto - prefiriendo palabras raras, que recuperan mucho mejor que los abreviados comunes - y buscar cada uno en la web en vivo como una frase exacta citada. Eso produce un conjunto de páginas candidatas.

Segundo, verificación: descargamos cada página candidata y alineamos cada frase de su texto con el contenido real de la página, localmente. La superposición de palabras por palabras se detecta con la comparación de palabras en rollo; parafrase cercana con umbrales de superposición de token y similaridad de edición. Un ranking de motores de búsqueda de una página nunca se trata como evidencia por sí mismo - sólo se verifican los recuentos de comparación de texto, y cada partido lleva una cifra de confianza en el informe.

Antes de nada de eso, tu texto está normalizado: Los caracteres parecidos a Unicode (un truco estándar para engañar a las damas) se colapsan hasta sus equivalentes simples, por lo que las letras cirílicos intercambiadas no ocultan coincidencias.

Cuando nos perderemos los partidos (falsos negativos)

  • Fuentes de pago y suscripción: revistas académicas, archivos de noticias detrás de los logins.
  • Bases de datos privadas - incluyendo archivos de sumisión académica como Turnitin. Ninguna herramienta pública puede verlas; cualquier chequero gratuito implicando lo contrario está mintiendo a usted.
  • Fuentes fuera de línea: libros impresos y papeles que nunca se pusieron en la web.
  • Contenido muy fresco: páginas publicadas hace minutos o horas que los motores de búsqueda no han indexado todavía.
  • Paráfrasis pesada: reescribir que cambia la mayoría de las palabras cae por debajo del umbral de casi coincidencia. Detectar ideas (en lugar de redacción) está más allá de cualquier coincidencia de texto.

Cuando vamos a marcar el texto inocente (falsos positivos)

  • Material correctamente citado - una cita se supone que coincida con su fuente. Compruebe la cita, no el punto culminante.
  • Frases comunes y placa de caldera: expresiones de stock, fórmulas legales, descripciones metodológicas repetidas en todo un campo.
  • Bibliografías y listas de referencias, que naturalmente coinciden con las obras que citan.
  • Texto coincidente en pocas frases, fácticas.

Por eso el informe muestra el texto fuente junto al tuyo, frase por oración, con coincidencias exactas y cercanas marcadas por separado: la herramienta encuentra superposición; una persona juzga lo que significa.

¿Qué significa la puntuación?

El porcentaje correspondiente es la parte de tus palabras que se sientan en frases alineadas con una fuente recuperada. Las bandas de medición - 0-5% parece original, 6-20% algunas coincidencias, 21%+ coincidencia significativa - son orientaciones de revisión calibradas para prosa típica, no umbrales de acusación. Un informe del 4% todavía puede contener un párrafo completamente copiado que vale la pena arreglar; un informe del 25% de material correctamente citado puede ser trabajo perfectamente honesto.

También le decimos cuántas fuentes fueron examinadas para su cheque - el número real, impreso en el informe, porque las afirmaciones de cobertura que no se puede verificar son marketing, no precisión.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Preguntas frecuentes

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.