O que este verificador pode - e não pode - detectar

Cada verificador de plágio tem pontos cegos, a maioria os enterra. Esta página é nossa, na íntegra, porque um relatório que você não pode interrogar é um relatório que você não pode confiar.

Como funciona o motor

O cheque corre em duas fases. Primeiro, a recuperação: mostramos as sequências de palavras distintivas de 8-12 de cada região do seu texto - preferindo palavras raras, que recuperam muito melhor do que os abreneiros comuns - e buscamos cada uma na web ao vivo como uma frase citada exata. Isso produz um conjunto de páginas candidatas.

Segundo, verificação: download de cada página candidata e alinhamos cada frase do seu texto com o conteúdo real da página, localmente. A sobreposição de palavra-para-palavra é detectada com a comparação de janelas de palavras rolantes; fechar a parafrase com limiares de sobreposição de token e de simulação de edição. Um motor de busca nunca é tratado como evidência por si mesmo - apenas conta de comparação de texto verificada, e cada correspondência carrega uma figura de confiança no relatório.

Antes de qualquer um disso, o seu texto é normalizado: caracteres tipo Unicode (um truque padrão para enganar damas) são colapsos de volta para seus equivalentes simples, então as letras cirílicas trocadas não escondem os jogos.

Quando perdermos jogos (falsos negativos)

  • Paywall e fontes de assinatura: periódicos acadêmicos, arquivos de notícias por trás dos logins.
  • Bases de dados privadas - incluindo arquivos de submissão acadêmica como Turnitin's. Nenhuma ferramenta pública pode vê-los; qualquer marcador livre que sugerisse que seja outra coisa está mentindo para você.
  • Fontes offline: livros impressos e artigos que nunca foram colocados na web.
  • Conteúdo muito fresco: páginas publicadas há minutos ou horas que os motores de busca ainda não foram indexados.
  • Parafrase pesada: reescrita que altera a maioria das palavras cai abaixo do limiar de quase par. Detecção de ideias (mais do que de formulação) está além de qualquer combinador de texto.

Quando vamos bandeirar texto inocente (falsos positivos)

  • Material corretamente citado - uma citação é suposto para corresponder à sua fonte. Verifique a citação, não o realce.
  • Frases comuns e caldeira: expressões de estoque, fórmulas legais, descrições metodológicas repetidas em todo o campo.
  • Bibliografias e listas de referência, que naturalmente correspondem às obras que citam.
  • Regra co-decidente em sentenças curtas e factuais.

É por isso que o relatório mostra o texto de origem correspondente ao seu lado, frase por frase, com jogos exatos e próximos marcados separadamente: a ferramenta encontra sobreposição; uma pessoa julga o que significa.

O que significa a pontuação

A porcentagem correspondente é a parte de suas palavras que se sentem em frases alinhadas a uma fonte recuperada. As bandas de calibração - 0-5% parece original, 6-20% alguns jogos, 21%+ correspondência significativa - são guia de revisão calibrada para prosa típica, não limiares de acusação. Um relatório de 4% ainda pode conter um parágrafo totalmente copiado que vale a pena fixar; um relatório de 25% de material corretamente citado pode ser perfeitamente honesto trabalho.

Também lhe dizemos quantas fontes foram realmente examinadas para o seu cheque - o número real, impressa no relatório, porque as alegações de cobertura que você não pode verificar são marketing, não precisão.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Perguntas mais frequentes

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.