Какво може - и не може - да открие тази четка

Всеки плагиатизъм има слепи петна. Повечето ги погребват. Тази страница е наша, в пълна степен, защото доклад, който не можете да разпитвате е доклад, на който не можете да се доверите.

Как работи двигателят

Първо, извличаме от 8-12 думи от всеки регион на вашия текст - предпочитаме редки думи, които извличат много по-добре от обикновени отварянета - и претърсваме всеки от тях в живо в интернет като точна цитирана фраза.

Второ, проверка: ние сваляме всяка кандидатска страница и подравняваме всяко изречение на вашия текст с действителното съдържание на страницата, местно. Word-for-word се сравнява с подвижното сравнение на думите; близка парафраза с жетоните-овърхов и редактиране-подобен праг. Претърсача класиране на страницата никога не се третира като доказателство само от себе си - само проверен брой на сравняване на текстовете, и всеки мач носи фигура на доверие в доклада.

Преди всичко това, вашият текст е нормализиран: Unicode изглеждат символи (стандартен трик за глупачки шашки) са срутени обратно към своите обикновени еквивалентности, така че разменени кирилици букви не крият съвпадения.

Когато пропуснем съвпадения (лажни отрицателни)

  • Източници на пайта и абонамент: академични списания, архиви на новините зад входа.
  • Частни бази данни - включително академични архиви за представяне като Turnitin. Няма обществен инструмент да ги види; всеки безплатна проверка, която предполага друго, е лъжа.
  • Отключени източници: печатни книги и документи, които никога не са били поставени в мрежата.
  • Много свежо съдържание: страници публикувани преди минути или часове, че търсачите още не са индексирани.
  • Тежък парафраза: преработка на текста, че промени повечето думи пада под прага на почти мач. Откриването на идеи (по-скоро от формулировката) е извън всеки текст съвпадение.

Когато ще означим невинен текст (фалшиви положители)

  • Правилно цитиран материал - цитат трябва да съответства на източника си. Провери цитата, а не на изтъкнато.
  • Обща фраза и котел: изражение на стоки, правни формули, методологични описания, повтарящи се в цяло поле.
  • Библиографии и референтни списъци, които естествено съвпадат с произведенията, които цитират.
  • Съвпадителна формулировка в кратки фактични изречения.

Ето защо в доклада се показва съвпадащия текст до вашия, изречение по изречение, с точно и близо до съвпадения, маркирани отделно: инструментът намира пренасяне; лице съди какво означава.

Какво означава резултата

Съвпадащият процент е дялът на вашите думи, които седят в изречения, изравнени с източника на източник. Списъците с размери - 0-5% изглеждат оригинални, 6-20% някои съвпадения, 21%+ значимо съвпадение - са калибрирани насоки за типична проза, а не за обвинения. Докладът от 4% все още може да съдържа един напълно копиран параграф, за да се поправи; доклад от 25% на правилно цитиран материал може да бъде напълно честен.

Ние също ви казваме колко източници всъщност са изследвани за вашия чек - реалния номер, отпечатан в доклада, защото покритието твърди, че не можете да проверите са маркетинга, а не точност.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Често задавани въпроси

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.