Co ten szacher może - i nie może - wykryć

Każdy kontroler plagiatyzmu ma ślepe miejsca. Większość ich pogrzebać. Ta strona jest nasza, w pełni, ponieważ raport nie możecie przesłuchać jest raportem, którego nie można ufać.

Jak działa silnik

Kontrola jest sprawdzona w dwóch fazach. Po pierwsze, odzyskiwanie: próbujemy charakterystyczne 8-12 sekwencje słów z każdego regionu twojego tekstu - preferując rzadkie słowa, które odbierają znacznie lepiej niż wspólne otwieracze - i przeszukiwać każdy z nich w sieci na żywo jako dokładne cytowane zdanie. To wytwarza zestaw stron kandydujących.

Po drugie, weryfikacja: pobieramy każdą stronę kandydowaną i wyrównujemy każde zdanie Twojego tekstu z aktualną zawartością strony, lokalnie. Pokrywanie się z słowom w słowo wykryte jest z porównaniem okien walcujących; zamknięcie parafrazy z przekroczeniem znaków i edycją podobnych progów. Ranking wyszukiwarki nigdy nie jest traktowany jako dowody same - tylko zweryfikowane liczenia porównań tekstów, a każdy mecz zawiera w raporcie figurę ufności.

Przed tym tekst jest normalizowany: znaki podobne do Unicode (standardowy sztuczka dla szaszybów) są zepsute z powrotem do ich zwykłych ekwiwalentów, więc wymienione cyryliczne litery nie ukrywają meczy.

Kiedy przegapimy mecze (fałszywe ujema)

  • Paywad and subskrypcjonalne źródła: akademickie czasopisma, archiwa wiadomości za logowaniem.
  • Prywatne bazy danych - w tym archiwa akademickich, takich jak Turnitin. Żadne narzędzie publiczne nie może je zobaczyć; każdy wolny checker sugeruje inaczej jest kłamstwo.
  • Internetowe źródła: drukowane książki i papiery, które nigdy nie zostały wprowadzone do sieci.
  • Bardzo świeża zawartość: strony opublikowane minuty lub godziny temu, że wyszukiwarki nie indeksowały jeszcze.
  • Ciężka parafraza: przepisanie zmiany większości słów spada poniżej progu bliskiego dopasowania. Wykrywanie pomysłów (ponad sformułowanie) jest ponad dowolnym meczem tekstu.

Kiedy będziemy znaleźć niewinny tekst (fałszywe pozytywy)

  • Prawicznie cytowany materiał - cytat powinien odpowiadać jego źródłu. Sprawdź cytat, a nie podkreślenie.
  • Wspólne wyrażenia i kotłowa: wyrażenia magazynowe, formuły prawne, opisy metodologiczne powtarzane w całym polu.
  • Bibliografie i listy referencyjne, które naturalnie pasują do dzieł, które zatytułują.
  • Sformułowanie w sprawie przypadków w krótkich, faktycznych zdarzeniach.

Dlatego w sprawozdaniu przedstawiono odpowiedni tekst źródłowy obok twojego, zdanie po zdaniu, z dokładnym i blisko meczów oznaczonych oddzielnie: narzędzie znajduje nakładanie; osoba ocenia, co to znaczy.

Co oznacza wynik

Pasuje odsetek to udział Twojego słowa, które siedzą w zdaniach porównywanych z odzyskanym źródłem. Pasma mierzeniowe - 0-5% wyglądają oryginalnie, 6-20% niektóre mecze, 21%+ znaczące dopasowanie - są wytyczne recenzyjne kalibrowane dla typowych proz, a nie progów oskarżenia. Raport 4% może nadal zawierać jeden całkowicie skopiowany paragraf warty ustalania; raport 25% odpowiednio cytowany materiał może być doskonałą szczerą pracą.

Powiemy również, ile źródeł rzeczywiście badano na czek - rzeczywisty numer, wydrukowany na sprawozdaniu, ponieważ twierdzenia o zasięgu nie mogą być zweryfikowane są marketing, a nie dokładność.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Często zadawane pytania

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.