Mitä tämä tarkastaja voi - ja ei voi - havaita

Jokaisella plagioinnin tarkastajalla on sokeat kohdat, joista suurin osa hautaa ne. Tämä sivu on kokonaan meidän, koska raporttiin, jota ei voi kuulustella, ei voi luottaa.

Moottorin toiminta

Tarkistaminen tapahtuu kahdessa vaiheessa. Ensinnäkin haku: näytteille tulee erottuvia 8-12 sanan jaksoja tekstisi joka alueelta, mieluummin harvinaisia sanoja, jotka ovat paljon parempia kuin tavalliset avaajat, ja etsimme jokaisen suorasta verkosta tarkana lainauslauseena.

Toiseksi varmistus: lataamme jokaisen ehdokassivun ja kohdistamme tekstisi jokaisen lauseen sivun varsinaiseen sisältöön paikallisesti. Sana-sana-yhdistelmä-vertailun kanssa havaitaan päällekkäisyyttä, ja jokaisessa ottelussa on mukana lyhyt parafiitti, jossa on token-overlap- ja editointi-saksaraja. Hakukonetta, joka on sivua varten asetettu, ei koskaan pidetä todisteena itsestään - vain todennettu teksti-vertailu ratkaisee, ja jokaisessa ottelussa on mukana luottamusluku raportissa.

Ennen kuin mitään näistä, tekstisi normalisoituu: Unicode lookalike -merkit (normaali temppu hämääville tarkastajille) romahtavat takaisin tavallisiin vastaavuuksiinsa, joten vaihdetut kyrilliset kirjaimet eivät piilota tulitikkuja.

Kun jäämme paitsi otteluista (väärät negatiivit)

  • Maksulliset ja maksulliset lähteet: akateemiset aikakauslehdet, uutisarkistot kirjautumisten takana.
  • Yksityiset tietokannat - mukaan lukien akateemiset arkistot, kuten Turnitinin arkistot. Julkista työkalua ei voi nähdä; kuka tahansa vapaa tarkastaja, joka vihjaa toisin, valehtelee sinulle.
  • Offline-lähteet: painetut kirjat ja paperit, joita ei koskaan laitettu verkkoon.
  • Hyvin tuoretta sisältöä: sivut, jotka julkaistiin minuutteja tai tunteja sitten, joita hakukoneet eivät ole vielä indeksoineet.
  • Raskas kääntölause: eniten sanoja muuttava uudelleenkirjoitus jää alle lähes ottelun rajan. Havaitsevat ideat (enemmän kuin muotoilu) eivät ole minkään tekstin sovittajan yläpuolella.

Milloin liputamme viattoman tekstin (väärät positiiviset)

  • Oikeasti lainattu materiaali - lainauksen pitäisi vastata sen lähdettä. Tarkista lainaus, ei kohokohtaa.
  • Yleiset lauseet ja kattilalauta: varaston ilmaisut, oikeudelliset kaavat, menetelmäkuvaukset, joita toistetaan koko alalla.
  • Bibliografioita ja viiteluetteloita, jotka luonnollisesti vastaavat heidän mainitsemiaan teoksia.
  • Sattumanvarainen sanamuoto lyhyinä tosiseikkoina.

Siksi raportissa näytetään vastaava lähdeteksti lauseelta, jossa on tarkat ja lähellä olevat ottelut erikseen: työkalussa on päällekkäisyyttä, henkilö arvioi, mitä se tarkoittaa.

Mitä pisteet tarkoittavat

Täsmätty prosenttiluku on lauseiden osuus, joka on linjassa noudetun lähteen kanssa. Mittarivit - 0-20 % näyttää alkuperäiseltä, 6-20 % vastaavuuksia, 21 %+ merkittävää vastaavuutta - ovat tarkasteluohjeistusta, joka on kalibroitu tyypilliselle proosalle, ei syytöskynnyksille. Neljän prosentin raportti voi silti sisältää yhden täysin kopioidun kappaleen, joka kannattaa korjata; 25 prosentin raportti oikein lainatusta materiaalista voi olla täysin rehellistä työtä.

Kerromme myös, kuinka monta lähdettä tarkastettiin todella tarkastusta varten - raporttiin painettu todellinen numero, koska uutisointiväitteitä ei voida todentaa markkinoinniksi, ei tarkkuudeksi.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Usein kysyttyjä kysymyksiä

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.