Ko šis pārbaudītājs var un nevar atklāt

Katram plaģiārisma inspektoram ir aklas vietas. Lielākā daļa apglabāto vietu. Šī lapa ir mūsu, pilnībā, jo ziņojums, ko nevar nopratināt, ir ziņojums, kuru nevar uzticēt.

Kā darbojas motors

Pārbaude notiek divos posmos. Pirmkārt, izgūst: mēs izvēlamies atšķirīgas 8-12 vārdu sekvences no katra sava teksta reģiona - dod priekšroku retiem vārdiem, kas iegūst daudz labāk nekā parasti atvērt - un meklējam katru no tiem tiešraidē kā precīzu citētu frāzi. Tas rada kandidātu lapu kopumu.

Otrkārt, pārbaude: mēs lejupielādējam katru kandidāta lapu un pielāgojam katru jūsu teksta teikumu lapas faktiskajam saturam lokāli. Vārdu-vārdu pārklāšanās tiek atklāta ar ritošo vārdu- vīna salīdzinājumu; aizvērt parafrāzi ar token-overlap un rediģēšanas-līdzības sliekšņiem. Meklēšanas rīka rangs lapas nekad netiek uzskatīts par pierādījumu pats par sevi - tikai pārbaudīts teksta salīdzināšanas skaits, un katra maketa satur uzticamības skaitli ziņojumā.

Pirms jebkura no tā, jūsu teksts tiek normalizēts: Unikode lookalike rakstzīmes (standarta triks muļķot Checkers) tiek sabojātas atpakaļ uz to vienkāršu ekvivalentu, tāpēc apmainīti Kirilica burti neslēpj spēles.

Kad mēs palaidīsim garām spēles (viltus negatīvus)

  • Maksas un abonēšanas avoti: akadēmiskie žurnāli, ziņu arhīvi aiz pieteikšanās.
  • Privātas datu bāzes - tostarp akadēmisko iesniegšanas arhīvi, piemēram, Turnitin's. Nekāds publisks rīks nevar tās redzēt; jebkurš bezmaksas čeks, kas nozīmē citādi melo jums.
  • Neierobežots avots: drukātas grāmatas un papīri, kas nekad netika laisti tīmeklī.
  • Ļoti svaigs saturs: lapas publicētas pirms minūtēm vai stundām, ka meklētājprogrammas vēl nav indeksēti.
  • Smags parafrāze: pārrakstīt, ka izmaiņas lielākā daļa vārdu nokrīt tuvu atbilstības slieksnim. Atklājot idejas (nevis formulējumu) ir ārpus jebkura teksta atskaņotājs.

Kad mēs atzīmēt nevainīgu tekstu (viltus pozitīvie)

  • Pareizi citēts materiāls - citāts ir paredzēts, lai atbilstu tā avotam. Pārbaudiet citāciju, nevis izcelšanu.
  • Kopīgas frāzes un katla plāksne: krājumu izteiksmes, juridiskās formulas, metodoloģiskie apraksti, kas atkārtojas visā laukā.
  • Bibliogrāfijas un uzziņu saraksti, kas dabiski atbilst tajos minētajiem darbiem.
  • Īsumā īss un faktiski formulēts formulējums.

Tāpēc ziņojumā ir redzams saskaņotais pirmteksts blakus jūsu teikumam, ar precīzi un tuvām spēlēm, kas atzīmētas atsevišķi: instruments atklāj pārklāšanos; persona nospriež, ko tas nozīmē.

Ko rezultāts nozīmē

Salīdzinājums ir daļa no jūsu vārdiem, kas atrodas teikumos, kas pielīdzināti pieņemtajam avotam. Mērījumu joslas - 0-5% izskatās oriģinālas, 6-20% dažas sakritības, 21% + nozīmīgas atbilstības - ir pārskatīšanas vadlīnijas kalibrētas tipiskiem prosiem, nevis apsūdzības sliekšņiem. 4% ziņojumā joprojām var būt viens pilnībā kopēts punkts, kas ir vērts fiksēt; 25% pārskats par pareizi citētu materiālu var būt pilnīgi godīgs darbs.

Mēs arī jums pateikt, cik daudz avotu tika faktiski pārbaudīta jūsu pārbaudi - reālo numuru, drukāts uz ziņojumu, jo segums apgalvo, ka jūs nevarat pārbaudīt ir mārketinga, nevis precizitāti.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Bieži uzdotie jautājumi

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.