Бу текширувчи нимани аниқлаши мумкин - ва аниқламаслиги мумкин

Ҳар бир плагиат текширувчининг кўрган жойи бор. Кўпчилиги уларни ерга кўмиб қўяди. Бу саҳифа бизники, тўлиқ, чунки сиз сўрай олмайдиган хабар ишона олмайдиган хабардир.

Двигатель қандай ишлайди

Текширув икки босқичда амалга оширилади. Биринчиси, олиш: биз матннинг ҳар бир қисмидан 8-12 та сўзлар орасини танлаб оламиз - оддий очиш сўзларидан кўра яхшироқ топиладиган кам учрайдиган сўзларни афзал кўрамиз - ва ҳар бир сўзни вебда тўғри иқтибосланган сўзлар сифатида қидирамиз. Бу номзод саҳифалар тўпламини ҳосил қилади.

Иккинчидан, текшириш: биз ҳар бир номзод саҳифани юклаб оламиз ва матнингизнинг ҳар бир жумласини саҳифанинг асл мазмуни билан мувофиқлаштирамиз. Ҳар бир сўзнинг ўхшашлиги сўз-дераза қиёслаши билан аниқланади; яқин парафразалар token-overlap ва edit-similarity thresholds билан аниқланади. Қидирув тизими саҳифани ҳеч қачон ўз-ўзидан далил сифатида қабул қилмайди - фақатгина текширилган матн қиёслаши ҳисобга олинади ва ҳар бир мослик ҳисоботда ишончли рақамни олиб боради.

Булардан олдин, матнингиз нормаллаштирилади: Юникодга ўхшаш ҳарфлар (тафтишчиларни алдаш учун стандарт усул) уларнинг оддий тенгламаларига туширилади, шунинг учун алмаштирилган кирилл ҳарфлари мосликларни яшира олмайди.

Биз ўйинларни йўқотганимизда (ёлғон салбий)

  • Paywalled ва обуна манбалари: илмий журналлар, киришдан кейинги янгиликлар архивлари.
  • Шахсий маълумотлар базалари - Turnitin's каби илмий топшириқ архивлари ҳам киради. Ҳеч қандай жамоатчилик воситаси уларни кўриб бўлмайди; бошқача маънони англатувчи ҳар қандай эркин текширувчи сизга ёлғон гапиради.
  • Offline манбалар: Интернетга ҳеч қачон қўйилмаган босма китоблар ва мақолалар.
  • Жуда янги мазмун: дақиқалар ёки соатлар олдин эълон қилинган саҳифалар, қидирув тизимлари ҳали индексламаган.
  • Оғир парафразалар: кўп сўзларни ўзгартирувчи қайта ёзишлар яқин мослашув чегараси остида қолади. Идеялар аниқлаш (матн ўрнига) ҳар қандай матн мослашувидан ташқарида.

Биз бегуноҳ матнни (ёлғон ижобий) ёпишганда

  • Тўғри цитата материали - цитата манбасига мос келиши керак. Цитатани текширинг, ёритилган қисмини эмас.
  • Умумлаштирилган иборалар ва ифодалар: сақлов иборалари, қонуний формулалар, бутун соҳада такрорланадиган методологик таърифлар.
  • Китоблар ва манбалар рўйхати, улар келтирилган асарларга табиий равишда мос келади.
  • Қисқа, фактик жумлалардаги тасодифий сўзлашув.

Шунинг учун ҳисоботда сизнинг матнингиз билан бирга, ҳар бир жумла учун, тўғри ва яқин муносабатлар алоҳида кўрсатилган ҳолда, мос келувчи манба матни кўрсатилади: асбоб ўхшашликни топади; инсон бунинг маъносини баҳолайди.

Балл нимани англатади

Мувофиқ фоиз - бу сизнинг сўзларингизнинг олинган манбага мувофиқ байтларда жойлашган қисмидир. Ўлчов чизиқлари - 0-5% оригинал кўринади, 6-20% баъзи муносабатлар, 21% + аҳамиятли муносабатлар - булар типик проза учун калибрланган кўриб чиқиш йўлланмалари, айблов чегаралари эмас. 4% ҳисобот ҳали ҳам бир тўлиқ нусхаланган абзацни тузатиш учун қийматга эга бўлиши мумкин; 25% ҳисобот тўғри цитата материали тўлиқ ҳақиқий иш бўлиши мумкин.

Биз сизга шунингдек, сизнинг текширувингиз учун қанча манбалар текширилганлигини ҳам айтамиз - бу ҳисоботда чоп этилган ҳақиқий рақам, чунки сиз текшира олмайдиган хабарларнинг қамрови маркетинг, аниқлик эмас.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Доимий сўраладиган саволлар

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.