Kile ambacho mchunguzi huyu aweza kugundua - na hawezi kugundua

Watu wengi huizika ukurasa huu, kwa ukamili, kwa sababu ripoti ambayo huwezi kuihoji ni ripoti ambayo huwezi kuitumaini.

Jinsi injini inavyofanya kazi

Ukaguzi huo unafanyika katika hatua mbili. Kwanza, rituval: tunaiga mifuatano ya maneno 8-12 kutoka kila eneo la maandishi yako - kupendelea maneno nadra, ambayo hutoa maneno bora zaidi kuliko maneno ya kawaida - na kutafuta kila mmoja kwenye mtandao akiwa hai kama kifungu hususa kilichonukuliwa.

Pili, hakikisha: Tunapakua kila ukurasa wa mgombea na kuweka kila sentensi ya maandishi yako dhidi ya maudhui halisi ya ukurasa huo. Neno-kwa neno kwa neno linatumiwa kwa kupindwa; ufafanuzi wa karibu na oplap na uhariri.

Kabla ya jambo lolote hilo, maandishi yako ni ya kawaida: Herufi za kisiri zilizo kama za kindoa (mbinu ya kawaida kwa wachunguzaji wa udanganyifu) huangushwa tena kwenye vifanani vyao vilivyo wazi, kwa hiyo herufi zilizobadilishwa za Kisirili hazizibi.

Basi tukiogopa kufanya uadilifu,

  • Vitabu vilivyounganishwa na kuandikishwa: majarida ya kitaaluma, hifadhi za habari nyuma ya witin.
  • Hakuna kifaa cha umma kinachoweza kuwaona; mkaguzi yeyote wa bure anayekuambia vingine, anayekudanganya.
  • Vyanzo vya habari: kilichochapishwa vitabu na makaratasi ambayo hayakuwekwa kwenye mtandao huo.
  • Habari mpya sana: kurasa zilizochapishwa dakika au saa nyingi zilizopita ambazo injini za utafutaji hazijaorodhesha bado.
  • Ufafanuzi mzito: Maandishi ya kubadilisha maneno mengi yanabaki chini ya mpaka ulio karibu.. Kupata mawazo (kwa kutumia maneno) kunapita mlingano wowote wa maandishi.

Na tukiweka baina ya makundi mawili yanayo gombana, na wanao taka kutakiwa wafanye uadilifu.

  • Chunguza maandiko yaliyonukuliwa vizuri - nukuu linapaswa kupatana na chanzo chake.
  • Maneno na maneno ya kawaida: maelezo ya mifugo, maelezo ya kisheria, maelezo ya kinadharia yarudiwayo katika nyanja nzima.
  • Vitabu vya Biblia na orodha za marejeo, ambazo kwa kawaida zinapatana na vitabu wanavyotaja.
  • Maneno ya siri katika sentensi fupi, za kweli.

Hii ndiyo sababu ripoti hiyo inaonyesha maandishi ya chanzo kimoja kando ya yako, hukumu kwa sentensi, kwa usahihi na karibu na mechi zilizotengwa: kifaa hicho kinapata nafasi ya usiku; mtu anahukumu maana yake.

Maana ya alama hizo

Asilimia hiyo ni sehemu ya maneno yako ambayo yanaambatana na sentensi zinazounganishwa na chanzo kilichotangazwa. Ripoti ya 4 inaweza kuwa na kikanyagio cha kwanza, asilimia 6 hadi 20 ya mechi, 21%+ za maana - zinapitia mwongozo uliorekebishwa kwa ajili ya uratibu wa kawaida, wala si wa mashtaka. Ripoti ya 4 inaweza bado kuwa na moja ya uratibu wa fungu kamili lililonakiliwa; ripoti 25 ya habari iliyonukuliwa vizuri inaweza kuwa kazi ya haki kabisa.

Pia tunawaeleza ni vyanzo vingapi ambavyo vilichunguzwa ili kuchunguza habari yenu - idadi halisi, iliyochapishwa juu ya ripoti hiyo, kwa sababu madai ya vyombo vya habari ambayo huwezi kuthibitisha ni matangazo ya biashara, si usahihi.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Maswali yaliyoulizwa mara nyingi

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.