Apa yang periksa ini boleh - dan tidak boleh - deteksi

Setiap periksa plagiat mempunyai titik buta. Kebanyakannya menguburkannya. Halaman ini adalah milik kami, sepenuhnya, kerana laporan yang tidak boleh dimintai keterangan adalah laporan yang tidak boleh dipercayai.

Bagaimana enjin bekerja

Pemeriksaan berjalan dalam dua fasa. Pertama, pemulihan: kami sampel 8- 12 rentetan perkataan yang berbeza dari setiap kawasan teks anda - lebih suka perkataan jarang, yang dipulihkan lebih baik daripada pembuka biasa - dan carian setiap satu di dalam web hidup sebagai frasa kutipan tepat. Yang menghasilkan set halaman calon.

Kedua, pengesahan: kami muat turun setiap halaman calon dan jajar setiap ayat teks anda dengan kandungan sebenar halaman, secara setempat. Tumpang tindih perkataan-perkataan dikesan dengan perbandingan tetingkap perkataan berputar; parafrasa tertutup dengan ambang tumpang tindih token dan kesamarataan edit. Penilaian enjin carian halaman tidak pernah dianggap sebagai bukti oleh dirinya sendiri - hanya perbandingan teks yang disahkan yang dikira, dan setiap perbandingan membawa angka kepercayaan dalam laporan.

Sebelum apa-apa yang, teks anda dinormalkan: Aksara serupa Unicode (trik piawai untuk periksa yang bodoh) dicondongkan semula ke setara biasa mereka, jadi huruf Cyrillic yang ditukar tidak menyembunyikan kesilapan.

Bila kita akan terlepas perlawanan (negatif palsu)

  • Sumber bayaran dan langganan: jurnal akademik, arkib berita di belakang log masuk.
  • Pangkalan data persendirian - termasuk arkib penyerahan akademik seperti Turnitin. Tiada alat awam boleh melihatnya; sebarang penyemak bebas yang menandakan sebaliknya adalah menipu anda.
  • Sumber luar talian: buku dan kertas yang dicetak yang tidak pernah diletakkan di web.
  • Kandungan sangat segar: halaman diterbitkan minit atau jam yang lalu yang enjin carian belum mengindeksnya.
  • Parafrasa berat: menulis semula yang mengubah kebanyakan perkataan jatuh di bawah ambang hampir sepadan. Mengesan idea (daripada perkataan) adalah di luar sebarang penyesuai teks.

Bila kita akan bendera teks tidak bersalah (positif palsu)

  • Bahan yang betul dikutip - petikan sepatutnya sepadan dengan sumbernya. Semak petikan, bukan penonjolan.
  • Frasa biasa dan boilerplate: ungkapan stok, formula undang-undang, keterangan metodologi yang diulang di seluruh medan.
  • Bibliografi dan senarai rujukan, yang secara semula jadi sepadan dengan karya yang mereka sebutkan.
  • Kata-kata yang bercanggah dalam ayat-ayat yang ringkas dan tepat.

Inilah sebabnya laporan memaparkan teks sumber yang sepadan di samping anda, ayat demi ayat, dengan sepadan tepat dan dekat ditandakan secara berasingan: alat mencari tumpang tindih; seorang manusia menilai apa yang bermakna.

Apa maksud skor itu?

Peratusan yang sepadan adalah bahagian perkataan anda yang berada dalam ayat yang disusun mengikut sumber yang diperoleh. Jalur pengukur - 0- 5% kelihatan asal, 6- 20% beberapa sepadan, 21% + sepadan yang signifikan - adalah panduan tinjauan yang diukur untuk prosa biasa, bukan ambang dakwaan. Laporan 4% masih boleh mengandungi satu perenggan yang disalin sepenuhnya yang patut diperbaiki; laporan 25% bahan yang dipetik dengan betul boleh menjadi kerja yang jujur.

Kami juga beritahu awak berapa banyak sumber yang sebenarnya diperiksa untuk cek awak - nombor sebenar, dicetak pada laporan, kerana tuntutan liputan yang awak tak boleh sahkan adalah pemasaran, bukan ketulenan.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Pertanyaan yang kerap ditanya

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.