Apa yang dapat dilihat pengukram ini - dan tidak dapat - mendeteksi

setiap plagiarisme memiliki titik buta kebanyakan menguburnya halaman ini milik kita, penuh, karena laporan yang tidak bisa kau interogasi adalah laporan yang tidak bisa kau percaya

Bagaimana cara kerja mesin

Cek berjalan dalam dua fase. Pertama, pengambilan: kita sampel urutan kata 8-12 khas dari setiap daerah teks Anda - lebih suka kata-kata langka, yang mengambil jauh lebih baik daripada pembuka umum - dan mencari masing-masing di web hidup sebagai frase dikutip yang tepat. yang menghasilkan set halaman kandidat.

Kedua, verifikasi: kami mengunduh setiap halaman kandidat dan menyelaraskan setiap kalimat teks anda dengan isi sebenarnya halaman, secara lokal. Kata demi kata tumpang tindih terdeteksi dengan perbandingan kata berawang; frasa penutup dengan ambang batas token-overlap dan similaritas. Sebuah mesin pencarian tidak pernah diperlakukan sebagai bukti dengan sendirinya - hanya perbandingan teks yang diverifikasi, dan setiap kecocokan membawa sebuah angka kepercayaan dalam laporan.

Sebelum itu, teks Anda dinormalkan: Karakter mirip Unicode (trik standar untuk main-main) roboh kembali ke rata-rata mereka, sehingga huruf Cyrillic ditukar tidak menyembunyikan kecocokan.

Ketika kita akan melewatkan pertandingan (hal negatif)

  • Menyambung dan berlangganan sumber-sumber: jurnal akademik, arsip berita di balik login.
  • Database pribadi - termasuk arsip pengiriman akademik seperti yang dimiliki Turnitin.
  • Sumber offline: buku tercetak dan kertas yang tidak pernah dimasukkan ke dalam web.
  • Konten yang sangat segar: halaman yang diterbitkan menit atau jam yang lalu mesin pencari belum diindeks.
  • Paraphrase berat: menulis ulang bahwa perubahan kebanyakan kata berada di bawah ambang batas hampir cocok. Mendeteksi ide (lebih cepat dari kata) di luar pencocokan teks manapun.

Ketika kita akan menandai teks yang tidak bersalah (salah positif)

  • Materi yang dikutip dengan benar - sebuah kutipan seharusnya cocok dengan sumbernya. Periksa kutipannya, bukan yang paling penting.
  • Frase dan pelapis uap: ekspresi saham, rumus hukum, deskripsi metodologis berulang di seluruh bidang.
  • Bibliographies dan daftar referensi, yang secara alami cocok dengan karya yang mereka sebutkan.
  • Kata-kata kebetulan dalam kalimat, kalimat fakta.

Inilah sebabnya mengapa laporan tersebut menunjukkan teks sumber yang cocok di samping Anda, kalimat demi kalimat, dengan kecocokan yang tepat dan dekat dengan yang ditandai secara terpisah: alat menemukan tumpang tindih; seseorang menilai apa artinya.

Apa artinya skor

Persentase yang cocok adalah bagian dari kata-kata Anda yang duduk dalam kalimat yang selaras dengan sumber yang diambil. Band pengukur - 0-5% terlihat asli, 6-20% beberapa kecocokan, 21%+ pencocokan yang signifikan - adalah panduan dikalibrasi untuk prosa khas, bukan ambang tuduhan. Laporan 4% masih dapat berisi satu paragraf yang disalin penuh layak diperbaiki; 25% laporan dari bahan dikutip dengan benar dapat benar bekerja jujur.

Kami juga memberi tahu Anda berapa banyak sumber yang sebenarnya diperiksa untuk cek Anda - jumlah yang sebenarnya, yang dicetak pada laporan itu, karena liputan mengklaim Anda tidak dapat memverifikasi pemasaran, bukan akurasi.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Sering kali mengajukan pertanyaan

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.