Bu kontrolör neyi tespit edebilir - ve neyi tespit edemez

Her kopyalama denetimcisi kör noktaları vardır çoğu onları gömer bu sayfa bizimdir, tamamen çünkü sorgulayamayacağınız bir rapor güvenemeyeceğiniz bir rapordur.

Motorun nasıl çalıştığı.

Kontrol iki aşamada yapılır. İlki, geri alma: metininizin her bölgesinden farklı 8- 12 kelime dizisini örnekleyiz - yaygın açılış kelimelerinden daha iyi geri alan nadir kelimeleri tercih ederiz - ve canlı webde her birini tam olarak alıntılanmış bir cümle olarak arıyoruz. Bu da bir grup aday sayfa üretir.

İkinci olarak, doğrulama: her aday sayfayı indirir ve metninizin her cümlesini sayfanın gerçek içeriğine göre yerel olarak doğrular. Sözcük- sözcük örtüşmesi, dönen kelime- pencere karşılaştırması ile tespit edilir; yakın parafraz, token- örtüşme ve edit- benzerlik barajlarıyla. Bir arama motoru sıralaması bir sayfayı kendiliğinden hiçbir zaman kanıt olarak değerlendirmez - sadece doğrulanmış metin karşılaştırması değerlendirilir ve her eşleşme raporda güven rakamı taşır.

Bunlardan önce, metininiz normalleştirilir: Unicode benzeri karakterler (kontrolcüleri kandırmak için standart bir hile) basit eşdeğerlerine geri çekilir, böylece değiştirilmiş Kiril harfleri eşleşenleri gizlemezler.

Maçları kaçırdığımızda (sahte negatifler)

  • Paywalled ve abonelik kaynakları: akademik dergiler, girişlerin arkasındaki haber arşivleri.
  • Turnitin gibi akademik sunuş arşivleri dahil özel veritabanları. Hiçbir kamusal araç onları göremez; aksini söyleyen herhangi bir ücretsiz kontrolcü size yalan söylüyor.
  • Offline kaynaklar: web'e asla konmamış basılı kitaplar ve makaleler.
  • Çok taze içerik: dakikalar veya saatler önce yayınlanan ve arama motorlarının henüz indekslemediği sayfalar.
  • Ağır parafraz: kelimelerin çoğunu değiştiren yeniden yazma, yakın eşleşme eğrisi altındadır. Fikirleri tespit etmek (sözcük yerine) herhangi bir metin eşleyicisinin ötesindedir.

Masum metinleri işaretlediğimizde (yalan pozitifler)

  • Doğrudan alınan madde - bir alıntı kaynakla eşleşmeli. İzlenim değil alıntıyı kontrol edin.
  • Ortak ifadeler ve boilerplate: stok ifadeleri, yasal formüle, metodolojik açıklamalar tüm bir alanda tekrarlanır.
  • Bibliyografiler ve referans listeleri, doğal olarak işaret ettikleri çalışmalarla uyumludur.
  • Tesadüflü cümleler kısa, gerçekçi cümleler.

Bu yüzden rapor, sizin metininizin yanında eşleşen kaynak metni, cümle cümle, tam ve yakın eşleşenler ayrı olarak işaretlenmiş olarak gösterir: araç örtüşmeyi bulur; bir kişi anlamına karar verir.

Puan ne demek?

Eşleşen yüzde, sözcüklerinizin alınan kaynakla doğrulanmış cümlelerde yer alan yüzdesidir. Gösterge bantları - %0-5 orijinal görünüyor, %6-20 bazı eşleşenler, %21+ önemli eşleşenler - suçlama barajları değil, tipik bir nesir için kalibrasyonlu inceleme rehberidir. %4 raporu hala düzeltmeye değer bir paragrafı tamamen kopyalayabilir; %25 raporu doğrudan alınan materyalden tamamen dürüst bir iş olabilir.

Ayrıca size, kontrolünüz için gerçekten kaç kaynak incelendiğini de söyleriz - raporda basılan gerçek sayı, çünkü doğrulayamayacağınız haber iddiaları doğruluk değil pazarlamadır.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

Sıkça Sorulan Sorular

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.