สิ่งที่เครื่องตรวจสอบนี้สามารถ - และไม่สามารถ - ตรวจจับ

ทุกคนที่ตรวจสอบการปลอมแปลง มีจุดบอด ส่วนใหญ่จะฝังมัน หน้านี้เป็นของเรา เต็มๆ เพราะรายงานที่คุณไม่สามารถสอบถามได้ มันเป็นรายงานที่คุณไม่สามารถเชื่อใจได้

เครื่องยนต์ทำงานยังไง

การตรวจสอบจะทำงานในสองขั้นตอน ครั้งแรกคือ การค้นหา: เราจะเลือกตัวอย่างคำที่แตกต่างกัน 8- 12 คำจากทุกส่วนของข้อความของคุณ - เลือกคำที่หายาก ที่จะค้นหาได้ดีกว่าคำเปิดที่ใช้กันบ่อย ๆ - และค้นหาแต่ละคำบนเว็บโดยใช้คำอ้างอิงที่ถูกต้อง ซึ่งจะนำมาซึ่งการสร้างกลุ่มของหน้าที่คาดว่าจะใช้ได้

ครั้งที่สอง การตรวจสอบ: เราจะดาวน์โหลดหน้าที่คาดว่าจะใช้ได้ทุกหน้า และปรับแต่งประโยคของข้อความของคุณให้ตรงกับเนื้อหาจริงของหน้านั้น ๆ โดยใช้ระบบภายใน คำต่อคำที่ซ้อนกันจะถูกตรวจสอบด้วยการเปรียบเทียบหน้าต่างคำ; คำที่ซ้อนกันจะถูกปิดด้วยการเปรียบเทียบตัวอักษรและค่าที่เหมือนกันของการแก้ไข เครื่องมือค้นหาจะไม่เคยจัดอันดับหน้าเว็บเป็นหลักฐานในตัวมันเอง - มีเพียงการเปรียบเทียบข้อความที่ถูกตรวจสอบเท่านั้นที่จะนับ และแต่ละข้อความที่ตรงกันจะถูกแสดงเป็นตัวเลขความเชื่อมั่นในรายงาน

ก่อนหน้านี้ ข้อความของคุณจะถูกปรับให้เป็นปกติ: อักษรที่คล้ายกันในยูนิก๊อต (กลวิธีมาตรฐานสำหรับผู้ตรวจสอบ) จะถูกหดกลับมาเป็นตัวอักษรที่คล้ายกันโดยธรรมดา ดังนั้น อักษรซิลิกัลที่ถูกเปลี่ยนจะไม่ซ่อนการเข้ากันได้

เมื่อเราพลาดการทดสอบ

  • จ่ายและแหล่งที่มาของการจอง: วารสารวิชาการ, ข่าวที่เก็บไว้หลังล็อกอิน
  • ฐานข้อมูลส่วนตัว - รวมถึงแฟ้มเก็บข้อมูลการส่งงานวิจัยทางวิชาการ เช่น Turnitin' s ไม่มีเครื่องมือสาธารณะใดสามารถดูมันได้ เครื่องมือตรวจสอบฟรีที่แสดงให้เห็นว่าเป็นอย่างอื่น มันจะโกหกคุณ
  • แหล่งข้อมูลออฟไลน์: หนังสือพิมพ์และบทความที่ไม่เคยถูกวางไว้บนเวบ
  • เนื้อหาใหม่มาก: หน้าที่ถูกเผยแพร่เมื่อนาทีหรือชั่วโมงก่อน ซึ่งเครื่องมือค้นหายังไม่ได้ทำดัชนี
  • คำแปลแปลเป็นภาษาอื่น: การเขียนใหม่ที่เปลี่ยนคำส่วนใหญ่ลงมาต่ำกว่าระดับที่ใกล้เคียงกับคำที่ค้นหา ในการตรวจสอบความคิด (มากกว่าคำที่ค้นหา) มันจะเหนือกว่าเครื่องมือค้นหาข้อความที่ค้นหาได้

เมื่อเราจะทำการแจ้งเตือนข้อความที่ไร้สาระ (ข้อความที่ถูกตีความผิด)

  • วัสดุที่อ้างถึงถูกต้อง - การอ้างถึงควรจะตรงกับแหล่งที่มาของมัน ตรวจสอบการอ้างถึง ไม่ใช่การเน้น
  • คำศัพท์ทั่วไปและคำจำกัดความ คำอธิบายของหุ้น ข้อกำหนดทางกฎหมาย คำอธิบายวิธีการ ถูกซ้ำซ้อนไปทั่วทั้งสาขา
  • หนังสือและรายชื่อที่อ้างถึง ซึ่งเป็นธรรมชาติที่ตรงกับงานที่พวกเขาอ้างถึง
  • คำพูดที่บังเอิญ ในประโยคสั้นๆ ข้อเท็จจริง

นี่คือเหตุผลที่รายงานแสดงข้อความที่ตรงกับคำที่คุณใช้ ข้างๆ ข้อความของคุณ ประโยคต่อประโยค โดยมีข้อความที่ตรงกับคำที่คุณใช้ และข้อความที่ตรงกับคำที่คุณใช้ ถูกระบุไว้แยกกัน: เครื่องมือจะค้นหาคำที่ตรงกัน แต่ผู้ใช้จะตัดสินว่ามันหมายความว่าอะไร

หมายถึงอะไร

เปอร์เซ็นต์ที่ตรงกัน คือ ส่วนของคำของคุณที่อยู่ในประโยคที่ตรงกับแหล่งที่มาที่ได้ค้นหามา ค่า - 0-5% ดูเหมือนจะเป็นต้นฉบับ, 6- 20% ตรงกันบางส่วน, 21% + ตรงกันอย่างมีนัยสำคัญ - เป็นคำแนะนำในการตรวจสอบที่ปรับให้เหมาะสมกับบทความทั่วไป, ไม่ใช่ค่าที่กำหนดไว้สำหรับข้อกล่าวหา รายงานที่ 4% ยังคงมีย่อหน้าที่ถูกคัดลอกอย่างสมบูรณ์ ที่มีค่าแก้ไข; รายงานที่ 25% ที่มีเนื้อหาที่อ้างอิงอย่างถูกต้อง อาจเป็นงานที่ซื่อสัตย์อย่างสมบูรณ์

เรายังบอกคุณอีกด้วยว่า มีแหล่งข่าว จำนวนเท่าไหร่ที่ถูกตรวจสอบจริงๆ สำหรับเช็คของคุณ จำนวนจริง พิมพ์บนรายงาน เพราะการคาดการณ์ที่คุณไม่สามารถตรวจสอบได้ เป็นการตลาด ไม่ใช่ความถูกต้อง

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

คำถามที่ถามบ่อย

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.