ما يمكن لهذا المدقق - وما لا يمكنه - كشفه

كل مكافح للسرقة لديه نقاط عمياء، معظمهم يدفنها هذه الصفحة هي صفحتنا، بالكامل، لأن التقرير الذي لا يمكنك استجوابه هو تقرير لا يمكنك الثقة به

كيف يعمل المحرك

ويجري التحقق على مرحلتين. أولا، الاسترجاع: نأخذ عينة من 8 إلى 12 كلمة مميزة من كل منطقة من نصك - نفضل الكلمات النادرة، التي تسترجع بشكل أفضل بكثير من الكلمات المفتاحية الشائعة - ونبحث عن كل منها على شبكة الإنترنت الفعلية كعبارة اقتباسية دقيقة. وهذا ينتج مجموعة من الصفحات المرشحة.

ثانيا، التحقق: نحن نقوم بتحميل كل صفحة مرشحة ونقوم بمواءمة كل جملة من نصك مع المحتوى الفعلي للصفحة، محليا. يتم الكشف عن التداخل كلمة بكلمة من خلال مقارنة نافذة الكلمات المتحركة؛ ويتم إغلاق المقتطفات من خلال التداخل الرمزي وعتبات التشابه في التحرير. ولا يعامل ترتيب محرك البحث صفحة على أنها دليل في حد ذاته أبدا - مقارنة النصوص المتحقق منها فقط هي التي تحسب، وكل مطابقة تحمل رقم ثقة في التقرير.

قبل أي من ذلك، نصك يتم تطبيعه: يجري تقليص الحروف المشابهة لـ Unicode (خدعة قياسية لخداع المدققين) إلى معادلاتها البسيطة، لذا فإن الحروف السيريلية المتبادلة لا تخفي التوافقات.

عندما نكون قد فاتتنا المباريات (السلبية الكاذبة)

  • المصادر المدفوعة والمصادر الاشتراكية: المجلات الأكاديمية، محفوظات الأخبار خلف تسجيل الدخول.
  • قواعد البيانات الخاصة - بما في ذلك محفوظات التقارير الأكاديمية مثل تورنتين. لا يمكن لأي أداة عامة أن ترى هذه البيانات؛ أي مرجع مجاني يشير إلى خلاف ذلك يكذب عليك.
  • المصادر غير المتصلة بالإنترنت: الكتب والورقات المطبوعة التي لم توضع قط على شبكة الإنترنت.
  • (ج) المحتوى الجديد جداً: الصفحات المنشورة منذ دقائق أو ساعات والتي لم تفهرسها محركات البحث بعد.
  • المراجعة الثقيلة: إعادة الكتابة التي تغير معظم الكلمات تقع تحت عتبة التوافق القريب. إن كشف الأفكار (بدلاً من الصياغة) يتجاوز أي مطابقة نصية.

عندما نقوم بتعليم النص البريء (الإيجابيات الكاذبة)

  • المواد المستشهد بها بشكل صحيح - يفترض أن يتوافق الاقتباس مع مصدره، فتحقق من الاقتباس، لا من الإشارة.
  • العبارات الشائعة والمعايير: تعبيرات المخزون، والصيغ القانونية، والأوصاف المنهجية المتكررة في مجال كامل.
  • Bibliographies and reference lists, which naturally match the works they cite.
  • صيغة متطابقة في جمل قصيرة وقائعية.

وهذا هو السبب في أن التقرير يظهر النص المصدر المطابق إلى جانب نصك، جملة تلو الأخرى، مع المطابقات الدقيقة والقريبة المميزة بشكل منفصل: الأداة تجد التداخل؛ ويحكم الشخص على ما يعنيه.

ماذا يعني التصنيف

النسبة المطابقة هي حصة كلماتك التي تقع في الجمل المنسقة مع مصدر مسترجع. ونطاقات القياس - 0-5% تبدو أصلية، 6-20% بعض المطابقات، 21% + تطابق كبير - هي توجيهات مراجعة معدلة للنثر النموذجي، وليس عتبات الاتهام. تقرير 4% يمكن أن يحتوي على فقرة مستنسخة بالكامل تستحق الإصلاح؛ وتقرير 25% من المواد المقتبسة بشكل صحيح يمكن أن يكون عملاً أميناً تماماً.

ونحن نخبركم أيضاً بعدد المصادر التي تم فحصها فعلاً من أجل فحصكم - العدد الحقيقي المطبوع على التقرير، لأن ادعاءات التغطية التي لا تستطيعون التحقق منها هي التسويق، وليس الدقة.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

الأسئلة المتكررة

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.