چه چیزی این بررسی‌کننده می‌تواند - و نمی‌تواند - تشخیص دهد

هر جور که ميخواي، هر جور که ميخواي، هر جور که ميخواي، هر جور که ميخواي، هر جور که ميخواي، هر جور که ميخواي، هر جور که ميخواي،

موتور چطور کار ميکنه

بررسی در دو مرحله اجرا می‌شود. اول ، بازیابی: ما ۸- ۱۲ دنبالۀ واژه متمایز را از هر ناحیه از متن شما نمونه می‌گیریم — واژگان نادر را ترجیح می‌دهیم ، که بازیابی آن‌ها بسیار بهتر از بازگشایی‌های معمول است — و هر کدام را در وب زنده به عنوان عبارت نقل شده دقیق جستجو می‌کنیم. این مجموعه صفحات کاندید را تولید می‌کند.

دوم، تایید: ما هر صفحه کاندید را بارگیری می‌کنیم و هر جمله از متن شما را در مقابل محتوای واقعی صفحه، محلی، هماهنگ می‌کنیم. تداخل کلمه به کلمه با مقایسه پنجره کلمه چرخان شناسایی می‌شود؛ پارافرز نزدیک با تداخل نشانه و آستانه شبیه سازی ویرایش. رتبه موتور جستجو هرگز به عنوان یک مدرک در نظر گرفته نمی‌شود - فقط مقایسه متن تایید شده محاسبه می‌شود، و هر تطابق یک رقم اعتماد را در گزارش حمل می‌کند.

قبل از هر یک از اینها، متن شما نرمال می‌شود: کاراکترهای مشابه یونیکد (یک ترفند استاندارد برای فریب چکرها) به معادل‌های ساده خود بازگردانده می‌شوند، بنابراین حروف سیریلیک جایگزین شده تطابق‌ها را پنهان نمی‌کنند.

وقتي که ما يه بازي رو از دست بديم

  • منابع پرداختی و اشتراکی: مجلات علمی، آرشیو اخبار پشت شناسه کاربری.
  • پایگاه‌های داده خصوصی - از جمله آرشیوهای ارسال علمی مانند Turnitin's. هیچ ابزار عمومی نمی‌تواند آنها را ببیند؛ هر چک‌کننده آزاد که به شما دروغ می‌گوید.
  • منابع آفلاین: کتاب‌های چاپ شده و مقالاتی که هرگز در وب قرار نگرفته‌اند.
  • محتوای بسیار تازه: صفحاتی که چند دقیقه یا ساعت پیش منتشر شده‌اند و موتورهای جستجو هنوز آن‌ها را فهرست نکرده‌اند.
  • پارافرز سنگین: بازنویسی که بیشتر کلمات را تغییر می‌دهد زیر آستانه نزدیک تطابق قرار می‌گیرد. تشخیص ایده (به جای واژه) فراتر از هر تطابق‌دهنده متن است.

وقتی متن بی گناه رو علامت میزنیم ( مثبت های نادرست)

  • مواد به درستی نقل شده - نقل قول باید با منبعش تطابق داشته باشد. نقل قول را بررسی کنید ، نه مشخص کردن را.
  • عبارت‌های مشترک و boilerplate: عبارت‌های سهام، فرمول‌های قانونی، توصیفات روش‌شناسی که در سراسر یک رشته تکرار می‌شوند.
  • کتاب‌شناسی و فهرست‌های مرجع، که به‌طور طبیعی با آثاری که نقل می‌کنند مطابقت دارند.
  • در این زبان، کلمات به صورت کوتاه و فشرده نوشته می‌شوند.

این به این دلیل است که گزارش متن منبع تطابق یافته را در کنار متن شما نشان می‌دهد، جمله به جمله، با تطابق دقیق و نزدیک جداگانه نشان داده شده: ابزار تداخل را پیدا می‌کند؛ یک شخص قضاوت می‌کند که آن به چه معناست.

. اين نتيجه يعني چي

درصد تطابق ، سهم کلمات شماست که در جملات با منبع بازیابی شده هم‌راستا هستند. نوارهای اندازه‌گیری — ۰- ۵٪ به نظر اصلی ، ۶- ۲۰٪ برخی تطابقات ، ۲۱٪ + تطابق قابل توجه — راهنمای بررسی برای نثر معمولی ، نه آستانه اتهام ، کالیبره شده‌اند. یک گزارش ۴٪ هنوز می‌تواند یک پاراگراف کاملاً کپی شده را که ارزش اصلاح دارد ، داشته باشد. یک گزارش ۲۵٪ از مواد به درستی نقل شده می‌تواند کار کاملاً صادقانه باشد.

همچنین به شما می‌گوییم که چند منبع برای چک شما بررسی شده است - تعداد واقعی، چاپ شده در گزارش، زیرا ادعاهای پوشش شما نمی‌توانید تأیید کنید بازاریابی است، نه دقت.

Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.

پرسش‌های متداول

Two phases. First we sample distinctive word sequences from your text and search them on the live web as exact phrases. Then we download every candidate page and align every sentence of your text against the page’s real content locally - exact matches by rolling word-window comparison, near matches by token overlap and edit similarity. Search results alone are never trusted as matches; only verified text comparison counts.

When the source is not on the public web at check time: paywalled journals, offline books, private submission archives, pages published minutes ago that search engines have not indexed, or content behind logins. Heavily paraphrased text can also fall below the near-match threshold. No web-based checker escapes these limits; we would rather tell you than let a 0% mislead you.

Correctly quoted passages, common stock phrases, technical boilerplate, legal or religious formulae, and bibliographies all legitimately match their sources. The report separates exact from near matches and shows the source text beside yours so a human can make the call - the score is an instrument reading, not a judgment.

It is the share of your words that sit in sentences we matched to a retrieved source: matched-sentence words divided by total words. The gauge bands are 0-5% "looks original", 6-20% "some matches - review citations", 21%+ "significant matching". The bands are review guidance, not accusation thresholds.

The interface runs in 100+ languages, and the engine itself is multilingual: sentence segmentation handles Latin, CJK and Arabic punctuation, and retrieval uses engines with strong non-English coverage. Match quality is best in languages with a large public web footprint; for very small languages, coverage is honestly thinner.