このチェッカーが検出できることと検出できないこと
盗作検査は どれも盲点がある 多くは埋める このページは 私たちのものです 質問できない報告は 信頼できない報告です
エンジンの動き
チェックは二つの段階で実行されます。 まず検索: テキストの各領域から特徴的な 8-12 語の文字列をサンプリングします。 一般的なオープナーよりもよく検索される珍しい言葉を選びます。それらをライブウェブ上で正確な引用句として検索します。 これにより候補ページのセットが生成されます。
次に検証: 候補ページをダウンロードし、テキストの文をページの実際の内容に合わせてローカルに整列します。 単語ごとの重複はローリングワードウィンドウ比較で検出され、近似的な翻訳はトークン重複と編集似通り性のしきい値で検出されます。検索エンジンのページのランクは、自身の証拠として扱われません。検証されたテキスト比較のみが計算され、各一致はレポートに信頼度を持っています。
これらの手順の前に、テキストは正規化されます。Unicode の似たような文字は、その単純な同等の文字に縮小されます。これにより、キリル文字の交換が一致を隠しません。
誤検出の場合
- 学術雑誌,ログイン後のニュースアーカイブ。
- プライベートデータベース - Turnitin のような学術的提出アーカイブを含む。公開ツールはこれを見ることができません。それ以外のフリーチェッカーは嘘です。
- オフライン資料:ウェブ上に掲載されなかった印刷本や論文。
- 非常に新しいコンテンツ: 検索エンジンがまだインデックス化していない、数分から数時間前に公開されたページ。
- 重い引用: ほとんどの単語を変更する書き直しは近似マッチのしきい値以下です。アイデア (言葉よりも) を検出するのはテキストマッチングの範囲外です。
安全なテキストをフラグするとき(F)
- 正しく引用された資料 - 引用はその出典と一致するものと考えられます。引用をチェックしてください。ハイライトはチェックしません。
- 共通のフレーズとボイラープレート:株式表現,法的公式,方法論的記述が全分野にわたって繰り返される。
- 文献目録と参考文献リストは,自然に引用した著作と一致する。
- 短い事実文で 偶然の言葉を使う
これは、このツールが、 人間が意味を判断するのと同じように、 重複を見つけるために、 文ごとに、 完全マッチと近似マッチを別々にマークして、 あなたのテキストの隣にマッチしたソーステキストを表示するための理由です。
得点の意味
合致率は検索した出典に合致した文に含まれる単語の割合です。 0-5% はオリジナルに見えます、6-20% はいくつかのマッチングがあり、21% 以上は有意なマッチングです。これらの測定値は典型的な文法に対して調整された検証ガイドラインであり、非難のしきい値ではありません。4% のレポートでも修正すべき完全にコピーされた段落が1つ含まれます。25% のレポートでも正しく引用された素材は完全に正直な作品です。
また、実際に調査された情報源の数も 報告書に印刷されている実数を 伝えます。 なぜなら、検証できない 報道内容の主張は マーケティングであり、正確性ではありません。
Results are indicative, not conclusive. We compare your text against publicly accessible web pages at the moment you run the check. We cannot detect matches in sources that are offline, paywalled, unindexed, or held in private databases (including academic submission archives). Common phrases, correctly quoted material, and coincidental wording can appear as matches. Use this report as a guide for review and citation - not as standalone proof that text was or was not plagiarized.