見覚えのないソースが Turnitin に表示された理由と対処法

Similarity Report に、アクセスしたこともないウェブサイトが表示されても、慌てる必要はありません。これは意外とよくあることです。Turnitin はあくまで「一致したテキストを最初に見つけた場所」を表示するだけで、本来のオリジナルソースとは限りません。同じ文章が、スクレイピングされたページや集約サイト、他の学生の論文など、複数の場所に存在していることは珍しくありません。この記事では、その仕組みと一般的な原因、そしてソース名ではなく「一致した文章そのもの」をどう読むべきかを解説します。

HumanPen チーム

· 5 分

結論から言うと

Similarity Report に見覚えのないソースが表示されたからといって、あなたがそれをコピーしたわけでも、レポートが間違っているわけでもありません。Turnitin が表示するのは「一致したテキストを最初に見つけた場所」であり、オリジナルソースとは限りません。あなたが引用した文章は、読んだ論文そのもの、その論文を集約サイトにスクレイピングされたコピー、そして同じソースを使った他の学生の提出物など、複数の場所に存在している可能性があります。Turnitin はそのうちの一つを表示しているに過ぎません。重要なのは、その文章があなたの執筆内容とどの程度一致しているか、そしてその重複が引用によるものなのか、ありふれた表現なのか、それとも実質的な内容の重複なのかという点です。

見覚えのないソースが表示される理由

類似レポートの解釈に関する大学のガイドラインでは、この仕組みを明確に説明しています(UNE と LSE の文書はほぼ同じ表現を使っています):

"Sources indicated in the right-hand panel are the first instance of the matched text which Turnitin comes across, not necessarily the original source."(右側パネルに表示されるソースは、Turnitin が最初に一致したテキストで行き当たったものであり、必ずしもオリジナルのソースとは限りません)
"Turnitin displays the first match that it finds, so it is possible that if you have used material from one source that the software will display a match from another source that contains the same text."(Turnitin は最初に見つかった一致箇所を表示するため、あるソースから資料を使用した際に、同じ文章を含む別のソースからの一致が表示されることがあります)

ここから、2 つの重要なことが言えます:

  • 表示されているソースはコピーであり、判定ではない。 表示されているウェブページは、単に同じ文章が存在する場所の一つに過ぎません。あなたが実際に使ったソースをスクレイピングして再掲載したページである可能性もあります。
  • 1 つの文章には複数の「居場所」があり得る。 一致した文章は、あなたが読んだ論文、その論文の再掲載版、そして同じソースを引用した他の学生の提出物など、複数の場所に正当に存在している可能性があります。Turnitin はそのうちの 1 つを表示しているだけです。

主な原因

見覚えのないソース名が表示された場合、大抵は以下のいずれかが原因です:

  • 集約サイトや再掲載サイト。 学術的な文章は、コンテンツファームや集約ページにスクレイピングされて再掲載されることがあります。あなたが一致したのは実際に読んだ論文の文章で、表示されているページはそのコピーに過ぎません。Wikipedia のようなページがソースとして表示されるのは、大抵このケースです。そこには、どこか他の場所で使われた文章が掲載されているだけです。
  • 同じソースを使った他の学生の論文。 Turnitin のデータベースには、過去に提出された学生の論文が含まれています。他の学生があなたと同じ文章を引用したり使ったりしていた場合、その学生の論文が一致ソースとして表示されることがあります。特に、両方が同じ公開ソースから引用していた場合に起こり得ます。
  • 二人の書き手が、同じ方向に言い換えをした。 二人の独立した書き手が、同じオリジナルの文章を前にして、似たような言い換え方をすることがあります。その結果、お互いの文章が一致しても、どちらかがもう一方をコピーしたわけではありません。一致は事実ですが、コピーは起きていません。
  • リポジトリやジャーナルのコピー。 論文誌や機関リポジトリでは、同じ論文が複数の形式で公開されています。そのいずれかと一致するのは正常なことです。

「一致」と「コピー」は別物

レポートを読む上で最も難しいのは、仕組みと告発を区別することです。大学のガイドラインにも明確に書かれています:Similarity Report は「文章の一致を検出するツール」であり、「盗作検知ツール」ではありません。見覚えのないソースとの一致は、あなたの文章がデータベース内の文章と似ているという証拠に過ぎません。それ以上の意味はありません。そのソースをコピーした証拠でも、何らかの判定を下すものでもありません。

これは両方向に作用します。一度も読んだことのないページとの一致でも、重複が実質的なものであれば問題になることがあります。そのページはあなたが引用すべきだった論文のスクレイピングコピーかもしれませんし、あなたのドラフトが本当に他の人の公開論文と重複しているのかもしれません。ソース名だけではほとんど分かりません。全てを物語るのは「一致した文章そのもの」です。

一致箇所そのものの読み方

ソース名に反応するのではなく、ハイライトされた文章とソースを並べて確認しましょう:

  1. 一致箇所を開く — レポート内のソースをクリックして、どの文章が一致したかを正確に確認します。
  2. URL ではなく重複部分を読む — 一致した文章は、引用した直接的な引用符付きの文章なのか、タイトルや参考文献なのか、手法に関する決まり文句なのか、それとも你自己的な文章の一区切りなのかを判断します。
  3. 類似レベルを確認する — 数語や 1 つの文章の一致と、複数の文章が完全に同じ表現であることは別問題です。
  4. ソースの内容と比較する — そのページが集約サイトや、あなたが実際に使った資料の再掲載コピーのように見える場合は、それは仕組みによる表示上の現象であり、新たな告発ではありません。

これは指導教員が行うのと同じ読み方です:その一致が引用によるものなのか、一般的な表現なのか、それとも説明が必要なものなのかを確認します。

さらに調べるべきケース

見覚えのないソースとの一致の多くは無害ですが、以下のケースでは注意が必要です:

  • 中心的な部分での実質的な重複。 数語のフレーズではなく、複数の文章が連続して一致している場合、そして表示されているソースがあなたが全く使っていないページであれば、そのページが何なのかを調べる価値があります。それはあなたが使ったソースの再掲載コピー(問題なし)かもしれませんし、あなたが知らなかった公開論文とあなたのドラフトが重複している(確認する価値あり)のかもしれません。
  • ページがウェブサイトではなく学生の論文。 他の学生の提出物との一致は、共謀を意味しません。両方が同じソースを使っただけかもしれません。ただし、重複が広範囲にわたる場合は、自分の執筆内容とその収束理由を振り返る価値があります。それこそが、指導教員が注目することだからです。
  • 参照文献や引用部分との一致。 properly に引用された引用符付きの文章や参考文献リストとの一致は予想されるものであり、フィルタで通常除外されます。これらは指導教員が問題視する一致ではありません。

重複部分を読んでも依然として説明がつかない場合は、類似性に関する他の疑問と同様、実践的な対処法は 1 つ:指導教員に相談することです。それこそがレポートの目的です。対話を終わらせるためではなく、始めるためにあるのです。

まとめ

Similarity Report に見覚えのないソースが表示されるのは、一致メカニズムの表示上の特性であり、あなたに対する判定ではありません。レポートに表示されるのは、一致したテキストを最初に見つけた場所 — スクレイピングされたページ、集約サイト、他の学生の論文、あるいは同じ文章が存在し得る数多くの場所のいずれかです。その一致が重要かどうかを決定するのは、文章そのものです:どの程度重複しているか、引用して参考文献を示しているか、そしてその重複が核心的な主張の中にあるのか、それともありふれたフレーズの中にあるのか。ソース名ではなく、一致した文章そのものを読み込みましょう。そして、重複が実質的で説明がつかない場合は、レポートの役割は指導教員との対話を開くことです。ソースリストにある名前は何も決定しません。決定するのは、文章そのものなのです。