ターンイットインのAI検出ツールは的確か? - 機能と限界
論文を提出した際、TurnitinのAI検出の精度に疑問を持ったことはありませんか? その精度について詳しく見ていきましょう。
この記事では、TurnitinのAI機能について詳しく解説し、実際に何を検出できるのか、その限界はどこにあるのかを探ります。
注意:TurnitinのAIレポートは、教師のみが閲覧できます。もしAIスコアを事前に確認したい場合は、T-detectorが、類似度とAI判定の割合を誰でも確認できるTurnitin検出ツールを提供しています。

Turnitinの精度はどのくらいですか?
Turnitinの公式見解では、AIによって生成されたコンテンツが20%以上含まれる文書において、人間が書いた文章をAI生成と誤判定する割合を1%未満に抑えることを目指しています。つまり、完全に人間が書いた100件の文書のうち、AI生成コンテンツを含むと誤って判定されるのは、わずか1件程度であるということです。
この精度を保証し検証するため、Turnitinは2023年4月にChatGPTの公開前に、80万件の学術論文に対し大規模なテストを実施しました。このテストにより、誤検出率を1%未満に維持するという主張が裏付けられています。
ただし、トレードオフとして、Turnitinは低い誤検出率を達成するために、文書中のAIが書いたテキストの最大15%を見逃す可能性があることを認めています。例えば、Turnitinのツールが文書の50%をAIが書いたものだと判断した場合、実際の割合は最大で65%に達する可能性があるということです。
TurnitinのAI検出機能でわかること、わからないこと
Turnitinの精度について議論する前に、まずTurnitinのAI検出ツールが具体的に何を検出しようとしているのかを理解することが重要です。
TurnitinのAI検出機能は、AIツールによって作成または修正された可能性のあるコンテンツを特定することに重点を置いています。以下に概要を示します。
検出可能な点:
AIによる文章の検出:GPT-3やGPT-3.5などの高度なAIツールによって生成されたと思われる文章を検出します。
AIによる言い換えの検出:AIによって生成された文章が、AIによる言い換えツールで修正されたかどうかを判断します。

検出の限界:
散文以外のコンテンツ:詩、脚本、コードなど、通常の文章構造に従わないコンテンツは苦手です。
短い形式/非従来型の文章:箇条書き、注釈付き参考文献など、従来の形式にとらわれない、または断片的な文章は苦手です。
言語と翻訳:主に英語の文章を対象としており、翻訳されたコンテンツがAI生成された文章のパターンに類似していない場合、正確に検出できないことがあります。
AIツールの特定:AIによって作成された文章の存在は検出できますが、ChatGPTなどの特定のAIライティングツールを区別することはできません。
TurnitinのAI検出の仕組み
TurnitinのAI検出プロセスでは、まず提出されたレポートを複数のテキストブロックに分割し、それぞれのブロック(数百語程度)についてAIによって生成された兆候がないか分析します。各ブロック内の文には、0(人間が記述)から1(AIが生成)までのスコアが付けられ、AI検出モデルがこれらのスコアを評価して、AIが関与している可能性を判断します。

AI生成の疑いがある場合、AI言い換え検出モデルによってさらに詳細な分析が行われ、AI言い換えツールを使用してテキストが修正されていないかどうかが確認されます。この2回目の分析でも、文に0から1までのスコアが付けられます。AI生成と判定されたものの、言い換えられていない文は、AI生成と判定され、さらに言い換えも行われた文とは区別されます。最終的なAI検出率は、これらの結果を組み合わせて、AIが直接生成した部分と、言い換えによって修正された部分の両方を定量化し、レポートに含まれるAI生成コンテンツとAIによる言い換えに関する詳細で包括的な情報を提供します。
したがって、レポートに表示されるAI検出率は、AIによって生成されたコンテンツとAIによって言い換えられたコンテンツの合計となります。
Turnitinで論文のAIスコアを確認する方法
TurnitinのAI検出スコアは、通常、学生が直接確認することはできません。教育機関や教員はTurnitinのシステム上でAIスコアを確認できますが、LMS(Learning Management System)を通じて学生に直接提供されたり、学生自身が個別に閲覧できるわけではありません。
では、Turnitinに近い詳細なレポートを入手するにはどうすれば良いでしょうか? T-detectorは、類似度スコアとAI検出結果の両方を提供する専門的なツールです。Turnitinのレポートと同等の情報を得るために、T-detectorをどのように利用できるかをご紹介します。
Turnitinで論文をチェックする手順:
T-detectorのプラットフォームにアクセスします。
チェックしたい文書をアップロードします。操作は簡単で、ユーザーフレンドリーな設計です。
分析には通常、文書の長さや複雑さによって5〜20分程度かかります。
分析が完了すると、類似度スコアと検出されたAI生成コンテンツに関する詳細なレポートが提供されます。
重要な点として、T-detectorを使用した場合、文書がTurnitinのデータベースに保存されることはありません。したがって、同じ文書をTurnitinに再提出しても影響はありません。このため、T-detectorは、教育機関への最終提出前に予備チェックを行うための有効な手段となります!
なぜ Turnitin のレポートで、AI を使用していないのに AI が検出されるのか?
Turnitin の AI 検出ツールは高機能ですが、完璧ではありません。人間が書いた文章が、AI によって生成されたものと誤判定される場合があります。これには、主に以下の理由が考えられます。
よく使われるフレーズや構造化されたテキスト: AI が生成する文章で頻繁に使用されるフレーズや構造が含まれていると、誤検出されることがあります。
高度な AI モデル: Turnitin は検出モデルを常に更新していますが、最新または非常に高度な AI が生成した文章は、人間の文章スタイルに酷似しているため、検出が困難になることがあります。
創造的なライティング スタイル: 型破りな、または創造的なライティング スタイルは、AI 検出器が学習している典型的なパターンに合致しないため、誤って分類されることがあります。
教員の設定: 教員がソースと引用フィルターをどのように設定するかによって、テキストが AI 生成としてフラグされるかどうかが変わります。たとえば、ごくわずかな一致を除外しない場合、学生自身の名前や一般的なフレーズがフラグ付けされることがあります。
提出履歴: 学生が同じ論文の草稿を複数回提出すると、AI スコアが不当に高くなる可能性があります。教員は、以前の提出物をレポートから除外することで、この問題を回避できます。
直接コピーと適切な引用: テキストを直接コピーした学生も、適切に引用した学生も、類似度スコアが同じになることがあります。教育者は、引用以外の類似性を明確にするため、レポートから引用部分を除外する場合があります。
過剰な引用: 引用や参考文献が多い論文も、類似度スコアが高くなることがあります。教員は、類似度計算から参考文献や引用部分を除外するように設定を調整する必要がある場合があります。
Turnitin の誤検出への対応
Turnitin は、AI 検出技術の限界と不正確さを認識しています。AI レポートのフィードバック ボタンから、誤りに関するフィードバックを推奨しています。このフィードバックは、モデルの改善と誤検出の削減に役立てられます。また、Turnitin は一定の誤差範囲を認識しており、誤検出を防ぎつつ、効果的な検出機能を維持できるよう、ツールの感度調整に継続的に取り組んでいます。
Turnitin AIスコアが高い場合、どうすればいいですか?
提出物のTurnitin AIスコアが高く、AI生成コンテンツの疑いがある場合、検出を回避するための対策を紹介します。
レポートを確認する: Turnitin AI検出器がどの部分を検出したか確認し、その理由を理解します。
担当教員に相談する: AIレポートについて担当教員や課題の責任者に相談し、検出された箇所について説明を求め、必要に応じて修正方法の指導を受けましょう。

コンテンツを修正する: 以下の点に注意して文章を修正します。
文構造を変える: 文章構造を変化させ、より自然な文章になるようにします。単純文、重文、複文を組み合わせることで、AI生成と判定されにくくなります。
表現を工夫する: 文構造を変えたり、異なる文字で見た目が似た文字を使うなど、AI検出を避ける工夫をします。ただし、読みやすさには十分注意してください。
同義語に置き換える: 重要なキーワードを同義語に置き換え、元の意味と文脈を保ちながら、より自然な文章にします。
情報源を 다양にする: 複数の情報源から情報を集め、内容が類似していると判断されるのを防ぎます。書籍、学術論文、ウェブコンテンツなど、 다양한な情報を取り入れることで、内容が豊かになります。
編集と校正を徹底する: 似たような文や表現の繰り返しなど、AI検出につながる箇所を修正します。手作業で修正することで、文章のトーンやスタイルを調整し、機械的なパターンをなくします。
引用を適切に利用する: 適切に引用することで、議論の根拠を示し、研究の完成度を高め、類似度スコアを下げることができます。

視覚的な要素を取り入れる: 画像、グラフ、表などを追加して、文章以外の要素を加え、オリジナリティを高めます。
徹底的に調査する: 深く調査することで、よりオリジナルのコンテンツを作成し、Turnitinとの一致の可能性を減らすことができます。十分な調査は、テーマへの理解を深め、引用や言い換えの過度な使用を防ぎます。
専門家の 도움을 청する: 独自のコンテンツ作成が難しい場合は、学術論文作成サービスなどの専門家の利用を検討してください。学術基準を満たし、AI検出を回避したオリジナルのコンテンツ作成のサポートを受けられます。
再提出を検討する: 担当教員の許可があれば、修正したレポートをTurnitinに再提出し、AIスコアが改善されたか確認します。再提出は、コースまたは学校の提出に関するポリシーに従ってください。
これらの対策を行うことで、Turnitin AIスコアを効果的に改善し、 академическое писањеの質を高めることができます。
よくある質問

Turnitinのスコアが36%はまずいですか?
Turnitinのスコアに良し悪しの基準はありません。36%という類似性スコアは、あなたの文章の36%が他のソースと一致していることを意味します。必ずしも悪いわけではありませんが、一致箇所や所属機関の規定によっては注意が必要です。一致した箇所を確認し、適切な引用が行われているか確認してください。
TurnitinはChatGPTを検出できますか?
はい、TurnitinはChatGPTのようなAIツールで生成された文章や、Quillbotのようなツールで言い換えられた文章も検出できます。AI検出機能により、AIが生成したコンテンツと、AIによる言い換えの両方を識別できます。
Turnitinの使い方は?
Turnitinを使うには、所属機関や先生の指示に従って、プラットフォームからドキュメントを提出してください。Turnitinが他のソースとの類似性を分析し、一致箇所をまとめたレポートが作成されます。
ChatGPTを使った場合、先生にバレますか?
ChatGPTの内容をそのままコピーして提出すると、Turnitinに検出される可能性が高いです。レポートにはAIが生成したコンテンツであることが示されますが、具体的なツール名は特定されません。
TurnitinのAIレポートで誤検出された場合はどうすれば良いですか?
Turnitinが誤ってAI生成と判定した場合(誤検出)、先生にレポートについて相談し、必要な証拠や修正を提出してください。また、Turnitinのインターフェースからフィードバックを送信することで、検出アルゴリズムの改善に協力できます。
結論
TurnitinのAI検出器の精度と限界についての議論は以上となります。
これで、Turnitinが検出できることとできないこと、そしてこれらの要素が皆さんの提出物にどう影響するか、より深く理解していただけたかと思います。
この情報が少しでもお役に立てれば幸いです。お読みいただき、ありがとうございました!