AI Humanization

QuillBotはTurnitinを回避できるか

Turnitinは、そのAI指標がすでに言い換えられたテキストと人間化されたテキストを対象にすると主張している。QuillBotは、自社の書き換えツールについて回避を主張していない。これら二つの立場の間に何があり、提出しようとしている文書にとってそれが何を意味するのか。

6 min
Comparison panel showing does turnitin detect quillbot, mapping QuillBot's paraphraser, humanizer and detector against Turnitin's two reports

QuillBotは、自社のHumanizerがTurnitinを上回るとは主張していない。自社の製品ページを確認すると、Humanizerはリライト機能として説明され、別個のAI DetectorはAI生成コンテンツを検出するツールとして説明されており、いずれにも正確性の割合や検出回避の主張は付されていない。一方でTurnitinは、同じ領域の反対側を主張している。この二つの立場の距離こそが、この問いが実際に位置する場所である。

では、TurnitinはQuillBotを検出するのか。Turnitinには、どのツールが文書に手を加えたのかを知る方法はなく、またそれを調べようともしない。そのAI writing indicatorは、文章が機械生成テキストの統計的パターンにどれほど近いかに基づいて採点する。QuillBotを一度通した文章は、それらのパターンをどれだけ変えたかに応じて、他のどのツールによるリライトと同様に、フラグが付くこともあれば付かないこともある。

TurnitinはQuillBotを検出するのか, 各社の見解

Turnitinからの答えは明確であり、公表されている。自社の助言では、AI paraphrasing toolで言い換えられたコンテンツを検出できるかという問いに答えている。その回答は、「はい, TurnitinのAI indicatorには、word spinner/AI paraphrasing toolを用いて言い換えられた可能性のあるAI生成コンテンツの検出が含まれます」である。humanizersとbypassersについても同じように答えている。これは、自社製品についてのベンダーの主張であり、数値を付さずに公表されている。

QuillBotは、反対方向の一致する主張をしていない。2026年8月時点で自社の料金ページと製品ページを読む限り、Humanizerには正確性の割合も、いかなる検出ツールを打ち負かすという記述もなく、AI DetectorはAI生成コンテンツを検出するツールとしてのみ説明されている。この分野の競合の中には、自社サイトで検出回避の保証を宣伝しているものも複数ある。QuillBotはその中には含まれない。

この二つの立場は互いに両立する。Turnitinは、自社のモデル内で言い換えられた文章と人間化された文章を対象に含むと主張している。QuillBotは、リライトツールであると主張し、それ以上は述べていない。どちらの記述も、特定の一つの文書に何が起こるかを学生に教えるものではない。だが、この問いをする人が実際に知りたいのは、その部分である。

QuillBotのツールは相互に代替可能ではない

この問題には、QuillBotの3つの別個の機能が関わっている。これらはそれぞれ、検出器から見たときに異なる動作をする。Paraphraserは、文章内の語や短い句を、同じ内容を別の言い方で表す形に変える。AI Humanizerは、QuillBot Premiumの一部として提供され、AIによって生成された特定の文書に向けた書き換えの一種である。AI Detectorは、貼り付けられたテキストを判定するチェック機能である。これは、いずれの書き換えツールとも関係がない。

この違いは、2つの書き換えツールと検出器の間に当てはまる。段落をQuillBot独自のAI Detectorに通して低い結果が出たとしても、それはTurnitinが同じ段落を判定したときに何を示すかについては何も意味しない。2つの検出器は、2つの異なるしきい値を持つ、別々に学習された2つのモデルであり、同じテキストに対してしばしば異なる判断を示すため、どちらの結果も他方を予測しない。

無料版には、知っておくべきサイズ制約もある。QuillBotの無料のHumanizerは、1回の送信を125語に制限しており、1日あたりの使用回数も少ない。Turnitinは、AIスコアを生成する前に、少なくとも300語の条件を満たす散文を必要とする。125語ずつに分けて課題全体を書き換える学生は、Turnitinがそれを1つの連続した送信として採点する文書を組み立てていることになり、その際、各部分の継ぎ目をまたいで重なり合う区間で判定される。

QuillBotによる処理がTurnitinレポート内で変えるもの

Turnitinは2つの独立したレポートを生成し、書き換え処理はそれらに対して非常に異なる形で反映される。Turnitinは、AIの割合は「類似性スコアとは異なり、独立している」と明言しており、AIによる文章の強調表示はSimilarity Reportにはまったく表示されないとしている。全体の比較は、Turnitinの類似性スコアとAIスコアの比較で詳しく述べている。

Similarity Report に対しては、言い換えの処理が実際に機能する。類似性チェックは、提出物をウェブページ、出版物、過去に提出された論文のリポジトリと照合し、一致するテキストを報告する。語を置き換えると、その一致が崩れる。これこそが QuillBot の Paraphraser が行うために作られた仕事であり、この製品カテゴリが存在する理由である。

AI writing indicator に対しては、同じ処理が扱えるものがはるかに少ない。そのモデルは、そもそもその段落を別の文書と比較していない。各文を、機械生成文のパターンにどれだけ近いかで文ごとに採点し、その後、そのスコアをセグメント全体で平均する。語の置換では、文の長さ、節の順序、接続語の選択はおおむね元のままであり、まさにそれらが採点対象となっている特徴である。

QuillBot の機能機能の内容Turnitin レポートへの影響
Paraphraser語と短い句を置き換える類似性の一致を減らせる場合がある, AI indicator への影響は小さい
AI HumanizerAI が下書きしたテキストを書き換える, Premium 機能書き換えで文構造が実際にどれだけ変わったかによる
AI Detector貼り付けたテキストに対する独自の推定値を報告するなし。Turnitin の数値には影響しない別のモデルである
Grammar and fluency checks機械的な誤りを修正するなし。Turnitin の AI モデルは正確さではなくパターンを採点する

自分の論文を人間らしくする

重要な語句や引用には手を加えずに、AI支援テキストを変換して自然な人間の文章のようにします。

無料で始める

なぜ答えは論文ごとに異なるのか

2 人の学生が同程度の下書きを同じ QuillBot の機能に通したとしても、Turnitin のスコアは大きく異なることがある。その理由は QuillBot ではなく Turnitin の処理系の内部にある。割合は、文書全体にわたるセグメント単位のスコアの平均であるため、文書のどれだけの部分が書き換えられたかは、単一の段落がどれだけうまく書き換えられたかと同じくらい結果を左右する。

この数値は、書き換えとは無関係な条件にも左右される。Turnitin は、300語未満の条件を満たす散文では AI の割合を表示しない。20パーセント未満では、その範囲では偽陽性がより多いため、正確な数値の代わりにアスタリスクを表示する。また、機関側で AI writing 機能がそもそも有効になっていなければならず、管理者は設定ページからアカウント全体でこれを無効にできる。

いずれも独立した調査結果ではなく Turnitin が公表している数値であり、どちらも個々の文については明確に不確実なモデルを示している。Turnitin の精度数値もこの文脈に含めるべきである。Turnitin は、AI writing が20パーセント以上の文書について、文書レベルの偽陽性率が1パーセント未満であり、文レベルの偽陽性率は約4パーセントであると述べている。

提出前にこれをどう扱うか

上記のいずれも、QuillBot による書き換えで Turnitin のチェックを通過できるとは述べていないし、どちらの製品についても正確な説明であればそうは言えない。Turnitin は、自社のモデルが人間らしく整えられた文章とパラフレーズされた文章を対象にしていると述べている。QuillBot は、自社のツールが書き換えを行うと述べている。どちらの会社も、特定の文書がどのようなスコアになるかを約束できる立場にはなく、あるツールが検出器を打ち負かすという主張は、事前には誰にも観察できない結果を述べているにすぎない。

より有用な問いは、その書き換えが文章そのものに何をしたかである。語彙を入れ替え、すべての文の長さを同じままにした処理は、分類器が測定するものには触れずに、段落の読み味だけを変えている。free AI word cleaner は、下書きにまだ残っている定型語を示してくれるが、どのスコアがどうであれ、人間の読者のためには修正する価値がある。

同義語への置換が専門用語を損なう箇所や、このツールが本当にどのような利用者に適しているかを含め、QuillBot の Humanizer を製品として評価する場合は、QuillBot humanizer review が別途扱っている。この記事は Turnitin の問題にのみ焦点を当て、それ以外は扱わない。

Turnitin の AI スコアを動かす編集は構造的なものである。すなわち、変化する文の長さ、移り変わる節の順序、削除されるヘッジ表現、そしてモデルが生成できるはずのなかった具体的な内容である。その作業は、AI text を humanize する方法のガイドで段階的に示されており、最初の処理をどのツールが行ったかにかかわらず、同じ作業である。

TextPulse の AI humanizer は、これらの構造的編集を文書全体に適用し、Turnitin が示す内容の予測ではなく、テキスト自体から算出された推定 Human Score を報告する。どのツールも他社のモデル内部を見ることはできず、それが可能だと主張する製品は、実際には持っていない確実性を売っているのである。

Grammarly は同じ問いに別の答えを与えるが、その比較は別ページに置かれている。パラフレーズツールは、学術ドラフトにおいて、より静かな問題も生む。すなわち、参考文献一覧と一致しなくなる本文中引用である。

いかなる書き換えツールが何を報告しても、採点者が問うのはソフトウェアではなく作業そのものである。下書きの履歴、メモの一式、開かずに内容を説明できる資料、これらの証拠は、実際に作業を行った者なら誰でも利用でき、割合が示されない日にも有効である。

私たち自身の研究でわかったこと

TextPulse Research の検出器一致性研究では、9つの商用AI検出器が同じ90本の学術テキストを評価しました。そのひとつが455語のハイブリッドテキストで、人間が書いた冒頭と結びの間に168語のAI生成部分を挟んだものです。QuillBot はこのテキストを 13% AI と判定しましたが、同じ文章に対する他のツールの判定は 0% から 95.7% までばらつきました。論文全文、コーパス、ツール別スコア行列は TextPulse Research で公開されています。

研究コーパスのハイブリッドテキストに対する QuillBot の判定。
研究コーパスのハイブリッドテキストに対する QuillBot の判定。
XLinkedInFacebook

よくある質問

Turnitinは、どのツールが文書を編集したかを特定できない。そのため、TurnitinはQuillBotを検出するかという問いへの答えは、ツールではなく文章そのものに依存する。Turnitinは、そのAI指標が、ワードスピナーまたはAI言い換えツールで言い換えられた内容と、ヒューマナイザーまたはバイパサーを通した内容を対象にすると述べている。報告されるのは条件を満たすテキストの割合であり、ツール名ではない。

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

AI人間化の最新情報を受け取る

学術ライティング、AI検出、そして人間化に関するヒントを、受信箱へお届けします。

スパムはありません。いつでも配信停止できます。