AI Detection

Compilatio AI Detector レビュー: 欧州の機関向け検出器

Compilatio は、欧州の大学がライセンスする検出器であり、米国の総覧が Turnitin を前提とするところで用いられる。フランスで開発され、50 以上の国の 1,100 校超で使用されており、学生が提出前に自分の作業を自ら実行できる主要な機関向け検出器としては唯一である。AI 文の検出について 94 から 99% の信頼性率、1% 未満の偽陽性を主張している。これを含んだ唯一の査読付き研究では 14 ツール中 2 位とされ、試験したツールは正確でも信頼できるものでもないと結論づけられた。以下に、証拠が支持する内容を示す。

8 min
Compilatio AI Detector Review: Europe's Institutional Detector

Compilatioは、欧州の大学がライセンスするAI detectorであり、米国の総覧ではTurnitinが想定される。これはフランスで開発され、20年以上にわたり plagiarism の分野にあり、同社サイトによれば、50以上の国で1,100校超が導入している。フランス、ベルギー、スイス、スペインで論文を書いているなら、これがその文章を読むソフトウェアであることが多い。

その精度の主張は具体的である。AI生成の文章を検出する「94 to 99% reliability rate」と、「less than 1% false positives」である。Compilatioを含む唯一の査読付き研究は、14のツールの中でこれをTurnitinに次ぐ第2位に位置づけ、検証したツールは「neither accurate nor reliable」であると結論づけた。

研究者が信頼できないと判断した分野での第2位という位置づけが、このレビューの論点である。Compilatioはまた、制度上の競合他社のどれも行っていないことを1つ行っている。それは、評価される学生に同じ detector を販売していることであり、価格は4.99 eurosからである。

Compilatioとは何か、そして実際に誰が使っているのか?

Compilatioは4つの製品を販売しており、文書を持っているのが誰かによって分かれている。Magisterは教員向けの類似性チェックツールである。Magister+は、その上にAI detection、deep rephrasing detection、多言語および翻訳 detection、grammar checkingを追加する。Studiumは学生向け版で、クレジット制で販売される。Compilatio Copyrightは、出版前に原稿を確認する専門の著者や編集者を対象としている。

Compilatio homepage headed Detect AI Content with Compilatio, listing a plagiarism checker and AI detector, with separate entry points for teachers, students and professional writers
Compilatioのホームページには、教員、学生、専門の著者という3つの入口がある。学生向けの入口が、これをTurnitinと分けるものである。

同社は、100万人超のユーザー、50か国以上での展開、そして学校の95%が毎年再契約していると報告している。サーバーはフランスにあり、これは学生の課題を米国の処理業者に送る前にGDPR上の義務を検討する欧州の機関にとって実質的な利点であり、Compilatioがフランス語圏のシステムに対して持つ位置づけは、Turnitinが英語圏のシステムに対して持つ位置づけに相当する理由の一部でもある。

Compilatioが自社の精度について主張していること

同社のAI detector pageには、AI生成の文章を検出する「94 to 99% reliability rate」と「less than 1% false positives」が記載されており、この範囲は文書の長さ、言語、学術コンテンツの種類によって変動するとされている。また、この検出器は35以上の言語に対応し、ChatGPTの出力をGPT-5.2、GPT-5.1、GPT-5、GPT-4.5、GPT-4o、GPT-4o Miniにわたって認識し、さらにGemini、Claude、DeepSeek、Copilotにも対応するとしている。結果は、文書のどの程度が機械生成であったかを推定する0から100の割合として、教員に示される。

同社は自社ブログでこの数値を文脈化しており、2023年の検出器は「over 70%」の精度であったと報告し、その後の信頼性は「increased by more than 20%」と述べている。これは検出器のウェブサイトとしては珍しいことであり、製品の過去の得点を公表するベンダーは少ない。

免責事項もまた、異例なほど直接的である。Compilatioは、「AI-generated contentの割合は常に慎重に解釈され、人間による分析で補完されるべきである」、「AI detectorsは100% accurateであると装うことはできない」、そして「最終判断は常に教育者と学生に委ねられるべきである」と述べている。これを、但し書きなしに99%の確実性を宣伝する競合他社と比べると、この分野ではより誠実な提示である。それでもなお、これはベンダーによる検証であり、製品を販売する会社自身が実施し、報告しているものである。

独立した証拠が示すこと

重要なのは、Weber-Wulff とその共同研究者による International Journal for Educational Integrity の研究であり、この研究では14のシステムを検証した。内訳は、公開されている12のツールに、商用の Turnitin と PlagiarismCheck を加えたものである。精度について、論文は「Turnitin は、精度分類のすべての手法を用いた場合に最も高いスコアを獲得し、Compilatio と GPT-2 Output Detector がそれに続いた」と報告している。14件中2位というのは、Compilatio が独立した検証で得た最良の順位である。

このカテゴリー全体に対する論文の結論は、その順位が示す印象よりも厳しい。著者らは、「利用可能な検出ツールは正確でも信頼できるものでもなく、AI生成テキストを検出するのではなく、出力を人間が書いたものとして分類する方向に強い偏りがある」と結論づけ、さらに「内容の難読化技術はツールの性能を著しく悪化させる」と述べている。テキストを人間が書いたものだと判定する方向に傾く検出器は、偽陽性では非常に優秀に見える一方で、本来検出すべき AI テキストを見逃すことになる。これが、1%未満の偽陽性率という主張の背後にあるトレードオフである。

質問Compilatio が公表している内容独立した検証で明らかになった内容
AI の文章に対する信頼性提供元自身の検証によれば、94から99%14ツール中2位に順位づけられたが、研究全体の結論は、このカテゴリーは信頼できないというものだった
偽陽性1%未満Compilatio についての独立した数値はない。検証されたツールは、テキストを人間が書いたものだと判定する方向に偏っていた
言い換えられた、または難読化された AIMagister+ は「deep rephrasing」の検出を売りにしている難読化は、検証されたツール全体で性能を「著しく悪化させた」
言語35以上言語ごとの独立したベンチマークは行われていない
提供元の数値は Compilatio の AI detector ページによる。独立した知見は Weber-Wulff ら, International Journal for Educational Integrity, 2023 による。

2つの留保は逆方向に働き、いずれも誠実な読解には含めるべきである。その研究は2023年時点のモデルを対象としていたため、現在の検出器がGPT-5の出力をどのように扱うかについては何も示しておらず、また、それ以後にCompilatio自身が主張する20ポイントの改善もそこには現れない。これに対して、最も新しい大規模な機関間の直接比較である、2026年のVrije Universiteit Brusselの研究では、Pangram、GPTZero、Copyleaks、Turnitinを160本の長い学術論文にかけたが、Compilatioは含まれていなかった。したがって、その94から99%という数値についても、現時点で外部からの確認はどちらの方向にもない。

自分の論文を人間らしくする

重要な語句や引用には手を加えずに、AI支援テキストを変換して自然な人間の文章のようにします。

無料で始める

言い換えの主張こそが興味深い

多くの検出器は1つの数値を売りにしている。Magister+は複数の数値を売りにしており、追加のものは回避を直接対象としている。同製品は「deep rephrasingの検出」を宣伝しており、これは意味的盗用として位置づけられている。さらに、1つの言語で下書きし、それを別の言語に翻訳することで書き換えられた成果物に対する「多言語類似性, 翻訳の検出」も掲げている。また、「認識されない言語」部分の割合と位置も報告するとしており、これは文書の中に文字を隠し、肉眼ではテキストを読めなくする手口である。

この機能群は、学生が類似性チェックをすり抜けようとするときに最もよく用いる2つの方法、すなわち、出典の言い換えと翻訳に正面から向けられている。それが主張される割合で機能するかどうかは、まさに独立した検証が行われていない点であり、また、Weber-Wulffの発見である、難読化が検出を有意に悪化させるという結果は、この特定の機能ではなく当時のツールに当てはまるものである。いずれにせよ理解しておく価値があるのは、言い換えとAI検出は別個の問題であり、その点はTurnitinが言い換えられたテキストを検出するかどうかで扱われていること、そして分類器が実際に読むシグナルはAI検出器の仕組みで示されていることである。下書き自体の文の変化を無料のburstiness checkerで確認すると、ベンダーの見出しの数値よりも、検出器が何に反応するかについて多くを示す。

価格と利用方法, Turnitin が提供しない部分を含む

Studium は分析クレジットとして販売されており, 250語ごとに1クレジット, 有効期間は6か月で, 複数の文書にまたがって使用できる。パックは, 5,000語向けの20クレジットが4.99ユーロ, 20,000語向けの80クレジットが12.99ユーロ, 40,000語向けの160クレジットが19.99ユーロ, 100,000語向けの400クレジットが34.99ユーロである。最初の部分的分析は無料で, 上位3件の一致ソースをプレビューできる。所属機関がすでに契約している学生には, 年間40クレジット, およそ10,000語分が無料で付与される。

Magister と Magister+ には公表価格がない。機関が見積もりを依頼する方式であり, これは市場のこの半分では標準的である。

利用可能性の入口は, 価格よりも重要である。Turnitin によって評価される学生は, 自分の下書きに対して事前に Turnitin を自分で実行することはできないし, LMS を通じて Copyleaks によって評価される学生は, 通常, そのスコアの根拠となった完全なレポートを見ることができない。Compilatio の機関に所属する学生は, コーヒー1杯分の価格で同じ AI チェックを購入し, 何かを提出する前に結果を読むことができる。これが, このレビューにおいて実際に最も有用な事実である。

Compilatio が検出ツールの状況の中でどこに位置するか

Compilatio は, 信頼できる欧州の機関向け選択肢であり, 多くの競合よりも慎重に自らを提示している。すなわち, 単一の数値ではなく範囲を示し, 何を用いて採点したかについて公表された説明があり, その割合は判定ではないと明示している。これらは同社に有利な点である。

しかし, 証拠基盤は導入規模よりもなお薄い。独立に確立されている事実は, 2023年モデルに対する14件中2位という査読付きの配置が1件あることだけであり, その研究自体がこのカテゴリ全体を信頼できないと判断している。94から99%という数値はベンダー自身のものであり, Magister+ を特徴づける言い換えと翻訳の検出には外部試験がまったくない。とはいえ, そのことはこのツールが悪いことを意味しない。Compilatio の割合は, 何かの証明ではなく, さらに詳しく見る理由である, ということを意味するのであり, それは同社自身の文書が述べていることである。

公平性の問題は、ここでもこのカテゴリ全体でも当てはまり、第二言語で書く学生に最も強く及びます。この傾向は、AI検出器が非ネイティブの英語話者に対して偏っている理由で文書化されています。自分で書いた作品に対してスコアが不利に用いられる場合、実際の対応はAIを使っていないことを証明する方法に示されており、より広い正確性の全体像はAI検出器は正確かにあります。

完全な比較

Compilatioは、学生、研究者、採点者が出会う可能性のある10個の検出器の一つであり、このレビューが見いだした傾向, すなわち、前面には自信に満ちたベンダーの数値があり、その背後には薄い独立した記録があるという傾向は、それらすべてに共通して繰り返されます。Turnitin, GPTZero, Copyleaks, Pangram, Originality.ai, そしてその他のものと、同じ証拠優先の基準でどのように比較されるかについては、完全なAI detectors comparedガイドを参照してください。

XLinkedInFacebook

よくある質問

Compilatio は、AI 生成の一節を検出する信頼性率として 94 から 99% を示し、偽陽性は 1% 未満であると述べている。これは自社試験に基づくものであり、この範囲は文書の長さ、言語、内容の種類によって変動するとしている。独立したものとしては、これを含んだ唯一の査読付き研究である Weber-Wulff とその共同研究者による International Journal for Educational Integrity の研究があり、14 のツールのうち Turnitin に次ぐ 2 位に位置づけた一方で、試験したツールは正確でも信頼できるものでもなく、テキストを人間作成と分類する傾向があったと結論づけた。この研究は 2023 年時点のモデルを用いており、Compilatio の現在の独立試験は公表されていない。

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

AI人間化の最新情報を受け取る

学術ライティング、AI検出、そして人間化に関するヒントを、受信箱へお届けします。

スパムはありません。いつでも配信停止できます。