Avis sur le détecteur IA Compilatio, le détecteur institutionnel européen
Compilatio est le détecteur que les universités européennes souscrivent là où les synthèses américaines supposent Turnitin, conçu en France, utilisé par plus de 1 100 établissements dans plus de 50 pays, et le seul grand détecteur institutionnel qu’un étudiant peut exécuter sur son propre travail avant de le soumettre. Il affirme un taux de fiabilité de 94 à 99 % pour repérer le texte généré par IA et moins de 1 % de faux positifs. La seule étude évaluée par les pairs à l’inclure l’a classé deuxième sur 14 outils, et a conclu que les outils qu’elle testait n’étaient ni précis ni fiables. Voici ce que les preuves permettent d’établir.
Compilatio est le détecteur d'IA que les universités européennes souscrivent, là où les synthèses américaines supposent Turnitin. Il est conçu en France, il est présent dans le secteur du plagiat depuis plus de vingt ans, et son propre site indique plus de 1,100 établissements équipés dans plus de 50 pays. Si vous rédigez une thèse en France, en Belgique, en Suisse ou en Espagne, c'est souvent ce logiciel qui la lit.
Son affirmation de précision est spécifique, un "taux de fiabilité de 94 à 99%" pour détecter les passages générés par IA, avec "moins de 1% de faux positifs". La seule étude évaluée par les pairs à inclure Compilatio l'a classé deuxième sur quatorze outils, derrière Turnitin, et a conclu que les outils qu'elle testait n'étaient "ni précis ni fiables".
La deuxième place dans un domaine que les chercheurs ont jugé peu fiable est la tension dont traite cette analyse. Compilatio fait aussi une chose qu'aucun de ses concurrents institutionnels ne fait, il vend le même détecteur aux étudiants qui sont évalués, à partir de 4.99 euros.
Qu'est-ce que Compilatio, et qui l'utilise réellement ?
Compilatio vend quatre produits, répartis selon la personne qui détient le document. Magister est le vérificateur de similarité destiné aux enseignants. Magister+ y ajoute la détection d'IA, la détection de reformulation profonde, la détection multilingue et de traduction, ainsi que la vérification grammaticale. Studium est la version destinée aux étudiants, vendue en crédits. Compilatio Copyright vise les rédacteurs et éditeurs professionnels qui vérifient un travail avant publication.

L’entreprise indique plus d’un million d’utilisateurs, une présence dans plus de 50 pays, et précise que 95% des écoles se réabonnent chaque année. Ses serveurs sont en France, ce qui constitue un véritable argument de vente pour les institutions européennes qui évaluent les obligations du RGPD avant d’envoyer des travaux d’étudiants à un processeur américain, et c’est en partie pourquoi Compilatio occupe les systèmes francophones de la même manière que Turnitin occupe les systèmes anglophones.
Ce que Compilatio affirme au sujet de sa propre exactitude
La page du détecteur d’IA du fournisseur indique un « taux de fiabilité de 94 à 99% » pour la détection des passages générés par IA et « moins de 1% de faux positifs », la fourchette variant selon la longueur du document, la langue et le type de contenu académique. Elle précise que le détecteur couvre plus de 35 langues et reconnaît les productions de ChatGPT à travers GPT-5.2, GPT-5.1, GPT-5, GPT-4.5, GPT-4o et GPT-4o Mini, ainsi que Gemini, Claude, DeepSeek et Copilot. Le résultat parvient à l’enseignant sous la forme d’un pourcentage compris entre 0 et 100, estimant quelle part du document a été générée par une machine.
Sur son propre blog, l’entreprise replace ce chiffre dans son contexte, elle indique que son détecteur de 2023 atteignait « plus de 70% » de précision et affirme que la fiabilité a « augmenté de plus de 20% » depuis. C’est chose rare sur le site d’un détecteur, un fournisseur publiant les scores antérieurs de son produit.
Les avertissements sont eux aussi d’une franchise inhabituelle. Compilatio indique que « le pourcentage de contenu généré par IA doit toujours être interprété avec prudence et complété par une analyse humaine », que « les détecteurs d’IA ne peuvent pas prétendre être exacts à 100% », et que « le jugement final doit toujours revenir aux enseignants et aux étudiants ». Si l’on compare cela à des concurrents qui annoncent une certitude de 99% sans réserve, il s’agit de la présentation la plus honnête de cette catégorie. Cela reste un test du fournisseur, exécuté et rapporté par l’entreprise qui vend le produit.
Ce que montrent les preuves indépendantes
L’étude qui importe est Weber-Wulff et ses collègues dans l’International Journal for Educational Integrity, qui a testé quatorze systèmes, douze outils accessibles au public plus le duo commercial Turnitin et PlagiarismCheck. Sur le plan de la précision, l’article indique que "Turnitin a obtenu le score le plus élevé selon toutes les approches de classification de la précision, suivi de Compilatio et de GPT-2 Output Detector". La deuxième place sur quatorze est le meilleur classement indépendant obtenu par Compilatio.
Le verdict de l’article sur l’ensemble de la catégorie est plus sévère que ne le laisse entendre ce classement. Ses auteurs ont conclu que "les outils de détection disponibles ne sont ni précis ni fiables et présentent un biais principal vers la classification du texte comme rédigé par un humain plutôt que vers la détection de texte généré par IA", et que "les techniques d’obfuscation du contenu dégradent significativement les performances des outils". Un détecteur qui tend à qualifier un texte de rédigé par un humain paraîtra excellent pour les faux positifs et manquera le texte IA qu’il devrait détecter, ce qui constitue le compromis derrière une revendication de faux positifs inférieurs à 1%.
| Question | Ce que Compilatio publie | Ce qu’a établi le test indépendant |
|---|---|---|
| Fiabilité sur des passages IA | 94 à 99%, d’après les propres tests du fournisseur | Classé deuxième sur quatorze outils, dans une étude dont le constat global était que la catégorie n’est pas fiable |
| Faux positifs | Moins de 1% | Aucune valeur indépendante pour Compilatio, les outils testés étaient biaisés vers la qualification du texte comme rédigé par un humain |
| IA paraphrasée ou obfusquée | Magister+ commercialise la détection de "deep rephrasing" | L’obfuscation a "significativement dégradé" les performances de l’ensemble des outils testés |
| Langues | Plus de 35 | Non évalué indépendamment par langue |
Deux réserves vont en sens opposés, et toutes deux doivent figurer dans toute lecture honnête. Cette étude portait sur des modèles de l’ère 2023, elle ne dit donc rien sur la manière dont le détecteur actuel traite les sorties de GPT-5, et l’amélioration revendiquée par Compilatio de 20 points depuis lors n’y apparaîtrait pas. En revanche, la plus récente comparaison institutionnelle de grande ampleur, l’étude de 2026 de la Vrije Universiteit Brussel qui a soumis Pangram, GPTZero, Copyleaks et Turnitin à 160 longs articles universitaires, n’incluait pas Compilatio. Ainsi, son taux de 94 à 99% ne bénéficie d’aucune confirmation externe actuelle, dans un sens comme dans l’autre.
Humanisez votre propre article
Transformez votre texte assisté par IA et faites-le sonner humain, sans toucher aux mots importants ni aux citations.
La revendication sur le reformulation est la plus intéressante
La plupart des détecteurs vendent un seul chiffre. Magister+ en vend plusieurs, et les chiffres supplémentaires visent directement l’évasion. Il annonce une « détection de reformulation profonde », qu’il présente comme du plagiat sémantique, ainsi qu’une « détection des similitudes multilingues et des traductions » pour les travaux réécrits en rédigeant dans une langue puis en traduisant dans une autre. Il indique aussi le « pourcentage et l’emplacement des passages en "langue non reconnue" », ce qui correspond à la technique consistant à dissimuler des caractères à l’intérieur d’un document afin que le texte ne puisse pas être lu à l’œil nu.
Cet ensemble de fonctions vise directement les deux moyens les plus courants par lesquels les étudiants tentent de faire passer un contrôle de similarité, la paraphrase d’une source et sa traduction. Savoir si cela fonctionne au taux revendiqué est précisément ce qui n’a pas été testé de manière indépendante, et le constat de Weber-Wulff selon lequel l’obfuscation dégrade significativement la détection s’applique aux outils de cette époque plutôt qu’à cette fonction précise. Ce qu’il importe de comprendre dans tous les cas, c’est que la paraphrase et la détection de l’IA sont des problèmes distincts, traités dans whether Turnitin detects paraphrased text, et que les signaux qu’un classifieur lit réellement sont exposés dans how AI detectors work. Vérifier la variation des phrases d’un brouillon avec un free burstiness checker montre davantage ce à quoi un détecteur réagit qu’un pourcentage mis en avant par un fournisseur.
Tarification et accès, y compris la partie que Turnitin ne propose pas
Studium est vendu sous forme de crédits d’analyse, un crédit pour 250 mots, valables pendant six mois et utilisables sur plusieurs documents. Les packs sont de 20 crédits à 4.99 euros pour 5,000 mots, 80 crédits à 12.99 euros pour 20,000 mots, 160 crédits à 19.99 euros pour 40,000 mots, et 400 crédits à 34.99 euros pour 100,000 mots. Une première analyse partielle est gratuite, avec un aperçu des trois premières sources correspondantes. Les étudiants dont l’établissement est déjà abonné reçoivent 40 crédits gratuits par an, soit environ 10,000 mots.
Magister et Magister+ n’affichent aucun prix public. Les établissements demandent un devis, ce qui est standard pour cette moitié du marché.
Le point d’accès compte davantage que le prix. Un étudiant évalué par Turnitin ne peut pas exécuter Turnitin sur son propre brouillon au préalable, et un étudiant évalué par Copyleaks via son LMS ne peut généralement pas voir le rapport complet dont provient son score. Un étudiant dans un établissement Compilatio peut acheter la même vérification IA pour le prix d’un café et lire le résultat avant de soumettre quoi que ce soit. C’est le fait le plus utile en pratique dans cet examen.
La place de Compilatio dans le paysage des détecteurs
Compilatio est l’option institutionnelle européenne crédible, et elle se présente avec plus de prudence que la plupart de ses concurrents, une plage plutôt qu’un chiffre unique, un compte rendu publié de ce qu’elle a utilisé pour établir son score, et des instructions explicites indiquant que le pourcentage n’est pas un verdict. Ce sont des points en sa faveur.
La base de preuves reste toutefois plus mince que son empreinte de déploiement. Un seul placement évalué par les pairs, deuxième sur quatorze, face à des modèles de 2023, dans une étude qui jugeait l’ensemble de la catégorie peu fiable, est tout ce qui est établi de manière indépendante à son sujet. Le chiffre de 94 à 99% est celui du fournisseur lui-même, et la détection de reformulation et de traduction qui distingue Magister+ n’a fait l’objet d’aucun test externe. Rien de cela ne rend l’outil mauvais. Cela fait d’un pourcentage Compilatio une raison d’examiner de plus près plutôt qu’une preuve de quoi que ce soit, ce qui est précisément ce que dit sa propre documentation.
La question de l’équité s’applique ici comme partout dans cette catégorie, et elle pèse surtout sur les étudiants qui écrivent dans une deuxième langue, un schéma documenté dans pourquoi les détecteurs d’IA sont biaisés contre les rédacteurs non natifs en anglais. Si un score est utilisé contre un travail que vous avez rédigé vous-même, la réponse pratique est exposée dans comment prouver que vous n’avez pas utilisé d’IA, et le tableau plus large de la précision dans les détecteurs d’IA sont-ils précis.
La comparaison complète
Compilatio est l’un des dix détecteurs qu’un étudiant, un chercheur ou un correcteur est susceptible de rencontrer, et le schéma que cette analyse a mis en évidence, des chiffres du fournisseur affichés avec assurance au premier plan et un faible dossier indépendant en arrière-plan, se répète pour chacun d’entre eux. Pour voir comment il se compare à Turnitin, GPTZero, Copyleaks, Pangram, Originality.ai et aux autres selon le même critère fondé d’abord sur les preuves, consultez le guide complet AI detectors compared.
Questions fréquentes
Compilatio indique un taux de fiabilité de 94 à 99 % pour détecter les passages générés par IA et moins de 1 % de faux positifs, d’après ses propres tests, et précise que cette fourchette varie selon la longueur du document, la langue et le type de contenu. De manière indépendante, la seule étude évaluée par les pairs à l’inclure, Weber-Wulff et ses collègues dans l’International Journal for Educational Integrity, l’a classé deuxième sur quatorze outils derrière Turnitin, tout en concluant que les outils testés n’étaient ni précis ni fiables et avaient tendance à classer le texte comme rédigé par un humain. Cette étude utilisait des modèles de 2023, et aucune évaluation indépendante actuelle de Compilatio n’a été publiée.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.