Le signe révélateur du tiret cadratin, pourquoi ChatGPT en abuse
Ce qui cause réellement l'habitude de ChatGPT de s'appuyer sur le tiret cadratin, le rôle que joue ce signe dans une phrase, et ce vers quoi un éditeur humain se tourne à la place, une virgule, un deux-points ou un point.
Parfois, un responsable du recrutement enverra une lettre de motivation à un collègue avec une ligne ajoutée, vérifiez les tirets. Cette longue forme apparaît trois fois dans deux phrases, une fois comme une virgule, une fois comme deux points, et une fois comme un point final, le tout dans le même paragraphe. La petite habitude que possède chatgpt est celle où l’on voit le tiret avant de lire l’idée. Il est important de comprendre correctement cette habitude avant de tirer quelque conclusion que ce soit sur ce qu’elle signifie réellement. Ce réflexe, repérer le signe avant de lire l’argument, est en miniature l’habitude du tiret cadratin de chatgpt, et il vaut la peine de la comprendre correctement avant de décider de ce qu’elle prouve réellement.
Le tiret cadratin est le long tiret, plus long qu’un trait d’union et plus long que le tiret utilisé dans une plage de nombres, qu’un auteur insère au milieu d’une phrase pour remplir la fonction d’une virgule, de deux points ou d’un point final. ChatGPT l’utilise plus souvent que la plupart des textes édités, même si l’ampleur exacte de cet écart dépend de la version du modèle qui a produit le paragraphe que vous avez sous les yeux. Cet article se limite strictement à ce seul signe, ce qui provoque cette habitude, la fonction qu’il remplit réellement lorsqu’il apparaît, et ce qu’un éditeur humain met à la place.
Qu’est-ce qui provoque l’habitude du tiret cadratin de ChatGPT ?
Personne chez OpenAI n’a publié d’explication technique, mais une grande partie de ce que nous savons est due à une enquête indépendante, sans qu’un billet de blog de l’entreprise soit nécessaire. Un bon exemple est une analyse approfondie rédigée par l’ingénieur logiciel Sean Goedecke en octobre 2025. Au lieu de supposer, il a testé lui-même les théories simples. Il a essayé un modèle qui économisait des jetons en utilisant un seul signe au lieu d’une virgule. Mais une virgule est exactement aussi courte. Il a aussi essayé une préférence dialectale repérée à partir des retours de travailleurs humains, et a examiné un vaste échantillon de texte en anglais nigérian, un dialecte couramment associé à cette main-d’œuvre. En fait, il y apparaissait moins souvent que dans l’anglais moderne ordinaire, et non plus souvent.
La théorie que les propres tests de Goedecke ont laissée en place renvoie à un changement dans les données d’entraînement entre les versions du modèle. Il a constaté que cette habitude était à peine présente dans les sorties de GPT-3.5, puis environ dix fois plus fréquente une fois GPT-4o publié, ce qui renvoie à ce qui a changé dans l’ensemble d’entraînement plutôt qu’à l’architecture du modèle elle-même. Son hypothèse la plus plausible est celle de livres numérisés de la fin des années 1800 et du début des années 1900, une période où ce signe était inhabituellement fréquent dans l’anglais imprimé, bien au-dessus de son niveau dans l’écriture contemporaine. Personne en dehors des laboratoires qui ont entraîné ces modèles ne peut le confirmer. C’est la théorie la plus soigneusement testée disponible, non un fait établi.
Une autre ligne de recherche publiée en mars 2026 renvoie à une cause connexe qui mérite d’être nommée, à savoir la part du texte d’entraînement d’un modèle qui était formatée en markdown plutôt qu’en prose ordinaire, selon l’idée qu’une forte exposition à ce style de formatage laisse sa propre empreinte sur les choix de ponctuation en général. Le résumé honnête est que plusieurs explications sont plausibles, qu’une est raisonnablement bien testée, et qu’aucune n’est confirmée par l’unique partie qui pourrait réellement la confirmer.
Quel rôle le signe joue-t-il dans la phrase ?
Avant de choisir un remplacement, il est utile de nommer le rôle que joue le signe, car une virgule, un deux-points et un point ne sont pas interchangeables, pas plus que leurs substituts en tiret long. Quatre rôles couvrent presque tous les cas qu’un lecteur est susceptible de rencontrer.
| Ce que fait le tiret cadratin | Ce qu’un rédacteur humain utilise à la place | Exemple |
|---|---|---|
| Isoler une remarque incidente à l’intérieur d’une phrase | Une paire de virgules, ou des parenthèses | Le constat, reproduit deux fois, s’est maintenu dans les deux conditions. |
| Marquer un changement brusque ou une interruption nette | Un point et une nouvelle phrase | Le constat s’est maintenu dans les deux conditions. Il n’a pas survécu à une troisième. |
| Relier deux propositions indépendantes étroitement liées | Un point, ou un point-virgule lorsque le lien compte | L’échantillon était petit. L’ampleur de l’effet ne l’était pas. |
| Introduire une liste, un résumé ou une explication | Deux-points | Le résultat allait dans un sens: la réplication a échoué. |
Chacune de ces phrases était une phrase qui aurait pu utiliser ce signe et ne l’a pas fait. Ce texte est lui-même un argument selon lequel ce signe est un indice de machine, et il formule cet argument en n’utilisant jamais le caractère qu’il décrit, pas une seule fois, dans aucune phrase ci-dessus ou ci-dessous.
Humanisez votre propre article
Transformez votre texte assisté par IA et faites-le sonner humain, sans toucher aux mots importants ni aux citations.
La manie du tiret cadratin est-elle la même chez tous les chatbots ?
Non, et l’écart entre les systèmes est important. Un test avec le même prompt sur six chatbots au milieu de 2025, cité dans le guide plus large de TextPulse sur les schémas d’écriture de l’IA, a montré que trois systèmes produisaient ce signe environ une fois tous les soixante-dix mots et qu’un autre le produisait environ une fois tous les quatre cent soixante-dix mots, tandis que deux autres ne l’ont pas produit du tout dans l’échantillon. La fréquence est une propriété du système et de la version qui ont généré le paragraphe sous vos yeux, et non un trait fixe de l’écriture de l’IA en général.
OpenAI a déployé une correction partielle en novembre 2025: un réglage d’instructions personnalisées qui, une fois activé par l’utilisateur, indique au modèle d’arrêter. Sam Altman l’a annoncé lui-même, en le présentant comme une écoute enfin accordée à une plainte de longue date. Ce réglage est facultatif, et non activé par défaut, de sorte qu’une grande partie du contenu quotidien de ChatGPT n’a jamais été touchée par lui, et que cette habitude persiste partout où personne n’a pris la peine d’actionner l’interrupteur.
La réputation de cette marque comme indice d’IA est elle-même assez récente et quelque peu exagérée. Le retour de bâton a commencé vers février 2025, selon les commentaires qui l’ont suivi. Un article populaire sur cette tendance a noté qu’il n’y avait jamais eu de preuve solide que les chatbots utilisent cette marque plus souvent que ne le faisaient déjà les rédacteurs humains soigneux. Ces deux constats peuvent coexister, l’habitude est réelle et mesurable dans la production brute, et la certitude d’internet à la repérer à partir d’une seule phrase va bien au-delà des preuves réelles.
Comment vérifier votre propre brouillon pour cette habitude
Lisez un paragraphe à voix haute et marquez chaque endroit où apparaît un tiret long. Une occurrence sur une page est un choix stylistique, du genre que les rédacteurs humains font depuis des siècles. Plusieurs dans un seul paragraphe, surtout lorsqu’elles remplissent des fonctions différentes de celles du tableau ci-dessus, méritent un examen plus attentif. Cette densité est inhabituelle en dehors des productions d’IA et en dehors d’une poignée de stylistes qui utilisent délibérément beaucoup de tirets.
Le suppresseur gratuit de tirets longs de TextPulse vérifie automatiquement cette densité et propose, pour chaque occurrence, la virgule, les deux-points, le point ou une restructuration, selon ce qui convient, ce qui est plus rapide que de compter à la main dans un long document. La même collection d’outils gratuits couvre les autres niveaux qu’un paragraphe rédigé par une machine tend à signaler en même temps, le choix des mots, le rythme des phrases et la structure, pour une vérification qui va au-delà de la ponctuation seule.
Les phrases de remplissage font le même travail au niveau de la phrase, et il existe une liste de celles qu’il vaut la peine de supprimer en premier. Supprimer ce vocabulaire d’un brouillon que vous avez déjà rédigé adopte encore une autre approche.
Aucun de ces éléments n’exigeait de logiciel spécial pour être vérifié, seulement de l’attention et la volonté de relire la phrase. Cet article a fait le même choix tout au long de sa propre rédaction, recourir à une virgule, à deux-points ou à un point, et jamais une seule fois à la marque qu’il a passée quinze cents mots à décrire.
Questions fréquentes
L'habitude de ChatGPT avec le tiret cadratin vient surtout de ce qui a changé dans ses données d'entraînement entre les versions du modèle, et non d'un choix de conception délibéré. Des tests indépendants ont constaté que ce signe était beaucoup plus fréquent dans les sorties de GPT-4o que dans celles de GPT-3.5, et l'hypothèse principale renvoie à une forte exposition à d'anciens livres imprimés d'une période où ce signe apparaissait à un niveau inhabituellement élevé. OpenAI n'a pas publié sa propre explication, donc cela reste l'hypothèse la mieux étayée plutôt qu'un fait confirmé.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.