Selon une récente étude publiée par l’agence Graphite, le modèle de langage Claude Opus 5.5 d’Anthropic adopte un style de rédaction nettement plus proche de l’écriture humaine que ses prédécesseurs. Malgré une diminution spectaculaire de certains tics visuels comme le tiret cadratin, l’intelligence artificielle conserve encore de nombreuses empreintes linguistiques caractéristiques.
Un style plus fluide et moins artificiel
L’analyse menée sur un corpus de près de 10 000 sujets montre une nette progression vers un langage plus naturel. La divergence de Jensen-Shannon, qui mesure l’écart de vocabulaire entre la machine et l’humain, diminue de 19 % par rapport à Claude Opus 5, atteignant 0,052. En comparaison, le modèle concurrent GPT-6 Astra d’OpenAI affiche un écart plus marqué avec un score de 0,109.
Anthropic est également parvenue à réduire le style alambiqué de sa prose. Le score mesurant les fioritures et métaphores superflues passe de 16,75 pour Opus 5 à 10,57 pour Opus 5.5, soit une baisse de 37 %. Même si ce chiffre reste 1,6 fois supérieur à la moyenne des auteurs humains (6,65), le progrès demeure notable. La quasi-disparition des tirets cadratins (-99 %) élimine aussi l’un des repères visuels les plus évidents d’un texte généré par IA.
Des milliers de tics de langage persistants
Malgré ces améliorations d’ensemble, l’intelligence artificielle n’a pas entièrement effacé sa signature. Les chercheurs ont identifié 2 548 tournures de phrases employées au moins deux fois plus souvent par Claude Opus 5.5 que par des rédacteurs humains. Ce chiffre n’enregistre qu’une faible baisse de 4 % par rapport à la version précédente.
Certaines expressions s’avèrent particulièrement révélatrices dans les textes rédigés en anglais par le modèle :
- La formule « this matters » (« c’est important ») apparaît 116 fois plus souvent chez l’IA que sous la plume d’un humain.
- La structure « why _ matters » (« pourquoi _ compte ») est 92 fois plus fréquente.
- L’expression « looking ahead » (« pour la suite ») est utilisée 40 fois plus.
- L’adjectif « dependable » (« fiable ») revient 23 fois plus fréquemment.
Le vocabulaire a également évolué vers un ton plus serviable, illustré par la formule « can help you », huit fois plus présente qu’auparavant.
La détection d’IA face au jeu de la taupe
Ces résultats illustrent le défi permanent auquel font face les concepteurs de modèles linguistiques et les développeurs d’outils de détection comme Pangram. Comme le souligne le média Gizmodo, l’élimination des défauts les plus visibles d’une IA ressemble souvent à un jeu de la taupe : corriger une habitude linguistique en fait généralement émerger de nouvelles.
Afin de permettre à d’autres équipes de chercheurs de vérifier ces observations, l’agence Graphite a mis l’ensemble de ses données brutes en libre accès. Ces informations permettront de mesurer l’efficacité réelle des détecteurs automatiques face aux évolutions constantes des générateurs de texte.