
Ce que Pew Research a mesuré, et comment
Le Pew Research Center a passé au crible près de 490 000 pages web en anglais, collectées via l’archive Common Crawl entre janvier 2021 et juillet 2026. Chaque page a été soumise à Open Pangram, un détecteur d’IA open source, pour repérer les signes de rédaction ou de réécriture automatisée.
Sur un échantillon aléatoire de 10 000 pages datant de juillet 2026, 10 % montrent des signes significatifs de rédaction par IA, selon Pew Research. En ne conservant que les pages publiées après le lancement de ChatGPT fin 2022, la part grimpe à plus d’un tiers.
La tendance a démarré fin 2022 et ne s’est jamais interrompue depuis, portée ensuite par l’arrivée de Claude et de Gemini. Pas un pic isolé, donc, mais une trajectoire continue depuis près de quatre ans.
Pour un rédacteur ou un éditeur, le chiffre à retenir n’est pas le 10 % global, encore modeste, mais bien le tiers observé sur le contenu récent. C’est celui qui concerne directement ce que vous publiez aujourd’hui.
Le contenu IA n’est pas réparti de façon égale sur le web
Au lancement de ChatGPT, les signes de rédaction par IA apparaissaient à des taux similaires sur les principaux domaines de premier niveau : .com, .org, .edu, .gov. Ce n’est plus le cas.
En 2026, environ 10 % des pages en .com montrent des signes de rédaction par IA, contre 4,6 % en .org, et environ 1 % seulement en .edu ou .gov, soit dix fois moins que sur les domaines commerciaux.
L’écart s’explique en partie par la nature des sites eux-mêmes : sites marchands, médias et blogs d’entreprise publient en continu, avec une pression de production que les sites institutionnels ou universitaires ne connaissent pas de la même façon. LEPTIDIGITAL le documentait déjà avec l’étude Ahrefs sur l’impact de ChatGPT sur le web et le SEO.
Si votre site est en .com, comme la grande majorité des sites d’entreprise, vous évoluez statistiquement dans la zone la plus concernée. Ce n’est pas une accusation, c’est un contexte à connaître avant de publier.
Les tics qui trahissent le plus un texte écrit par IA
Pew a comparé les textes du web actuel à ceux de 2023 pour isoler les marqueurs stylistiques les plus révélateurs. Les tirets cadratins apparaissent aujourd’hui deux fois plus souvent. Les virgules d’Oxford ont progressé de 63 %.
Le vocabulaire type de l’IA a plus que doublé : crucial, delve (« explorer en profondeur »), interplay, testament, entre autres, reviennent nettement plus souvent qu’en 2023. Le tour « ce n’est pas seulement X, c’est Y » a presque triplé, même s’il reste globalement rare.
Cette liste dira sûrement quelque chose à tout rédacteur professionnel : elle recoupe presque terme à terme les mots que toute charte éditoriale sérieuse s’efforce déjà de bannir. Les outils qui promettent d’« humaniser » un texte généré par IA ont, sans le savoir, une feuille de route toute tracée.
Pew précise une limite méthodologique importante : un détecteur d’IA peut se tromper sur un document isolé. C’est à grande échelle, sur des centaines de milliers de pages, que ces tendances deviennent lisibles.
Ce que ça change pour vos contenus et votre référencement ?
Le contexte aide à comprendre pourquoi ces chiffres montent : environ la moitié des adultes américains utilisent désormais un chatbot IA, dont 24 % quotidiennement, selon une enquête Pew de juin 2026. Le volume de texte généré ou assisté par IA ne peut que suivre.
Cette dynamique confirme, chiffres à l’appui, ce que Google répète depuis des mois dans ses consignes sur le contenu people-first : l’automatisation n’est pas le problème en soi, la standardisation en est un. Un article qui ressemble à mille autres perd en visibilité, qu’il soit écrit par une IA ou par un humain pressé.
Sur ce terrain, une récente étude sur la visibilité des contenus dans ChatGPT pointait dans la même direction : les IA génératives citent plus volontiers un contenu qui apporte une information ou un point de vue qu’elles ne peuvent pas reproduire elles-mêmes.
Concrètement, traquer les tirets cadratins et les virgules d’Oxford dans vos propres textes est un bon exercice, mais le vrai chantier reste d’écrire quelque chose qu’une IA n’aurait pas pu écrire à votre place.
Notre verdict :
Le problème n’est pas que l’IA rédige, c’est ce qu’elle rédige quelque chose de réellement unique et pertinent. Les tics que Pew a isolés sont une chose, mais dans le fond, ce que les lecteurs souhaitent : c’est obtenir une information utile, peu importe qu’elle ait été en partie rédigée avec l’aide de l’IA ou non.

Fondateur de LEPTIDIGITAL et SUPASST, je suis également consultant spécialisé en acquisition de leads B2B (SaaS). Passionné par le marketing digital, l’intelligence artificielle et le SEO. Avant de devenir indépendant, j’ai occupé des postes clés en tant que SEO Manager et responsable e-commerce pour plusieurs grandes entreprises (Altice Media, Infopro Digital, Voyage Privé et le Groupe ERAM). Sur le plan perso, je suis un curieux insatiable, également passionné par la photographie, le badminton et les voyages. Pour toute demande de partenariat, privilégiez LinkedIn ou email ([email protected]).