Ce qu’on a mesuré sur 199 articles
Le score moyen de citabilité IA du blog de Peechy est passé de 70,8 à 85,9 sur 100 lors d’un passage complet sur 199 articles, réalisé le 27 août 2026. Trois manques structurels expliquaient l’écart : sources de premier rang absentes, définitions non formatées pour l’extraction, sections qui ne se comprenaient pas hors contexte.
On ne parle pas ici d’une métrique publiée par Google ou par OpenAI. Il n’existe pas, à ce jour, de score officiel de “citabilité” accessible publiquement : ni ChatGPT, ni Perplexity, ni les AI Overviews de Google ne communiquent de note par page. Ce que Peechy mesure, c’est une grille interne construite à partir des critères que les moteurs génératifs utilisent effectivement pour choisir leurs sources, documentés côté Google et étudiés côté recherche académique. Trois seuils reviennent systématiquement : la présence de sources vérifiables et faisant autorité, des définitions formatées pour être extraites telles quelles, et des blocs de texte qui tiennent debout sans le reste de l’article.
Sur les 199 articles passés en revue, la note moyenne a gagné 15,1 points. Pas uniformément : certains articles de dépannage technique, déjà truffés de valeurs précises (limites PHP, codes d’erreur, seuils de cache), sont montés à 90 ou plus. D’autres, plus proches de l’essai d’opinion, plafonnent autour de 80 parce qu’ils reposent sur des jugements et des retours d’expérience impossibles à sourcer sans les inventer.
Les trois seuils qui décident si un moteur te cite
Un moteur génératif ne lit pas une page comme un humain. Il découpe le contenu en fragments, évalue chaque fragment séparément, et décide fragment par fragment s’il mérite d’être cité. Trois éléments pèsent le plus dans cette décision.
Des sources de premier rang, pas des articles qui en parlent
Une source de premier rang désigne un document primaire (documentation officielle d’un éditeur, texte réglementaire, étude publiée) plutôt qu’un article qui la commente ou la vulgarise. Citer la documentation de Google Search Central plutôt qu’un blog qui la résume donne un signal de fiabilité que le moteur peut vérifier lui-même en remontant à la source.
Google confirme d’ailleurs que ses systèmes d’IA utilisent une technique de “query fan-out” : une seule question posée par l’utilisateur déclenche plusieurs recherches sous-jacentes sur des sous-thèmes distincts, chacune pouvant remonter des sources différentes source : Google Search Central, AI Features documentation. Le query fan-out est le mécanisme par lequel une requête unique se transforme en plusieurs requêtes parallèles, chacune capable de faire remonter une page précise pour une sous-question précise plutôt que pour le sujet global.
Des définitions formatées pour être extraites
Un moteur génératif cherche des définitions qu’il peut recopier sans reformuler, parce que reformuler introduit un risque d’erreur factuelle. Le format qui fonctionne le mieux : terme en gras, immédiatement suivi du verbe qui définit (“désigne”, “est”, “correspond à”), sans détour. “L’accessibilité web, c’est important pour tout le monde” ne se cite pas. “L’accessibilité web désigne l’ensemble des pratiques qui rendent un site utilisable par les personnes en situation de handicap” se cite, parce que la phrase est autonome et directement copiable.
Des sections qui tiennent seules
Une section auto-portante est un bloc de texte qui reste vrai et compréhensible sans le reste de l’article, généralement parce qu’il associe une affirmation à une source et, quand c’est pertinent, à un chiffre précis. Une analyse du pipeline de sélection des AI Overviews avance que Google réduit un pool de 200 à 500 documents candidats à seulement 5 à 15 sources finalement citées, via un filtrage sémantique puis un re-classement au niveau du passage source : ziptie.dev, 2026. Cette même analyse observe que seulement 38 % des pages citées par AI Overviews figurent aujourd’hui dans le top 10 organique classique, contre 76 % un an plus tôt : le classement Google traditionnel et la citation par l’IA divergent de plus en plus. Cette phrase, prise isolément, reste vraie et compréhensible : c’est exactement ce qu’un moteur extrait pour construire sa réponse.
La cause racine : 125 articles sans aucune source
Sur les 199 articles audités, 125 ne comportaient aucune source externe. Pas une source mal choisie, pas une source secondaire : zéro lien vers un document vérifiable. La cause n’était pas éditoriale, elle était mécanique : le générateur de contenu sautait l’étape de recherche web à chaque fois que le gabarit d’article ne l’exigeait pas explicitement.
Concrètement, les gabarits de dépannage technique (“erreur 500”, “site lent”, “mémoire PHP épuisée”) intégraient une consigne de recherche parce que le sujet s’y prêtait naturellement : citer la documentation PHP ou WordPress.org est un réflexe pour ce type de contenu. Mais des gabarits plus orientés stratégie ou opinion (“pourquoi choisir tel modèle”, “les signaux d’alerte avant de signer”) ne comportaient pas cette consigne, et le générateur produisait alors un texte entièrement fondé sur le raisonnement interne, sans jamais aller chercher un chiffre externe pour l’étayer.
Ce point mérite d’être isolé parce qu’il touche à un biais assez répandu dans la production de contenu assistée par IA : un modèle de langage peut écrire un paragraphe qui a toutes les apparences de la rigueur (formulation assurée, structure logique, vocabulaire technique) sans qu’aucune des affirmations qu’il contient ne soit vérifiable. La note de citabilité ne sanctionne pas le manque de qualité rédactionnelle, elle sanctionne le manque de traçabilité. Un article bien écrit mais sans source reste, du point de vue d’un moteur génératif, un contenu qu’il ne peut pas se permettre de citer sans risque.
La correction a consisté à rendre la recherche web obligatoire pour tous les gabarits, pas seulement ceux qui s’y prêtaient visiblement. Ce changement seul explique la majeure partie du gain de 15,1 points, parce qu’il touchait le tiers des articles du blog qui, jusque-là, ne pouvaient statistiquement pas être cités faute de matière citable.
L’outillage de vérification : ce qui compte, ce qui ne compte pas
Une fois la règle “recherche obligatoire” mise en place, encore fallait-il vérifier que chaque article respectait effectivement les trois seuils, et pas seulement qu’il contenait un lien externe au hasard. Le contrôle qualité, chez Peechy, s’effectue après la rédaction, avec Claude configuré pour appliquer une checklist explicite plutôt que pour juger “à l’instinct” si le texte semble sérieux.
La checklist vérifie point par point :
| Critère | Seuil demandé | Ce qui est rejeté |
|---|---|---|
| Domaines de premier rang | 2 minimum, distincts | Deux liens vers le même domaine, ou des sources secondaires uniquement |
| Définitions formatées | 2 minimum | ”X, c’est…” au lieu de “X désigne…” |
| Sections auto-portantes | 3 minimum | Une phrase qui a besoin du paragraphe précédent pour être vraie |
| Statistiques citées | Systématique | Un chiffre sans lien vers sa source juste après |
| Liens internes | 3 minimum | Des liens hors contexte, plaqués en fin d’article |
Ce que cet outillage ne fait pas : il ne vérifie pas la véracité du contenu de la source citée, seulement sa présence et sa nature (premier rang ou non). Il ne garantit pas non plus qu’un moteur génératif choisira effectivement de citer l’article : la checklist optimise les conditions nécessaires, pas le résultat final, qui dépend aussi de la requête posée par l’utilisateur, de la concurrence sur le sujet, et du comportement du moteur au moment T. Cette distinction entre “conditions réunies” et “citation garantie” est justement ce qui empêche de vendre un score comme une promesse.
L’étude fondatrice sur le sujet, menée par des chercheurs de Princeton et publiée à la conférence KDD 2024, a testé neuf tactiques de contenu sur des moteurs génératifs et mesuré des gains de citation allant jusqu’à 40 % selon les tactiques combinées, avec un effet particulièrement marqué pour l’ajout de statistiques et de citations sourcées plutôt que pour les techniques classiques de SEO comme la densité de mots-clés source : Aggarwal et al., GEO: Generative Engine Optimization, KDD 2024. C’est cette logique, optimiser au niveau du fragment de texte plutôt qu’au niveau de la page entière, qui sous-tend toute la checklist utilisée sur le blog.
Pourquoi le plafond honnête est entre 85 et 88, pas 100
Un score de 100/100 n’est pas un objectif réaliste, et le prétendre serait mentir au lecteur. Deux raisons structurelles l’expliquent, l’une propre au contenu de Peechy, l’autre propre au fonctionnement des moteurs génératifs eux-mêmes.
La première raison : certaines des données les plus utiles d’un article, comme une fourchette de prix de première main (un site à 900 euros, un projet à 15 000 euros, un accompagnement à 30 000 euros), constituent statistiquement des chiffres non sourcés au sens strict du terme. Elles viennent de l’observation directe du marché par l’agence, pas d’une étude publiée avec une méthodologie citable. Les sourcer artificiellement, en accolant un lien vers une étude qui ne mesure pas exactement la même chose, serait plus malhonnête que de les laisser sans source et d’assumer qu’elles perdent quelques points de citabilité. Le choix a été de préserver l’exactitude plutôt que de maximiser le score.
La seconde raison est propre à l’architecture même des moteurs génératifs : ils ne sont pas déterministes. Un système de query fan-out qui déclenche plusieurs sous-requêtes pour une même question ne remontera pas systématiquement les mêmes sources d’une exécution à l’autre, et des travaux de recherche récents ont documenté que les moteurs génératifs développent des préférences de sources et des comportements de citation propres, distincts de ceux de la recherche web traditionnelle, ce qui les rend en partie imprévisibles et parfois manipulables source : Exposing Citation Vulnerabilities in Generative Engines, arXiv, 2025. Aucune méthode de rédaction, aussi rigoureuse soit-elle, ne peut garantir qu’une page précise sera citée à chaque requête pertinente : le système lui-même n’offre pas cette garantie.
Pour situer le niveau atteint, le premier baromètre français dédié à la citabilité IA, publié en avril 2026 par Reworld MediaConnect sur un panel de 377 marques françaises disposant de budgets et de contenus conséquents, a mesuré un score moyen de seulement 64,6 sur 100 source : Baromètre GEO, Reworld MediaConnect, avril 2026. Un score de 85,9 se situe donc largement au-dessus de la moyenne observée chez des acteurs pourtant mieux dotés en ressources, ce qui contextualise pourquoi chercher à dépasser 88 relèverait de rendements très rapidement décroissants, voire de compromis sur l’exactitude des chiffres publiés.
Ce que ça change pour un site qui n’a pas 199 articles
Le raisonnement s’applique à n’importe quel site, pas seulement à un blog volumineux. Trois vérifications simples, sans outillage complexe, permettent d’estimer où se situe un contenu par rapport aux trois seuils.
- Chaque page contient-elle au moins un lien vers une source primaire (documentation officielle, texte réglementaire, étude) plutôt qu’un article qui en parle ?
- Les définitions de termes techniques sont-elles écrites comme des phrases autonomes, copiables telles quelles, ou noyées dans une phrase narrative ?
- Un paragraphe pris isolément, sans le reste de l’article, reste-t-il vrai et compréhensible ?
Ce travail rejoint directement les enjeux abordés dans être cité par ChatGPT et Perplexity et dans GEO : apparaître dans les réponses IA de Google. La divergence croissante entre classement organique et citation IA documentée plus haut explique aussi pourquoi la question mérite d’être traitée séparément du référencement classique, un sujet approfondi dans SEO vs GEO en 2026 et dans AI Overviews en France : ce qui change.
Un score de citabilité IA est-il une métrique officielle de Google ?
Non. Ni Google, ni OpenAI, ni Perplexity ne publient de score de citabilité par page. Ce type de note est une grille interne construite à partir des critères documentés (sources, structure, extractibilité) et sert d’indicateur de progrès, pas de mesure garantie par un tiers.
Pourquoi 100/100 n'est-il jamais atteignable ?
Parce que certaines données utiles (fourchettes de prix internes, retours d’expérience directs) ne peuvent pas être sourcées sans être fabriquées, et parce que les moteurs génératifs ne sont pas déterministes : ils peuvent citer une source différente à chaque exécution de la même requête.
Les tactiques SEO classiques fonctionnent-elles pour être cité par une IA ?
Peu ou pas. L’étude Princeton/KDD 2024 montre que la densité de mots-clés a un impact quasi nul sur la citation par les moteurs génératifs, contrairement à l’ajout de statistiques sourcées et de définitions claires, qui augmente la fréquence de citation jusqu’à 40 %.
Combien de sources faut-il par article pour être cité ?
Il n’existe pas de nombre magique, mais deux domaines de premier rang distincts par article constituent un plancher raisonnable, à condition que les liens pointent vers des documents primaires et non vers des articles qui les commentent.
Un article sans aucune source vérifiable ne sera jamais cité par un moteur génératif, quelle que soit la qualité de sa rédaction : c’est le point de départ à corriger avant tout le reste.
Ce problème, Peechy s'en occupe
Plutôt que de tout gérer seul, confiez votre site à une agence qui s'occupe de tout, hébergement, sécurité, maintenance et corrections. Encore plus simple en abonnement : on règle les soucis avant même que vous les remarquiez.
Confier mon site à Peechy