D’où les réponses IA tirent leurs sources
Pour être cité par un assistant, il est utile de savoir combien de place offre une réponse. En bref : beaucoup moins qu’une page de résultats, et elle ne se remplit pas de la même façon.
L’étude la plus vaste à ce jour a comparé six assistants (ChatGPT, Gemini, Perplexity, Grok, Google AI Mode et Copilot Search) à Google et Bing, sur 55 936 requêtes, 124 287 domaines et environ 1,4 million de liens cités. Les assistants citaient en moyenne 4,3 URL et 3,4 domaines par réponse, contre 10,3 URL et 7,3 domaines pour les moteurs traditionnels, et moins de dix URL distinctes apparaissaient dans 80 % des réponses (Zhang et al., arXiv:2512.09483).
Quatre places, pas dix. C’est la première chose à intégrer.
Le classement n’ouvre pas la même porte
La même étude n’a trouvé que 38 % de domaines communs aux deux types de moteurs, tandis que 37 % étaient propres aux assistants, avec un recouvrement inférieur à 40 % au niveau des réponses pour toute paire de moteurs. Une étude plus modeste de 2026 a mesuré le recouvrement de chaque modèle avec les résultats de Google : les médianes allaient de 0 % pour GPT-4o à 14,3 % pour Perplexity Sonar Pro (Chen et al., arXiv:2601.16858).
Les données des éditeurs d’outils vont dans le même sens tout en divergeant sur le chiffre. Ahrefs indiquait en mars 2026 que 38 % des pages citées dans les AI Overviews se classaient aussi dans le top 10, contre environ 76 % dans son étude de juillet 2025 (Ahrefs). Prenez les chiffres précis pour ce qu’ils sont, des mesures d’éditeur sur une cible mouvante ; prenez la tendance pour acquise. Une part significative de ce qui est cité ne se classait pas sur la question posée.
Ce que les domaines cités ont en commun
La même grande étude s’est penchée sur ce qui distingue les domaines favorisés par les assistants. Ils présentent en général un HTML plus structuré et hiérarchisé, un texte plus facile à lire, une popularité moindre et davantage de liens sortants vers des sources réputées. Les auteurs restent prudents, et vous devriez l’être aussi : il s’agit d’une corrélation sur des URL échantillonnées, pas de la preuve qu’une restructuration du HTML génère des citations. Cela va néanmoins dans le même sens que ce que l’on sait de l’écriture pour la récupération.
Une idée très répandue mérite d’être abandonnée. On décrit souvent les citations IA comme bien plus concentrées que les résultats naturels. Mesurés par l’indice de Gini, les assistants de cette étude affichaient au contraire une concentration plus faible que Google et Bing, soit une répartition un peu plus égale des domaines. Être petit est ici moins disqualifiant que ne le veut la légende.
Qu’en faire
- Partez de quatre places. Si la réponse de votre catégorie compte déjà quatre bonnes sources, votre travail consiste à en déloger une, pas à s’ajouter, d’où l’intérêt de mesurer le déplacement.
- Cessez de déduire la visibilité IA des positions. Les deux se recouvrent d’un tiers aux deux tiers selon qui mesure : l’un n’est pas un indicateur de l’autre.
- Regardez qui occupe les places dans votre catégorie. Souvent, ce ne sont pas des concurrents mais des pages que vous ne possédez pas.
Et méfiez-vous des statistiques précises de part de citations, y compris celles-ci. Elles proviennent de jeux de données propriétaires, varient fortement d’une fenêtre de mesure à l’autre, et plusieurs chiffres largement diffusés ne renvoient à aucune source consultable.