Votre marque est décrite par des pages qui ne vous appartiennent pas

Demandez à un assistant quelle marque acheter dans une catégorie et regardez ce qu’il cite. Les sites des marques elles-mêmes n’en représenteront qu’une minorité.

Une comparaison de 2026 a classé les sources citées en contenus gagnés, sociaux ou détenus par la marque, sur des requêtes de classement grand public. Pour Claude 4.5 Sonnet, la répartition était de 65 % de contenus gagnés et 1 % de sociaux ; pour GPT-4o, 57 % et 8 % ; Perplexity Sonar Pro s’appuyait davantage sur les pages des marques, à 39 % ; Gemini 2.5 Flash se partageait à peu près également entre contenus gagnés et pages de marques (Chen et al., arXiv:2601.16858). La répartition varie selon le moteur, et dans la plupart, les contenus gagnés dominent.

Les données d’éditeurs d’outils sur les AI Overviews de Google vont nettement dans le même sens. Ahrefs indiquait en septembre 2026 que les domaines les plus cités sur plus de trois millions de requêtes américaines étaient youtube.com (22,9 %), reddit.com (18,5 %) et facebook.com (10,1 %), Wikipédia se situant à 4,0 % (Ahrefs). Prenez ces parts comme la mesure d’un éditeur sur une fenêtre donnée, pas comme une constante : l’analyse de Semrush sur 230 000 requêtes a vu la part de réponses de ChatGPT citant Reddit passer d’environ 60 % à environ 10 % en un mois, fin 2025 (Semrush).

La tendance résiste au désaccord. Les contenus d’utilisateurs, la vidéo et les sites de référence sont systématiquement surreprésentés, et votre page produit n’est qu’une source parmi d’autres.

Pourquoi c’est structurel, et pas passager

Deux mécanismes se renforcent.

D’abord, un assistant n’a de place que pour environ quatre sources : une vaste étude a mesuré une moyenne de 4,3 URL et 3,4 domaines cités par réponse, contre 10,3 et 7,3 pour les moteurs traditionnels (Zhang et al., arXiv:2512.09483). Avec quatre places, une seule page qui compare dix marques vaut davantage pour le modèle que dix pages de marques qui vantent chacune la sienne.

Ensuite, une partie de ce que dit le modèle ne vient d’aucune page récupérée. Les modèles s’appuient largement sur leur connaissance latente des noms de produits (Pfrommer et al., arXiv:2406.03589), et dans l’étude de 2026, 16 % des entités présentes dans les classements générés n’apparaissaient dans aucun extrait récupéré. Ces connaissances préalables ont été formées, à l’entraînement, par ce même corpus de tiers.

Ce qui en découle pour le travail

  • Auditez les sources citées, pas seulement votre position. Pour chaque réponse de votre catégorie, notez les pages citées. Cette liste est votre véritable ensemble concurrentiel, et elle a sa place dans votre indicateur de déplacement.
  • Corrigez les faits erronés là où ils se trouvent. Une fiche technique périmée chez un distributeur ou un avis daté est une donnée corrigeable. C’est peu glorieux, et c’est le travail au meilleur rendement disponible.
  • Obtenez une couverture comparative. Les pages qu’affectionnent les assistants sont celles qui comparent, testent et chiffrent. Vous ne pouvez pas les écrire vous-même de façon crédible, mais vous pouvez fournir les données dont elles ont besoin.
  • Laissez entrer les robots de recherche. Les pages de tiers n’aident que si le moteur peut les récupérer, elles et les vôtres, ce qui fait de la décision sur les robots une décision de visibilité, et pas seulement une décision juridique.
  • Attendez-vous à un décalage. Les connaissances acquises à l’entraînement évoluent lentement, ce qui explique qu’un sursaut d’activité sur votre propre domaine ne change souvent rien, et pourquoi distinguer récupération et mémoire compte avant de dépenser quoi que ce soit.

Il y a une raison commerciale pour que cela en vaille la peine. Pew a constaté que, lorsqu’un résumé IA apparaissait, les utilisateurs cliquaient sur un résultat dans 8 % des visites contre 15 % sans résumé, et sur un lien du résumé dans 1 % des visites (Pew Research Center). La visite est de moins en moins l’aboutissement. Être décrit correctement l’est, et cette description est assemblée à partir de sources que vous pouvez trouver mais pas modifier.