Quand vous effectuez une recherche en utilisant ChatGPT, Claude, Perplexity, Mistral, Gemini ou Copilote, est-ce que vous vous demandez parfois où ces plateformes puisent leur information? Je veux dire, on sait qu’elles sont entrainées en piochant sur le web, les médias sociaux et une panoplie de sources… mais quelles sont ces sources, exactement?
Une intéressante étude a récemment été effectuée par la firme SEMrush, montrant les sources principales utilisées par ces outils LLM (Large Language Models). On remarque des changement assez importants par rapport à la version précédente de ce rapport, publié en 2025. Reddit maintient ainsi sa position de tête, mais c’est la présence de Linkedin en deuxième position qui surprend le plus, surtout pour ceux et celles qui ont délaissé cette plateforme récemment en raison des contenus plus ou moins pertinents qu’on y retrouvait (Linkedin s’attaque d’ailleurs au AI Slop, ces contenus sans valeur ajoutée, générés par l’IA, mais c’est un tout autre sujet…). YouTube et Google arrivent en 5e et 6e place, confirmant l’importance de ces plateformes si on souhaite être cité par l’IA.

Devrait-on investir temps et argent sur Reddit ou Wikipedia?
La question qui tue, maintenant: vous faites quoi sur ces plateformes? Wikipedia et Reddit ne datent pas d’hier, et ce sont deux bêtes à apprivoiser. Mais on s’entend que tout bon marketeur voudra prendre ces données en considération afin d’assurer que votre entreprise, votre marque ou vos produits, apparaissent dans les résultats de recherche générés par l’IA.
Voilà qui confirme ce dont je vous parlais dans des articles parus récemment, c’est-à-dire que si le SEO demeure important pour être trouvé en ligne, les relations publiques deviennent encore plus importantes que jamais pour assurer des mentions et/ou articles dans un subreddit ou via un texte sur Wikipedia. Bref, on se doit d’identifier les sources qui mentionnent votre marque (ou vos compétiteurs) et voir comment on peut assurer une présence ou mention sur ces plateformes, utilisées comme sources par l’IA.
Ça vous surprend, ce tableau? Et vous, vous faites quoi pour assurer que ces plateformes mentionnent votre marque ou votre entreprise? Je me doute bien qu’au Québec, un site comme Reddit n’a peut-être pas la même importance qu’aux États-Unis, ou qu’en France il peut y avoir d’autres sites web plus influents, mais je serais curieux d’avoir votre feedback pour savoir si vous avez creusé la chose de votre côté…
Les modèles d’IA ne sont pas “one size fits all”
Un dernier truc à mentionner. Malgré le tableau que vous voyez ci-dessus, il faut comprendre que les modèles d’entrainement de chaque plateforme diffèrent à un degré ou un autre, et que les sources d’information ne sont pas les mêmes. Comme le rapportait First Page Sage plus tôt cette année, les recommandations varient selon la nature des sources utilisées, comme on peut le voir dans le tableau suivant:

On note ainsi une plus grande variété dans les sources d’information chez ChatGPT (OpenAI) que Perplexity, par exemple. Mais cette dernière mise plus fortement sur les listes d’autorité, ce qui tombe sous le sens quand on sait l’entente signée avec TripAdvisor notamment au début 2024 pour accéder à plus de 2 millions d’avis consommateurs. On remarque aussi que Claude et ChatGPT intègrent des données d’utilisation et exemples de consommateurs, ce qui ne semble par le cas pour Gemini ou Perplexity.
Bref, le message clé ici est qu’on doit traiter avec chaque plateforme comme étant de nature différente, et non pas une seule entité homogène. Pas surprenant d’ailleurs, que lors de différents audits GEO effectués au cours des derniers mois, on ait observé des disparités dans la visibilité IA chez certains clients. Une excellente visibilité lors de certaines requêtes dans ChatGPT, alors que ces mêmes requêtes faisaient chou blanc dans Google AI Mode. Quand on creuse, on comprend dès lors que chaque modèle a ses particularités..



Laisser un commentaire