Aller au contenu
Implementa.

SEO pour ChatGPT (GEO) · Guide 35 sur 35

Quelles sources cite l’IA : la carte des domaines qui décide si elle te nomme

Quand ChatGPT recommande un outil ou nomme un prestataire, il ne lit pas ton site : il synthétise à partir d’un ensemble très réduit de sources qu’il pondère au-dessus des autres. Et cet ensemble est plus court qu’on ne le croit. Dans une analyse de 1,2 million de réponses de ChatGPT, 67 % des citations d’un sujet venaient d’à peine 30 domaines ; et dans une étude de 5W Public Relations sur les citations aux États-Unis, Wikipédia (≈13 %) et Reddit (≈12 %) pèsent à elles seules plus d’une citation sur quatre. Traduction : il existe un club de sources qui décide qui existe pour le modèle, et ton site en est rarement membre. Voici la carte de ce club —quels domaines l’IA pondère quand elle parle de ta catégorie, comment les repérer et comment t’y glisser—.

Il y a une idée dont on a du mal à se défaire : si ton site est bon, l’IA te trouvera. Ça ne marche pas comme ça. Quand ChatGPT recommande un outil ou nomme un prestataire, il ne parcourt pas internet en lisant les sites un à un : il récupère et synthétise à partir d’un ensemble très réduit de sources qu’il pondère au-dessus des autres. Et cet ensemble est vraiment court. Dans une analyse de 1,2 million de réponses de ChatGPT, 67 % des citations d’un sujet venaient d’à peine 30 domaines. Exister pour le modèle, ce n’est pas apparaître sur Google : c’est être dans ce club de sources. Voici la carte de qui le dirige et comment y entrer.

L’IA ne te lit pas : elle récupère depuis un club de sources

Un moteur génératif ne classe pas les pages par liens comme la recherche classique. Quand tu l’interroges, il décompose la question, récupère des fragments des sources qu’il juge fiables et rédige une réponse en en citant quelques-unes. L’effet est une concentration brutale : dans l’étude de 5W Public Relations sur les citations de ChatGPT aux États-Unis, Wikipédia (autour de 13 %) et Reddit (près de 12 %) totalisent à elles seules plus d’une citation sur quatre, et hors ces deux-là presque aucun domaine ne dépasse 3 %. La liste de qui décide est courte, et ton domaine n’y est presque jamais.

Ça change l’endroit où se joue ta visibilité. Selon les analyses du secteur, la plupart des citations avec lesquelles l’IA construit une recommandation ne viennent pas du domaine de la marque, mais de tiers —annuaires, avis, médias, forums—. Ton site reste nécessaire (l’IA le récupère pour confirmer ce que tu fais et qui tu es), mais il te met rarement sur la liste. La liste est écrite par les sources que le modèle pondère déjà. C’est pourquoi « optimiser pour le GEO » ne se limite pas à toucher ton site : c’est comprendre quelles sources l’IA cite dans ta catégorie et travailler pour y être.

Les domaines qui pèsent presque toujours (et pourquoi)

Il n’y a pas deux catégories identiques, mais le motif se répète. Cinq types de source reviennent sans cesse quand l’IA parle de produits, de services ou de prestataires :

Type de sourceExemplesPourquoi l’IA la pondère
EncyclopédiqueWikipédiaEntité vérifiable et neutre. C’est la source la plus citée par ChatGPT : elle fait de toi « quelque chose qui existe » aux yeux du modèle.
CommunautéReddit, forums de nicheAvis sans filtre de marque. L’IA le lit comme une expérience réelle d’utilisateurs, pas comme du marketing.
Avis / annuairesG2, Capterra, annuaires de ton secteurVérification indépendante de ce que tu dis de toi. En logiciel, G2 est parmi les plus citées justement parce que tu ne la contrôles pas.
Médias d’autoritéForbes, Business Insider, presse proSignal tiers crédible. Une mention signée pèse plus que dix posts sur ton propre blog.
MultimodalYouTubeDomine dans Google AI Overviews et compte dans le reste. La vidéo bien balisée entre là où le texte n’arrive pas.

Le fil commun est inconfortable mais clair : l’IA fait plus confiance à ce que les autres disent de toi qu’à ce que tu dis de toi-même. La vérification indépendante bat l’information auto-déclarée. C’est pourquoi un avis réel sur G2 ou une mention dans un média bougent l’aiguille de ta visibilité bien plus que réécrire ta page d’accueil pour la dixième fois.

Chaque moteur lit un internet différent

L’erreur de débutant est de traiter « l’IA » comme une seule chose. Elle ne l’est pas. Le recouvrement de domaines entre ChatGPT et Perplexity tourne autour de 11 % seulement : ce sont deux bibliothèques presque distinctes. Perplexity s’appuie énormément sur Reddit et des sources vivantes ; Google AI Overviews privilégie YouTube et le multimodal ; ChatGPT concentre sur Wikipédia, Reddit et les médias établis. La même marque peut être reine sur l’un et ne pas exister sur l’autre. On le développe dans ChatGPT vs Perplexity : même marque, deux visibilités et dans comment apparaître dans Perplexity.

La conséquence pratique : un audit de sources se fait par moteur. Mesurer ta présence dans un unique agrégat « IA » te donne un chiffre qui moyenne des réalités opposées et te rend aveugle exactement là où tu as le trou. Si ton acheteur demande dans Perplexity, ta carte de sources est celle de Perplexity, pas celle de ChatGPT.

Comment savoir quelles sources elle cite dans TA catégorie

La bonne nouvelle : ça s’audite sans outil payant pour commencer. Il te faut juste de la méthode et de la constance. Quatre étapes :

  1. Écris 15 à 25 questions de catégorie, sans ta marque. Comme demande vraiment un acheteur qui ne te connaît pas encore (« meilleur outil pour X », « comment choisir un prestataire de Y »). C’est le même set que tu utilises pour auditer ta visibilité avec des prompts.
  2. Lance-les sur les moteurs qui montrent leurs sources. Perplexity, Google AI Overviews et ChatGPT avec recherche listent les domaines qu’ils citent. C’est là qu’on lit la carte ; note chaque source qui apparaît.
  3. Compte les répétitions, pas les impressions. Après deux ou trois passages, tu verras les mêmes revenir : un annuaire ou une plateforme d’avis de ton secteur, un ou deux médias, un fil Reddit, un ou deux sites de concurrents. Cette courte liste est le club qui décide ta catégorie.
  4. Croise avec où tu es. Marque dans lesquelles de ces sources tu apparais déjà et lesquelles non. L’écart entre « sources que l’IA cite » et « sources où tu existes » est, littéralement, ton plan de travail.

Comment entrer dans le set de sources qui te cite

Une fois la carte en main, le travail est d’entrer dans ces sources, pas d’en inventer d’autres. Par ordre de retour :

  1. Revendique et complète ta fiche sur les plateformes d’avis et annuaires qui sortent déjà. G2, Capterra ou le vertical de ton secteur, avec des données correctes et des avis réels et récents. C’est le levier le plus rapide dans les catégories logicielles.
  2. Consolide ton entité. Même description, même catégorie et mêmes données sur ton site, LinkedIn et les annuaires, pour que l’IA puisse « recouper » qui tu es. Les données structurées qui comptent vraiment aident à cette désambiguïsation, mais c’est de la plomberie, pas le moteur.
  3. Gagne des mentions de tiers. Un article signé dans un média du secteur, un passage en podcast, un cas publié. L’IA pondère ce que les autres disent de toi ; donne-lui du matériel vérifiable à citer.
  4. Participe là où vit la communauté. Reddit et les forums de niche pèsent beaucoup. Ne spamme pas : apporte des réponses utiles que l’IA peut récupérer comme expérience réelle.
  5. Garde ton site impeccable et lisible. Réponse directe en haut, données vérifiables, entité claire. Il ne te met pas sur la liste tout seul, mais c’est ce que l’IA récupère pour te confirmer une fois que tu y es.

Et mesure-le dans le temps, pas une fois : la photo d’aujourd’hui ne dit pas si tu progresses. Combine l’audit de visibilité pour la carte initiale, le suivi des mentions semaine après semaine pour voir le mouvement, et le cadre pour mesurer ta visibilité dans l’IA pour noter chaque réponse. Si tu ne veux pas monter et maintenir ça à la main, le monitoring de visibilité dans l’IA garde la carte de sources vivante et surveillée par moteur ; et quand la lecture appelle à l’action, l’optimisation GEO travaille sur ta présence dans ces sources, pas sur un rapport.

Questions fréquentes

Une poignée très concentrée. Dans l’analyse de 5W sur les citations de ChatGPT aux États-Unis, Wikipédia (autour de 13 %) et Reddit (près de 12 %) totalisent plus de 25 % de toutes les citations, et hors ces deux-là presque aucun domaine ne dépasse 3 %. Ensuite reviennent régulièrement les médias d’autorité (Forbes, Business Insider), YouTube et —dans les catégories logicielles— des plateformes d’avis comme G2. La leçon n’est pas « publie sur Wikipédia » : c’est que ChatGPT construit la réponse à partir de sources tierces qu’il juge fiables, pas depuis ton domaine. C’est pourquoi le travail de visibilité se joue autant hors de ton site que dessus.

Non, et l’écart est grand. Le recouvrement de domaines entre ChatGPT et Perplexity tourne autour de 11 % seulement : chaque moteur lit un internet différent. Perplexity s’appuie énormément sur Reddit et des sources vivantes ; Google AI Overviews privilégie YouTube et le multimodal ; ChatGPT concentre sur Wikipédia, Reddit et les médias établis. La même marque peut régner sur l’un et disparaître de l’autre. C’est pourquoi un audit de sources se fait par moteur, pas dans un agrégat unique qui te rassure et te ment sur ta position réelle.

En le lui demandant toi-même, méthodiquement. Lance 15 à 25 questions de catégorie (sans ta marque) sur chaque moteur et, dans ceux qui montrent leurs sources —Perplexity, Google AI Overviews, ChatGPT avec recherche—, note quels domaines reviennent sans cesse. En deux ou trois passages tu verras le motif : presque toujours un annuaire ou une plateforme d’avis de ton secteur, un ou deux médias, un fil Reddit et un ou deux sites de concurrents. Cette courte liste est ta carte : ce sont les pages où tu dois exister pour que l’IA te récupère. Pas besoin d’outil payant pour commencer ; il faut poser toujours la même chose et noter.

Oui, mais avec le bon rôle. Ton site est nécessaire —l’IA le récupère pour confirmer ce que tu fais, tes données et ton entité— mais il te met rarement sur la liste des recommandés : ça, ce sont les sources tierces que le modèle pondère qui le décident. Le travail a donc deux jambes à la fois : rendre ton site impeccable et lisible (réponse directe, données vérifiables, entité cohérente) et, surtout, gagner une présence citée sur les domaines qui sortent déjà dans ta catégorie —avis réels sur G2/Capterra ou l’annuaire de ton secteur, mentions signées dans les médias, participation utile dans les communautés que l’IA lit—. Une jambe sans l’autre laisse la moitié du travail non faite.

Plan d'Impact IA · gratuit

Le guide est générique. Ton plan, non.

Parle-nous de ton entreprise et on te renvoie un diagnostic avec priorités, chiffres et quoi implémenter en premier. Sans rendez-vous commercial, sans payer un euro.

Quelles sources cite l’IA : la carte des domaines qui décide si elle te nomme · Implementa