Comment être cité par ChatGPT et Perplexity
Ouvrez Perplexity et posez la question à laquelle votre meilleur article répond. Comptez les sources citées : cinq, parfois huit, numérotées en haut de la réponse. Regardez si vous y êtes. Dans la plupart des cas, non, et les pages qui y sont ne sont pas celles qui vous devancent sur Google.

Cette liste de sources obéit à une mécanique différente de celle des dix liens bleus. Elle est documentée en partie, opaque pour le reste. Voici ce qu'on peut en faire.
Comment un moteur de réponse choisit ses sources
Quand ChatGPT, Perplexity ou le mode IA de Google répond en citant des liens, le modèle ne récite pas sa mémoire d'entraînement. Il déclenche une recherche, récupère des textes, les lit dans sa fenêtre de contexte, puis rédige. Cette architecture porte un nom : RAG, pour Retrieval-Augmented Generation. La citation vient de la phase de récupération, pas du modèle.
La récupération se fait par extraits
Le système interroge un index ou envoie un robot, et il en ramène des segments de texte : un paragraphe, une définition, les lignes d'un tableau. Pas des pages entières. Votre article de 2 000 mots n'entre jamais en entier dans la fenêtre de contexte, il entre par morceaux.
Un paragraphe qui commence par « comme nous l'avons vu plus haut » perd la moitié de son sens une fois extrait. Un paragraphe qui commence par nommer son sujet et donne sa réponse dans les deux premières phrases tient debout tout seul. Écrivez chaque section comme si elle allait être lue hors de l'article, parce que c'est exactement ce qui arrive.
Le classement des extraits récupérés
Une fois les segments en main, le système en garde quelques-uns. Il retient ceux qui répondent le plus directement, et parmi eux ceux qui apportent un élément vérifiable : un chiffre, une date, une procédure, un nom d'outil. La popularité du domaine pèse, mais moins qu'en SEO classique. Un site spécialisé qui donne la valeur exacte passe devant un généraliste qui tourne autour.
Le moment où la citation apparaît
Le lien s'affiche quand le modèle appuie une affirmation sur un extrait précis. Si votre texte confirme ce que trois autres sources disent déjà dans les mêmes termes, il sert de matière première et disparaît. Si vous apportez le seul chiffre de la réponse, vous êtes cité.

Ce qui change par rapport au référencement classique
Le SEO traditionnel optimise pour un robot qui compte des occurrences et pèse des liens. Le référencement pour les moteurs de réponse, souvent appelé GEO pour Generative Engine Optimization, travaille sur la structure de l'information et sur ce que le reste du web dit de vous.
Le clic contre la mention
Sur Google, vous vous battez pour un clic. Sur Perplexity, vous vous battez pour une ligne dans la liste des sources, et le clic vient après, s'il vient. Cela change la rédaction des introductions. Une intro tiède qui pose le décor pendant trois paragraphes ne sera jamais l'extrait retenu : au moment où la réponse arrive, le budget de contexte est déjà pris ailleurs.
Donnez la réponse tôt, développez ensuite. L'article reste lisible pour un humain, et il devient récupérable pour une machine.
La fin du mot-clé exact répété
Le modèle comprend la question sans que vous répétiez « meilleure agence marketing Lyon » huit fois. Il cherche autre chose : des entités nommées et cohérentes. Votre marque, vos services, les prénoms et noms de vos experts, vos partenaires, vos clients cités par leur nom. Ces entités doivent apparaître de la même façon partout, sur votre site comme ailleurs.
Une marque écrite « Contenax » ici et « contenax.com » là, avec deux descriptions différentes de son activité, se retrouve traitée comme deux choses floues. Améliorer son référencement naturel avec du contenu passe désormais par cette cohérence de nommage autant que par les mots-clés.
L'autorité de domaine relativisée
Un vieux domaine avec beaucoup de backlinks garde un avantage sur la découverte : il est crawlé souvent et indexé vite. Cet avantage s'arrête là. Au moment du classement des extraits, c'est la précision de la réponse qui décide. C'est la meilleure nouvelle de ce dossier pour un site jeune.
Les formats de page qui se font citer
Plus l'information est prête à l'emploi, moins le système a de travail à faire pour l'extraire.
- Le résumé en tête d'article. Cinq à huit lignes qui donnent la réponse principale, placées avant le premier H2. Elles servent au lecteur pressé et constituent un extrait autoportant idéal.
- Les listes à puces en vraies balises HTML. Une liste écrite avec des tirets dans un paragraphe reste un bloc de texte pour le robot. Les balises
<ul>et<li>marquent une énumération, et une énumération se récupère telle quelle. - Le tableau de comparaison. Sur les requêtes du type « différence entre A et B », le système cherche une structure tabulaire. Une comparaison rédigée en prose sur quatre paragraphes ne sera pas retenue face à un tableau de six lignes.
- La définition autonome. Un paragraphe qui commence par « Le GEO désigne… » et tient en trois phrases se cite sans coupe. Placez-en une par notion importante de votre secteur.
- Le chiffre daté et sourcé. « 34 % en 2025 selon [source] » fonctionne. « Une grande majorité des entreprises » ne fonctionne pas, parce que rien n'y est vérifiable.
Reprenez un de vos articles et lisez uniquement ses intertitres. Si aucun ne pose une question que quelqu'un taperait vraiment, la récupération n'a aucune prise.
Ce qui se vérifie côté technique
Les user-agents IA dans votre robots.txt
Beaucoup de sites bloquent des robots IA sans le savoir, souvent via un module de sécurité installé pour autre chose. Les noms à connaître, parce qu'ils ne font pas la même chose :
- GPTBot collecte des données d'entraînement pour OpenAI. Le bloquer n'a aucun effet sur les citations en temps réel.
- OAI-SearchBot alimente l'index de recherche de ChatGPT. Le bloquer vous sort des sources citées.
- ChatGPT-User va chercher une page à la demande, quand un utilisateur ou un agent réclame ce lien précis.
- PerplexityBot indexe pour Perplexity, ClaudeBot pour Anthropic.
- Google-Extended concerne l'entraînement des modèles Gemini. Les AI Overviews, elles, s'appuient sur l'indexation Googlebot : bloquer Google-Extended ne vous en retire pas.
Ouvrez votre robots.txt maintenant et cherchez ces chaînes. Un Disallow: / sous OAI-SearchBot annule tout le reste de cet article.
Vous pouvez très bien décider d'ouvrir la recherche et de fermer l'entraînement : c'est une position défendable, et elle se règle ligne par ligne.
Le rendu HTML sans dépendance au JavaScript
Les robots de récupération lisent souvent le HTML brut, sans exécuter les scripts. Un contenu injecté après trois appels d'API existe pour votre visiteur et pas pour eux. Testez en désactivant JavaScript dans votre navigateur, ou avec un curl sur l'URL : si le texte principal n'apparaît pas, il n'existe pas pour la moitié des agents.
Les données structurées Schema.org
Marquez vos pages avec Article, FAQPage, Product, Organization, Person pour vos auteurs. Ce balisage ne garantit aucune citation, personne n'a publié de corrélation propre là-dessus. Il coûte une heure de travail une fois et rend explicite ce que le texte laisse deviner : qui parle, de quoi, à quelle date. Faites-le, sans en attendre un miracle.
Un dernier point d'honnêteté : le fichier llms.txt circule beaucoup depuis 2024. Aucun grand moteur n'a confirmé le lire. Ajoutez-le si vous voulez, ne le comptez pas comme un levier.
Les mentions de votre marque hors de votre site
Ce que vous écrivez sur vous compte moins que le nombre d'endroits indépendants qui disent la même chose. Un modèle croise les sources avant de vous présenter comme une référence.
Forums et plateformes communautaires
Reddit, les discussions LinkedIn, les forums métier et Stack Overflow reviennent souvent dans les sources citées, parce qu'on y trouve l'avis d'utilisateurs plutôt que des pages commerciales. Une marque citée par des tiers dans ces fils entre dans le paysage des réponses « quel outil pour X ». Vos propres interventions comptent aussi, à condition qu'elles apportent quelque chose et qu'elles sonnent comme vous : décrire sa voix de marque à une IA sert autant pour vos contenus que pour ces prises de parole externes.
Une précision utile : personne ne contrôle ce qui se dit sur ces plateformes, et les tentatives d'y placer sa marque de force se voient. Le travail consiste à mériter les mentions, puis à attendre.
Presse spécialisée et annuaires
Les médias sectoriels et les annuaires professionnels servent de points d'appui pour la vérification. Une fiche à jour dans l'annuaire de référence de votre secteur, une interview dans un média métier, une étude reprise par un site institutionnel : ces sources pèsent plus qu'une centaine de liens obtenus en masse. Les annuaires spécialisés, longtemps enterrés par le SEO, redeviennent utiles pour cette raison.
Mesurer sa présence dans les réponses générées
Aucune console ne fait pour les moteurs de réponse ce que la Search Console fait pour Google. Deux méthodes tiennent quand même la route.
Les referrers IA dans votre analytics
Créez un segment sur les domaines chatgpt.com, perplexity.ai, claude.ai, copilot.microsoft.com. Regardez-le une fois par mois. Le volume sera petit à côté de l'organique, et il le restera un moment. Ce segment sert d'indicateur de tendance, pas de canal d'acquisition à piloter cette année.
Un protocole de test manuel
Bloquez trente minutes par mois. Écrivez dix questions que vos clients posent réellement, formulées comme ils les formulent. Passez-les dans ChatGPT et Perplexity, notez dans un tableau si vous êtes cité et quelles sources le sont à votre place. Ouvrez ensuite deux de ces sources et cherchez ce qu'elles ont que vous n'avez pas : un tableau, un chiffre daté, une définition en tête de page.
Refaites le même test le mois suivant, avec les mêmes dix questions. Sans questions identiques, la comparaison ne vaut rien.
Les tentatives qui font perdre du temps
Le volume sans apport
Publier quarante articles génériques pour occuper le terrain ne produit pas de citations. Ces textes redisent ce que le web dit déjà, et un système de récupération qui trouve la même phrase à quinze endroits garde la source qui l'a formulée en premier ou le mieux. Un article qui apporte une donnée que vous êtes seul à avoir vaut mieux que dix qui recopient l'existant.
Les contenus froids jamais mis à jour
Perplexity et le mode IA de Google valorisent la fraîcheur, surtout sur les sujets techniques. Une page de 2023 sur les user-agents IA se fait doubler par n'importe quelle page de 2026 qui liste les bons noms. Datez vos mises à jour dans le texte et dans le balisage, et reprenez vos pages sensibles deux fois par an.
Le texte caché
Les phrases invisibles destinées à orienter la réponse du modèle, les instructions dissimulées dans le HTML, les blocs en blanc sur blanc : ces techniques circulent, et elles se détectent. Un domaine repéré comme manipulateur sort des ensembles de récupération, et rien ne dit qu'on y revient. Le rapport risque/gain ne tient pas debout.
Ce que vous pouvez vérifier cette semaine
- Votre
robots.txtn'interdit pasOAI-SearchBot,PerplexityBotniChatGPT-User. - Vos trois articles les plus lus commencent par un résumé de cinq à huit lignes.
- Chaque section de ces articles se comprend sans avoir lu la précédente.
- Vos comparatifs existent en tableau HTML, pas en prose.
- Chaque affirmation importante s'appuie sur un chiffre daté et sourcé.
- Le contenu principal apparaît dans le HTML sans exécution de JavaScript.
- Votre marque est nommée de la même façon sur votre site, vos fiches annuaires et vos profils sociaux.
Questions fréquentes
L'IA cite-t-elle uniquement les sites à gros trafic ?
Non. Le trafic n'entre pas directement dans le classement des extraits. Un site spécialisé peu visité passe devant un généraliste s'il répond plus précisément et si sa page est structurée pour être découpée. L'avantage des gros sites tient surtout à la fréquence de crawl et à la vitesse d'indexation.
Comment savoir si mon site est bloqué pour ChatGPT ?
Ouvrez votresite.com/robots.txt et cherchez GPTBot, OAI-SearchBot, ChatGPT-User et CCBot. Un Disallow: / sous OAI-SearchBot vous retire des sources de la recherche ChatGPT. Un blocage de GPTBot seul ne concerne que l'entraînement.
Les liens internes aident-ils à être cité ?
Oui, indirectement. Un maillage cohérent permet aux robots d'atteindre vos pages profondes et de relier vos sujets entre eux. Une page orpheline qui contient votre meilleure donnée ne sera jamais récupérée.
Pourquoi Perplexity cite-t-il d'autres sources que Google ?
Les deux utilisent des index et des algorithmes de récupération différents. Perplexity accorde beaucoup à la fraîcheur et à la capacité d'une page à répondre directement. Google s'appuie sur son index historique et pondère davantage l'ancienneté du domaine. Une page peut donc être citée par l'un et absente chez l'autre.
Un contenu généré par IA peut-il être cité ?
Oui, aucun système ne filtre sur l'origine du texte. Il filtre sur ce que le texte apporte. Un article générique, sans chiffre, sans exemple daté, sans position tranchée, n'est retenu par personne, qu'il ait été écrit à la main ou non.
Pour aller plus loin
Bloquez quarante-cinq minutes avant la fin de la semaine. Ouvrez votre robots.txt, puis vos trois articles les plus lus : ajoutez-y un résumé en tête, passez les énumérations en vraies listes HTML, et remplacez une affirmation vague par un chiffre daté. Posez ensuite vos dix questions dans Perplexity et notez le résultat quelque part. Vous aurez une base de comparaison pour le mois suivant.
Contenax écrit vos articles à partir de votre corpus de marque : vous décrivez le sujet et l'angle, l'outil produit un premier jet structuré en sections autonomes, avec intertitres explicites, listes balisées et résumé en tête. Il ne connaît pas les chiffres de votre marché, c'est à vous de les fournir ; il se charge de la structure et du premier jet, vous gardez le dernier mot. Découvrez Contenax.




