Meilleurs Outils SEO
Tous les articles
Par La rédactioncitations ChatGPTsources IAdonnées GEO

D'où viennent les citations de ChatGPT : ce que montrent les données

Les sources de ChatGPT changent selon les requêtes et dans le temps. Les données agrégées aident, à condition de lire leur échantillon et leurs limites.

Demander "quels sites ChatGPT cite le plus ?" appelle un classement. C'est aussi la mauvaise façon de commencer. La réponse dépend des prompts observés, de l'activation de la recherche web, de la période et de l'unité de calcul. Un domaine peut être fréquent dans un ensemble de questions techniques et presque absent d'un autre consacré au voyage. Une moyenne globale ne remplace pas l'analyse de votre catégorie.

Ce que mesure le rapport de domaines

Le rapport en direct sur les domaines cités par ChatGPT, publié par Promptwatch et consulté le 30 août 2026, indique s'appuyer sur plus de 100 millions de citations suivies à travers plus de 3 000 sites. Il affiche des tendances sur une fenêtre glissante de 40 jours et classe plusieurs familles de domaines.

Ces chiffres décrivent l'échantillon collecté par Promptwatch, pas l'intégralité des conversations ChatGPT. La page précise que les données viennent des interfaces réelles de moteurs IA et qu'elles sont agrégées. Elle ne publie pas la liste complète des prompts dans le rapport ouvert. Vous pouvez donc étudier un mouvement général, mais pas en déduire automatiquement le comportement de votre niche.

La fenêtre glissante impose une autre précaution. La valeur visible aujourd'hui ne sera pas nécessairement celle de demain, même si le passé récent n'a pas été corrigé. De nouvelles réponses entrent dans la fenêtre tandis que les plus anciennes en sortent. Nous évitons donc de recopier ici le classement ponctuel des domaines. Une capture datée serait vite périmée.

ChatGPT ne cite pas toujours

Une réponse peut être produite sans recherche web et ne contenir aucune source. Selon la documentation Promptwatch sur les citations et mentions, consultée le 30 août 2026, une citation est une URL attachée à la réponse. Les réponses issues d'un fonctionnement sans recherche en ligne peuvent n'en afficher aucune.

Il faut donc séparer deux populations : les réponses avec sources et les réponses sans sources. Si vous calculez la part d'un domaine uniquement parmi les citations observées, vous ne mesurez pas la probabilité qu'une conversation quelconque cite ce domaine. Vous mesurez sa part dans le stock de citations recueilli selon la méthode annoncée.

Cette nuance paraît technique jusqu'au moment où une équipe annonce qu'un domaine "alimente ChatGPT" sur la base d'un pourcentage. Le chiffre peut seulement dire qu'il apparaît dans les sources de l'échantillon. Il ne prouve pas que ses pages ont servi à l'entraînement du modèle, ni qu'elles ont causé une recommandation de marque.

Le cas Reddit montre la vitesse des changements

Le rapport Promptwatch sur la baisse des citations Reddit dans ChatGPT, daté du 18 août 2026, fournit un exemple utile parce qu'il décrit précisément sa fenêtre. Pour ChatGPT Search, Reddit représentait en moyenne 3,83 % des citations du 18 juillet au 7 août 2026. La moyenne est passée à 0,52 % du 14 au 17 août, soit une baisse relative de 86,4 %.

Le dénominateur mérite d'être répété : la page calcule la part de Reddit parmi les citations des réponses qui contiennent au moins une citation. Elle suit la période allant du 7 juillet au 17 août 2026 pour le graphique ChatGPT. Elle ne mesure ni tous les prompts possibles ni toutes les conversations privées.

La publication dit aussi ce qu'elle ne sait pas. Le graphique situe le changement, mais n'en établit pas la cause. Une modification de la sélection des sources est une hypothèse. Le rapport précise qu'un problème de collecte ne peut pas être exclu et qualifie l'ampleur de la baisse de provisoire. Omettre cette réserve transformerait une observation en explication inventée.

Pour une marque, la leçon n'est pas de quitter Reddit après une semaine basse. Elle est de ne jamais traiter une source tierce comme un canal stable. Les règles d'accès, les choix de récupération et la composition des réponses peuvent changer sans que vous ayez modifié votre contenu.

Lire les domaines par fonction

Un domaine cité peut jouer des rôles très différents. Une encyclopédie fournit une définition. Un média apporte un fait daté. Un forum expose une expérience. Une documentation technique confirme un fonctionnement. Mélanger ces rôles dans un même classement produit peu d'idées éditoriales.

Sur vos prompts, ouvrez chaque réponse et classez la source selon la tâche qu'elle remplit. Demandez-vous quel passage semble soutenir l'affirmation, si l'URL est encore accessible et si la source est primaire. Vous verrez souvent que le moteur assemble plusieurs types de preuves.

Examinez ensuite les absences. Si vos pages ne sont jamais retenues pour une question où vous possédez une donnée primaire, la solution n'est pas d'imiter le domaine dominant du classement global. Rendez plutôt cette donnée accessible, datée et compréhensible sur une URL stable. Si la réponse cherche des retours d'usage, une page produit ne remplacera pas une discussion indépendante.

Construire votre propre échantillon

Commencez par un panier de prompts liés à des décisions réelles : questions de découverte, comparaison, compatibilité, mise en oeuvre et risque. Formulez-les comme vos prospects, sans ajouter systématiquement votre marque. Suivez les mêmes formulations sur une période stable et séparez les moteurs.

Dans chaque réponse, conservez les URL, les domaines, la place des sources et les marques mentionnées. Le domaine vous donne une vue générale. L'URL vous dit quel document a été retenu. Le texte de la réponse révèle enfin si cette citation profite à votre marque, à un concurrent ou seulement à l'explication du sujet.

Ne cherchez pas seulement votre propre site. Les sources externes qui parlent de votre catégorie façonnent aussi la réponse. Une citation tierce exacte peut vous aider. Une page ancienne ou ambiguë peut maintenir une description que vous ne reconnaissez plus. Vous ne la contrôlez pas, mais vous pouvez la surveiller et publier une source primaire plus claire.

Passer du classement à une décision

Un rapport global répond à une question de veille : quels domaines gagnent ou perdent du poids dans l'échantillon observé ? Votre suivi répond à une question opérationnelle : quelles pages influencent les réponses importantes pour votre marché ? Gardez ces niveaux séparés.

Pour relier les tendances publiques aux citations de vos propres prompts, nous recommandons Promptwatch. La fiche Promptwatch décrit la plateforme et ses autres mesures. Une fois votre panier suivi, consultez chaque URL avant de décider. Si un domaine progresse dans le rapport global mais ne figure jamais dans vos réponses, il ne mérite probablement pas votre prochain budget éditorial. Si une même page tierce revient sur vos prompts commerciaux, vous tenez en revanche un signal concret à examiner.