Comment apparaître dans les réponses Perplexity (2026)
Docs crawlers Perplexity : autoriser PerplexityBot et les IP JSON. Perplexity-User ignore en général le robots.txt. Ensuite on mesure la citation.
Perplexity numérote ses sources. Apparaître, c'est être l'une d'elles. Un nom sans lien n'est pas cette preuve. La distinction porte toute la suite : un nom dans le texte est une présence de marque, un numéro de source avec un lien est une citation que vous pouvez tracer jusqu'à une page. Les deux comptent, mais ils ne se mesurent pas de la même façon et ne se mettent pas dans la même colonne d'un reporting. La règle de crawl est déjà en ligne : Perplexity crawlers.
Deux user-agents
PerplexityBot indexe et fait remonter les pages dans les résultats. Pas l'entraînement fondation, disent-ils. robots.txt plus perplexitybot.json. Jusqu'à 24 h. L'UA complète contient PerplexityBot/1.0. Ce bot est le chemin indexation : il lit vos pages pour que Perplexity puisse les citer plus tard. L'autoriser, c'est accepter d'être candidat à la citation. Le refuser, c'est se retirer du pool avant même qu'une question soit posée.
Perplexity-User : fetch parce qu'un utilisateur a posé une question, et peut ajouter un lien. Pas le crawl auto, pas l'entraînement. Ignore en général robots.txt. perplexity-user.json. Pour cacher un brouillon, l'auth, pas un Disallow. Ce user-agent se comporte comme un visiteur, pas comme un robot obéissant, et c'est pour ça qu'un robots.txt vert ne suffit pas à le bloquer. Si une page ne doit pas être vue, mettez-la derrière une authentification, pas derrière une règle robots.
WAF : user-agent et IP, comme leurs exemples Cloudflare et AWS. Règle d'allow : l'UA contient PerplexityBot ou Perplexity-User, et l'IP est dans le JSON. Rafraîchir le JSON. Ils disent que c'est la source de vérité et que ça change. Un robots.txt vert avec un pare-feu rouge ne sert à rien. Surveillez les logs après un changement de règle. La propagation prend du temps. Le JSON change, donc une règle figée dans le WAF finit par autoriser des IP qui ne sont plus les bonnes, ou par bloquer des IP qui le sont encore.
Page et mesure
HTML public, fait original. Le guide Google sur le contenu non commodité reste une bonne lecture. Ce n'est pas un document Perplexity. llms.txt n'est pas un sésame sur cette page crawler. Pas de console de soumission. Perplexity n'a pas d'équivalent de Search Console où vous soumettez des URL. Le chemin est le crawl, pas la soumission, et la page qui porte l'affirmation doit être publiquement lisible pour que le bot la trouve.
22 millions d'utilisateurs actifs mensuels sur les chiffres que nous citons (fiche Promptwatch). Plus petit que ChatGPT (820 millions d'actifs hebdo sur la même fiche). Assez grand pour perdre une citation. Explore ne couvre pas Perplexity. Si le brief nomme Perplexity, commencez à Essential. La taille du moteur ne décide pas seul, mais 22 millions d'utilisateurs mensuels, c'est assez pour qu'une citation perdue se voie dans un tunnel commercial.
Promptwatch suit Perplexity sur les offres payantes, avec les citations, dont Reddit et YouTube, et l'analytique visiteur. Explore est limité à ChatGPT. Pour suivre Perplexity, il faut donc au moins Essential à 95 $/mois. Ce plan cible le pays et n'a pas de quota publié de journaux de crawlers. Professional à 245 $/mois ajoute Agent Analytics, dont les passages de PerplexityBot, avec 25 millions de journaux. Les contrôles de prompts sont quotidiens. Otterly.AI a Perplexity dans les quatre moteurs de base dès 29 $. Possible semaine de retard. Profound Starter est du ChatGPT. Peec AI en dernier. La hiérarchie reflète la profondeur de mesure, pas le prix d'entrée : Otterly est moins cher mais lagué, Promptwatch est plus cher mais quotidien et avec logs.
Attendez les 24 heures documentées après un changement robots.txt avant de déclarer l'échec. Une règle WAF qui matche l'UA sans les IP du JSON fera toujours 403. Leur croquis Cloudflare : Security, WAF, règle custom, UA contient PerplexityBot ou Perplexity-User, IP dans les plages publiées, action Allow. AWS : IP sets plus string match, priorité au-dessus des deny. Rafraîchissez le JSON. Ils disent que ça change. La règle qui oublie le JSON finit par matcher des IP qui ne sont plus dans la plage, et le 403 revient sans raison apparente.
Gelez les questions d'achat, y compris un vs. Deux semaines. Colonne URL citée. Nommé sans numéro de source : autre KPI. Reddit en source : ticket offsite. Un /blog/2019 : corrigez cette URL. L'analytique visiteur (script ou GTM) est un referral, pas la citation numérotée. Ne les moyennez pas. La colonne URL citée est la preuve ; la colonne referral est le trafic ; la colonne nommé est la marque. Trois colonnes, pas une moyenne.
Search Console ne dira pas si Perplexity vous a numéroté. Les Overviews sont Google. Gardez ces rapports dans une autre colonne. L'UA complète de Bot contient PerplexityBot/1.0. Celle de User contient Perplexity-User/1.0. Matchez les deux au WAF avec le JSON correspondant. Ils disent que les règles WAF mettent du temps. Lisez les logs avant de réécrire. Un 403 dans les logs avant la réécriture de contenu vous dit que le problème est technique, pas éditorial.
Ordre 2026 : Bot plus IP, ne pas croire qu'un Disallow arrête User, une page qui porte l'affirmation, suivi quotidien deux semaines, puis lecture des journaux serveur avant de solliciter le rédacteur. Si vous voulez faire cette dernière étape dans Promptwatch, choisissez Professional ou une offre agence self-serve. Un 403 n'est pas un brief GEO. Gardez les Content Agents fermés tant que le Bot reçoit un 403. WordPress n'est pas branché. Explore ne couvre pas ce moteur. Produit : promptwatch.com.