Le blog

Référencement6 min de lecture

Pourquoi Perplexity cite certains sites et jamais les autres

Perplexity ne classe pas des pages, il sélectionne des passages. Sept caractéristiques reviennent chez les sources qu'il cite, et aucune ne relève du bricolage SEO. Ce que nous observons, et ce que nous ne pouvons pas affirmer.

Écrit par Thomas, avec ClaudeCofondateur de Levupp

Perplexity ne renvoie pas une liste de pages, il rédige une réponse et cite les sources dont il a extrait ses phrases. La sélection porte donc sur des passages, pas sur des sites. Les sources retenues partagent presque toujours les mêmes caractéristiques : une réponse littérale à la question dès le début du contenu, des passages qui se comprennent isolément, une donnée vérifiable, une page accessible sans JavaScript ni mur payant, et une fraîcheur visible. Le reste suit.

Comment Perplexity choisit, mécaniquement

Le fonctionnement public est le suivant. Une question arrive, le moteur la reformule en une ou plusieurs requêtes de recherche, récupère un ensemble de pages depuis son index et depuis des index tiers, en extrait des passages, puis rédige une synthèse en attribuant chaque affirmation à une source.

Trois conséquences en découlent, et elles suffisent à expliquer l'essentiel.

Il y a deux sélections successives. La première est une sélection de pages, proche du référencement classique. La seconde est une sélection de passages à l'intérieur des pages retenues. Un site peut donc être trouvé et jamais cité, parce qu'aucun de ses paragraphes n'était utilisable tel quel.

Le nombre de places est très faible. Une réponse cite typiquement trois à huit sources, souvent moins. Il n'y a pas de deuxième page de résultats où subsister.

L'attribution crée une contrainte de vérifiabilité. Le moteur relie une phrase à une source. Un passage qui affirme sans rien qui l'étaye est un mauvais candidat, parce que l'attribution devient invérifiable pour le lecteur qui clique.

Les sept caractéristiques des pages citées

Ce qui suit vient de nos relevés sur les questions de nos clients et de leurs concurrents, pas d'une documentation officielle. Perplexity ne publie pas ses critères.

1. La réponse arrive avant l'argumentation. Les pages citées répondent à la question dans leur premier paragraphe. Celles qui installent le contexte pendant trois paragraphes sont lues et écartées, parce que le passage utile est trop loin et trop dilué.

2. Les paragraphes se tiennent debout tout seuls. Un passage qui commence par « c'est pour cette raison que » ne peut pas être extrait. Les pages citées ont une écriture où chaque section pourrait être lue en premier.

3. Il y a un chiffre, une date ou un nom propre. Une affirmation générale se trouve sur cinquante sites. Un chiffre daté et attribué à une source n'existe que sur ceux qui ont fait le travail, et il donne au moteur quelque chose à attribuer.

4. La page est lisible sans exécuter de JavaScript. C'est le critère le plus mécanique et le plus souvent ignoré. Une application monopage qui rend son contenu côté client n'offre au crawler qu'une coquille vide. Le rendu côté serveur n'est pas une option pour qui vise ces citations.

5. Rien ne bloque la lecture. Mur payant, bandeau de consentement qui masque le contenu, interstitiel de newsletter : tout ce qui se met entre le texte et le lecteur se met aussi entre le texte et le moteur.

6. La date est visible et récente. Sur les questions où l'état de l'art bouge, une page datée de l'année en cours est massivement préférée. Une page sans date du tout part avec un handicap qu'aucune qualité éditoriale ne rattrape.

7. Le domaine a une existence ailleurs. Un site cité par d'autres sites, présent dans des annuaires professionnels sérieux, avec une entreprise identifiable derrière, passe mieux qu'un domaine anonyme. C'est le seul des sept critères qui ressemble au vieux SEO, et il compte encore.

Les fausses pistes

La densité de mots-clés. Elle ne joue aucun rôle. Le moteur travaille sur du sens, pas sur des occurrences.

Le volume. Un article de quatre mille mots n'est pas mieux cité qu'un article de mille cinq cents. Il est même souvent moins bien traité, parce que le passage pertinent y est plus difficile à isoler.

Le fichier llms.txt. Rien n'indique qu'il entre dans la sélection. Voir notre article sur ce que fait réellement ce fichier, qui n'est pas un plaidoyer contre lui, mais qui le remet à sa place.

Les balises meta. La description meta ne sert pas à la citation. Elle sert à la page de résultats de Google, ce qui est un autre métier.

Publier tous les jours. La fréquence n'a pas d'effet visible. La fraîcheur d'une page précise, oui.

Le cas des entreprises locales

Sur une question située, la mécanique change un peu. Le moteur s'appuie davantage sur les fiches d'établissement, les annuaires et les pages de service ancrées géographiquement.

Ce qui produit un effet dans nos relevés : une page par métier et par ville, réellement écrite et non dupliquée, une fiche d'établissement complète avec des horaires et des avis, et des mentions cohérentes du nom, de l'adresse et du téléphone d'un annuaire à l'autre. La cohérence compte plus que le nombre.

Ce qui n'en produit pas : les cent pages de ville engendrées automatiquement avec le nom de la commune remplacé. Elles sont détectées comme quasi identiques, et un moteur qui cite un passage identique à quatre-vingt-dix-neuf autres pages n'apporte rien à personne. Le sujet est traité en détail dans notre article sur le SEO local multi-établissements.

Ce que nous ne pouvons pas affirmer

Par honnêteté, il faut délimiter ce qui précède.

Perplexity ne publie ni les critères de sélection, ni la pondération, ni la composition de son index. Nous observons des corrélations sur un échantillon de quelques centaines de questions, dans des secteurs français, sur une période limitée. Un critère peut être une conséquence d'un autre plutôt qu'une cause.

Le moteur change aussi. Les modèles sous-jacents sont remplacés régulièrement, les modes de recherche évoluent, et un comportement observé en juin peut avoir disparu en septembre. Toute personne qui vous vend une méthode garantie pour être cité vous vend une garantie qu'elle ne peut pas tenir.

Ce qui reste stable, en revanche, c'est la logique de fond : un moteur qui doit attribuer ses phrases à des sources préfère les sources qui rendent l'attribution facile et vérifiable. Cette logique ne dépend d'aucune version.

Questions fréquentes

Peut-on payer pour être cité par Perplexity ?

Perplexity a lancé des formats publicitaires dans ses réponses, distincts des citations. Vous pouvez donc acheter une présence identifiée comme publicité, vous ne pouvez pas acheter une citation dans le corps de la réponse. Les deux ne se confondent pas, et confondre les deux dans un devis d'agence serait trompeur.

Faut-il autoriser le crawler de Perplexity ?

Oui, si vous voulez être cité par lui. Son robot s'identifie et respecte le robots.txt. Le bloquer revient à demander à ne pas apparaître. La décision mérite d'être posée, elle est traitée dans notre article sur les crawlers d'IA.

Pourquoi mon concurrent est-il cité et pas moi, à contenu équivalent ?

Regardez d'abord la page citée chez lui, pas son site. Neuf fois sur dix, elle répond littéralement à la question posée dès son ouverture, elle porte une date récente, et elle contient au moins un élément vérifiable. Le contenu peut être équivalent en substance et très différent en extractibilité.

Une citation apporte-t-elle du trafic ?

Peu, et il faut le savoir avant de bâtir un budget dessus. Une partie du bénéfice est indirecte : le lecteur retient un nom et vous cherche ensuite, ce qui arrive dans vos statistiques en trafic direct ou de marque. Le baromètre GEO de Valiuz, publié en juillet 2026 sur treize enseignes françaises, mesure un taux de conversion de 1,8 % pour les visiteurs venus d'une IA contre 1,5 % pour les autres canaux. Moins de visites, mieux qualifiées.

Ce qu'il faut retenir

Il n'y a pas de levier isolé. Les sept caractéristiques décrites plus haut sont les mêmes que celles d'une bonne page tout court, lue par quelqu'un de pressé. Ce qui a changé, c'est que le lecteur pressé est maintenant une machine qui doit citer sa source, et qu'elle ne pardonne plus une réponse enterrée au milieu du texte.

Si vous voulez mesurer votre point de départ, la méthode de test en vingt minutes suffit. Si vous voulez que le site lui-même soit refait dans cette logique, c'est ce que couvre notre offre d'agence GEO.

Écrit par Thomas, avec ClaudeRéférencement · Intelligence artificielle

On construit le vôtre ?

Racontez-nous ce que vous avez en tête,on vous dit ce qu'on en ferait.

Démarrer un projet