SearchAudit.io

Comment une IA choisit les sources qu'elle cite

SearchAudit Team
18 sept. 2026 · 8 min de lecture
Image de couverture pour “Comment une IA choisit les sources qu'elle cite”

Quand vous posez une question à ChatGPT ou à Perplexity, vous obtenez une réponse dans laquelle quelques sources sont nommées. Pas dix liens à comparer : une synthèse, avec une à trois citations. Nous avons déjà écrit sur la façon dont ce basculement invalide les réflexes SEO d'hier. Cet article porte sur le mécanisme sous-jacent : parmi tout le web, comment le modèle décide-t-il qui nommer ?

Ce n'est pas un classement. Il n'existe pas de palmarès unique. C'est plutôt une série de filtres qu'une page doit franchir : échouer à l'un d'eux suffit à disparaître de la réponse. Voici les six, dans l'ordre où ils pèsent généralement.

  1. Peut-elle seulement vous récupérer ? Avant toute chose, le système doit être autorisé à charger votre page. Si votre robots.txt, votre hébergeur ou une extension bloque les robots d'exploration des IA, vous êtes hors course avant le départ — pas mal classé : absent. C'est le filtre dont la plupart des gens ignorent jusqu'à l'existence.

  2. Peut-elle vous lire ? Si le robot atteint votre page mais ne reçoit qu'une coquille vide — parce que le contenu ne s'affiche qu'une fois le JavaScript exécuté — il n'y a rien à citer. C'est l'échec le plus fréquent des sites vibe-codés, et nous avons détaillé exactement pourquoi. Sur les 301 sites que nous avons notés, c'est une des grandes raisons pour lesquelles 83,4 % obtiennent moins de 50/100.

  3. Comprend-elle ce que vous êtes ? Lire vos mots n'équivaut pas à savoir qui vous êtes et ce que vous faites. Un fichier llms.txt et des données structurées l'énoncent noir sur blanc — voici l'organisation, voici le produit, voici le prix, voici les réponses — pour que le modèle n'ait pas à le déduire d'indices épars. Cette clarté fait de vous une entité identifiable, et non un simple texte survolé.

  4. Êtes-vous pertinent pour la question exacte ? Ici, tout se joue dans le détail. Le modèle ne fait pas correspondre un mot-clé : il cherche une page qui répond réellement à ce qui est demandé. Les pages qui posent une question claire et y apportent une réponse directe — comme le fait une bonne FAQ — épousent la manière dont les gens formulent leurs demandes à une IA. Une réponse vague, détournée ou enfouie perd face à une réponse précise, même sur le même sujet.

  5. Vous fait-elle assez confiance pour associer votre nom à sa réponse ? Citer une source est un petit acte de caution, et les modèles sont réglés pour y regarder à deux fois. Ce qui construit cette confiance : la cohérence (votre nom, votre activité et vos coordonnées concordent partout où ils apparaissent), la corroboration (d'autres sources disent quelque chose de compatible) et la précision (des affirmations concrètes et vérifiables inspirent plus confiance que du remplissage). Nul besoin d'être un géant : il faut être cohérent et sans ambiguïté.

  6. Peut-elle en extraire une phrase nette et citable ? Le dernier filtre est pratique. Même pertinente et digne de confiance, une page ne sera pas citée si l'information utile est noyée sous dix précautions oratoires. Les modèles privilégient les énoncés autoportants — une phrase qui répond seule à la question, sans les trois paragraphes qui l'entourent. Des affirmations claires, une structure simple et des faits énoncés sont littéralement plus faciles à citer, et le plus facile à citer l'emporte.

Ce que cela implique pour vous

Remarquez la logique : aucun de ces six filtres ne récompense l'astuce ou la dépense. Ils demandent d'être accessible, lisible, compréhensible, pertinent, fiable et citable — dans cet ordre. La plupart des sites qui ne sont jamais cités ne perdent pas à l'étape 5 ou 6 : ils sortent dès l'étape 1 ou 2 et n'atteignent jamais la partie intéressante. Réglez les premiers filtres et vous devenez éligible, ce qui constitue l'essentiel du chemin.

C'est aussi pourquoi le Score de Visibilité IA est construit ainsi : il vérifie ces fondamentaux plutôt que de spéculer sur un algorithme mystérieux. Et c'est pourquoi les correctifs sont ennuyeux, au meilleur sens du terme : du vrai HTML, de l'accès, un llms.txt, des données structurées, des réponses claires. Nous détaillons la marche à suivre sur cinq stacks différentes ici.

Vous voulez savoir à quel filtre votre site s'arrête ? Lancez un audit gratuit — collez votre URL, 60 secondes, sans inscription. Vous obtiendrez votre score et les problèmes précis qui séparent votre site d'une citation. Pour les corriger, le Fix Pass à 29 $ (paiement unique) débloque tous les correctifs de ce site ; pour les équipes qui en surveillent plusieurs, Pro (79 $/mois, 5 domaines) et Agency (199 $/mois, 20 domaines) le font à grande échelle.

La recherche IA ne vous classe plus face à neuf concurrents. Elle décide, filtre après filtre, si elle inscrit votre nom dans la réponse. La bonne nouvelle : ces filtres sont connaissables — et la plupart ne dépendent que de vous.

(Les chiffres renvoient à l'étude SearchAudit sur 301 sites. Cet article traite de la présence et de la citation dans les réponses IA, pas du trafic ni du classement Google. Prix à jour à la date de publication — consultez la page tarifs.)

Voyez ce que l’IA voit sur votre site

Score et rapport d’anomalies gratuits. Sans inscription.

Lancer un audit gratuit