« Ça, on l’a écrit où sur notre site ? »
Vous avez lancé une recherche approfondie sur votre société. Le rapport revient bien rangé, sa liste de sources en bas, et vos propres pages dedans.
Sur cette liste, vous en avez ouvert combien ? Une, sans doute. La page s’est affichée, elle parlait bien du sujet, et la vérification s’est arrêtée là.
On attend d’un lien mis en appui qu’il porte ce que la phrase affirme. Celui-ci pointe bien chez vous, il s’ouvre sans problème, et la phrase qu’il appuie n’est écrite nulle part sur votre site.
Hex-ko a lu une mesure qui rouvre ces liens un par un, et elle est allée recompter les colonnes de son propre rapport de visibilité.
Les liens que l’IA met en source appuient-ils vraiment ce qu’elle écrit ?
Le lien s’ouvre dans plus de 94 % des cas, la page parle bien du même sujet dans plus de 80 %, et elle appuie comme un fait la phrase qu’elle accompagne dans 39 à 77 % des cas chez les modèles de pointe. Trois vérifications, trois taux.
Le relevé vient de six personnes de PricewaterhouseCoopers et date du 7 mai 2026 (R). Quatorze modèles d’IA, 130 demandes d’étude, et chaque citation des rapports rouverte une par une. Les demandes viennent de deux jeux de tests publics, rédigés en anglais.
Un agent de recherche approfondie, c’est la fonction qui envoie l’IA lire des dizaines ou des centaines de pages toute seule, puis écrire un rapport avec ses liens de sources. Les modes « recherche approfondie » de ChatGPT et de Gemini font ce travail.
Le tri entre « ça appuie » et « ça n’appuie pas » a été rendu par une IA qui note selon une grille, calée sur 50 à 100 relectures humaines. Des humains n’ont donc pas jugé l’ensemble des citations.
Votre rapport de visibilité s’arrête d’ordinaire à la première des trois couches
Une phrase du rapport, une citation posée dessous. La mesure regarde ce seul couple, et lui pose trois questions différentes :
- si le lien s’ouvre vraiment
- si la page parle du même sujet que la phrase
- si la page appuie, comme un fait, ce que la phrase affirme
Le nombre de citations que vous suivez chaque mois répond en général à la première. Quand on va jusqu’à la deuxième, on sait en plus que l’IA a traité votre page comme un appui.
Donc la troisième est la seule qui regarde ce qui a été dit de vous. Elle porte sur un autre objet, et on peut empiler les citations sans jamais la faire apparaître.
La source existe, elle parle du bon sujet, et le chiffre de la phrase ne se retrouve sur aucune de vos pages. C’est la notice d’un autre modèle glissée dans le carton : le vocabulaire est le bon, les références ne sont pas les vôtres.
Et la dernière citation que vous avez comptée, elle était passée par laquelle des trois ?
On pousse jusqu’à 150 recherches, et seule la troisième couche bouge
La même équipe a fait varier le nombre de recherches laissées à l’IA, de 2 à 150, sur deux modèles.
L’appui factuel descend. En moyenne sur ces deux modèles, il perd environ 42 points de pourcentage : GPT-5.4 passe de 79 % à 17 %, Claude Opus 4.6 de 80 % à 58 %.
Creuser plus profond rendrait la réponse plus juste, vous auriez parié là-dessus ? Hex-ko aussi.
Pendant ce temps, les deux premières couches tiennent : à toutes les profondeurs testées, les liens s’ouvrent et le sujet colle au-dessus de 92 %. La baisse se joue sur la troisième, et sur elle seule.
Et donc ce qui se pilote de votre côté, ce n’est pas la profondeur de lecture du modèle — elle ne vous appartient pas —, c’est la phrase qu’il va lire. Tient-elle debout toute seule, sortie de son paragraphe ?
Cette façon d’écrire la phrase, le papier ne l’a pas mesurée. Mais une phrase qui porte les trois éléments suivants se laisse moins déformer :
- le chiffre lui-même (32 % de plus)
- la date à laquelle il se rapporte (août 2026)
- ce à quoi il se compare (par rapport à août 2025)
« Les expéditions d’août 2026 ont progressé de 32 % par rapport à août 2025 » se suffit à elle-même : extraite seule, elle dit encore la même chose. « En forte hausse sur un an » demande, elle, les paragraphes qui l’entourent pour qu’on sache de quoi on parle.
Avant de reprendre ces chiffres pour votre marque
Ce qui a été mesuré, ce sont les citations des rapports écrits par la fonction de recherche approfondie. La réponse que ChatGPT vous donne dans une conversation ordinaire reste en dehors du périmètre.
Les 130 demandes d’étude viennent de jeux de tests publics rédigés en anglais. Le français n’y figure pas, et le papier ne dit rien de ce que donnerait la même mesure dans une autre langue.
Le relevé est publié par PricewaterhouseCoopers, un cabinet d’audit et de conseil qui vend aussi de l’accompagnement à l’adoption de l’IA. « Vérifiez ce que l’IA cite » est une conclusion qui l’arrange, et ça se garde en tête pendant la lecture. C’est une prépublication, par ailleurs : rien n’a encore été relu par les pairs.
Les quatorze modèles sont ceux d’une version précise, celle du moment de l’évaluation. Les auteurs ajoutent eux-mêmes une limite : une citation du web peut disparaître ou changer de contenu entre le moment où elle est produite et celui où on va la vérifier.
Déduction faite de tout ça, qu’est-ce qui se transporte chez vous ? Le cadre plus que les valeurs. Les trois couches, vous pouvez les compter séparément sur vos propres citations, quelle que soit la langue dans laquelle on vous cite.
dix citations ouvertes au hasard, et le compte de celles qui tiennent
Ce mois-ci, votre marque est sortie dans des réponses d’IA, et vous en avez le compte. Tirez-en dix au hasard.
Au hasard, parce qu’en ouvrant dans l’ordre où elles vous tombent sous les yeux, vous récolterez surtout les citations qui font plaisir. Ouvrez-les, lisez ce qui se dit de vous, comparez à ce que dit votre page, et notez le nombre de celles qui tiennent.
Ces dix-là ne comptent ni les liens qui s’ouvrent ni les sujets qui collent. C’est la troisième couche, mesurée une fois, de votre main.
Le mois où les citations montent, est-ce que ce qui se dit de vous monte avec ? Une colonne de comptages ne répond pas à cette question, et une décision d’investissement prise sur cette seule colonne laisse l’écart invisible jusqu’au bout.
Si vous avez déjà coupé votre feuille en deux colonnes, les mentions d’un côté et les citations de l’autre, celle-ci vient se poser juste à côté (Gemini vous nomme, ChatGPT vous cite).
Dix, ça suffit pour commencer : la colonne existe à partir du moment où elle porte une première valeur.
Sources
- Onweller, H. et al. (Commercial Technology and Innovation Office, PricewaterhouseCoopers, U.S.), “Cited but Not Verified: Parsing and Evaluating Source Attribution in LLM Deep Research Agents”, arXiv:2605.06635, 7 mai 2026 (limites : prépublication, non relue par les pairs ; le périmètre couvre les citations des rapports produits par les agents de recherche approfondie, pas les réponses d’une conversation ordinaire ; les 130 demandes d’étude viennent de deux jeux de tests publics rédigés en anglais ; l’éditeur PricewaterhouseCoopers vend de l’accompagnement à l’adoption de l’IA ; la pertinence du sujet et l’appui factuel ont été jugés par une IA notant selon une grille, calée sur 50 à 100 relectures humaines ; les quatorze modèles sont ceux de leur version au moment de l’évaluation).