Retour HexScope Lens

252 000 duels plus tard : les pages qui affichent un prix raflent les citations

POINT Points clés
  • Avec un prix affiché, 6,26 fois plus de citations
  • La mise en forme du texte n'a presque rien changé

La réunion qui se termine par « on va nettoyer la page pour l’IA »

Dès qu’on parle d’optimiser pour l’IA, on tombe d’abord sur la structure des titres et la finesse des puces.

Chez nous, une heure y est passée. Et je doute que ce soit le seul bureau où cette réunion a eu lieu.

Ensuite, Hex-ko n’a fait que la mise en forme, puis a regardé pendant trois semaines qu’il ne se passait rien.

C’est la partie utile de l’histoire : si une page bien rangée n’est toujours pas citée, la partie se joue en dehors du rangement.

Où, alors ? Une étude parue en mai 2026 a séparé les facteurs un à un, avec 252 000 duels entre deux pages du même sujet qui se disputent la première citation.

Que faut-il mettre sur une page pour que l’IA la cite ?

Un prix, des caractéristiques, une date de mise à jour récente.

Sur 252 000 duels entre deux pages traitant du même sujet, celle qui affichait un prix a été citée en premier au moins 6,26 fois plus souvent que celle qui n’en affichait pas.

La page portant une date récente l’emporte sur une page datée d’au moins 14,4 fois (Vishwakarma et ses collègues, six modèles, 252 000 essais, publié le 25 mai 2026).

En revanche, que le texte soit structuré ou non n’a presque rien déplacé : de 0,79 à 1,68 fois.

Le rapport de cotes, ici, c’est simplement « combien de fois plus souvent l’une est choisie ». Un, c’est une égalité ; six, c’est une page retenue six fois plus souvent.

C’est le dispositif qui change tout par rapport à ce qu’on avait couvert. La recherche sur les citations d’IA est presque toujours observationnelle : on ramasse les pages citées, on cherche des motifs.

Ici, on donne exactement deux pages candidates, on échange un seul facteur sur dix-huit, et on force le choix.

Trois chercheurs de Sprinklr l’ont fait tourner sur Gemini-2.5-Flash, GPT-5-Nano, GPT-5-Mini, GPT-5.2, Claude-3.5-Sonnet et Kimi-K2-Thinking.

Ils ont aussi inversé l’ordre des deux candidates pour neutraliser l’effet de la position elle-même.

Cela se lit donc comme « ajouter cet élément déplace votre taux de victoire d’autant », et non comme « les pages de ce genre se font souvent citer ».

Quatre portes à franchir avant tout le reste

Quatre facteurs ont produit un effet important, et dans le même sens, sur les six modèles :

  • l’adéquation entre le sujet de la page et la question
  • la présence d’un prix
  • la fraîcheur de la date
  • la position de la page dans l’ordre présenté

Les auteurs parlent de portes : si l’une lâche, la perspective d’être cité disparaît.

L’ordre du travail est donc fixé. D’abord accorder le sujet, ensuite écrire le prix, ensuite rafraîchir la date. La mise en forme vient après.

La quatrième porte, elle, ne vous appartient pas : l’ordre des candidates dépend de ce qui va chercher les documents. Trois sur quatre sont à vous.

Et laquelle de ces trois est la plus facile à attraper en premier ?

Rafraîchir une date, oui ; la masquer, non

Une date récente l’emporte sur une date ancienne d’au moins 14,4 fois.

Mais si vous supprimez la date, vous ne l’emportez plus que de 1,31 à 2,32 fois. Ajouter de la fraîcheur et masquer l’ancienneté ne sont pas le même geste à l’envers.

Retirer discrètement l’horodatage ne vous achète donc pas grand-chose.

Décoller l’étiquette de péremption ne rajeunit pas le lait.

Reprenez le contenu, puis affichez la date neuve. C’est cette page-là qui se retrouve du côté des 14,4.

Ce qui n’a pas joué, c’est la présentation ; le fond du texte, si

Texte structuré contre texte compact : de 0,79 à 1,68 fois. Et les auteurs écrivent noir sur blanc que le choix de format n’a eu aucun effet.

Écrire n’importe comment revient donc au même ? Non.

Les pages qui montrent leurs preuves gagnent d’au moins 2,09 fois. Celles qui affirment nettement, d’au moins 2,67. Celles au ton neutre, peu promotionnel, d’au moins 1,31.

Rien de tout cela ne décrit ce que Hex-ko a retouché pendant trois semaines.

Cela rejoint proprement deux articles précédents : la recette tient en trois mots, « chiffres et sources » et trois petits ajouts, et l’IA vous cite jusqu’à 40 % de plus.

Ceux-là mesuraient le gain d’une page réécrite. Celui-ci mesure qui gagne quand deux pages s’affrontent. Ce ne sont pas les mêmes unités.

Pour la fraîcheur, même rapport. L’IA cite surtout des pages de moins d’un an et un article réécrit compte autant qu’un article neuf comptaient les pages après coup.

Ici, seule la date change, et le cas « aucune date » est mesuré aussi. La tendance observée est découpée en facteurs.

Une tension mérite d’être nommée : le cadre SOAR évoqué dans huit heures avant qu’une IA cite votre communiqué range la structure parmi les signaux. Dans cette comparaison contrôlée, la structure ne déplace presque rien.

En conclure que la structure ne sert à rien serait rapide. Un cadre observationnel et une expérience à un facteur ne découpent pas à la même résolution.

Ce qu’il faut lire avant d’emporter ces chiffres

La sensibilité varie beaucoup selon le modèle. Sur dix-huit facteurs, la part de significatifs est de 83 % pour Kimi-K2-Thinking, 50 % pour Claude-3.5-Sonnet et 33 % pour Gemini-2.5-Flash.

Seules les quatre portes tiennent sur les six. Tout le reste dit qu’on ne peut pas vérifier sur un seul assistant et s’arrêter là.

D’autres réserves restent :

  • il n’y a que deux pages candidates, quand une recherche IA réelle en ramène cinq, dix ou davantage (les auteurs le signalent)
  • les marques sont anonymisées : l’avantage qu’une marque connue obtient indépendamment du contenu n’est pas dans ces chiffres (signalé aussi)
  • le matériel a été produit avec GPT-4o, et la relecture humaine a couvert 300 scénarios, soit 21 % du total (signalé aussi)
  • ce qui est mesuré, c’est la page visée par le premier marqueur de citation, pas l’exposition, ni le trafic, ni le chiffre d’affaires
  • les trois auteurs sont chez Sprinklr, qui vend des plateformes marketing aux entreprises

Deux de ces réserves pèsent davantage.

D’abord, le matériel est fait de 100 blogs produit en anglais, sur 50 catégories. Si vous mesurez dans une autre langue, reprendre les multiplicateurs tels quels est prématuré.

Ensuite, l’effet du prix suppose une page qui puisse porter un prix. Sur un produit B2B à tarifs non publics, cela ne se transpose pas. La question devient : jusqu’où pouvez-vous écrire votre logique tarifaire et les hypothèses d’un devis ?

ouvrez votre page principale et regardez sujet, prix et date

Il y a deux endroits où poser les mains : une page, et les réponses des modèles.

Ouvrez la page la plus consultée et vérifiez trois choses. Le sujet répond-il à la question que poserait un lecteur, un prix figure-t-il (ou au moins sa logique), et la date de mise à jour est-elle restée vieille ?

La mise en forme n’est pas annulée. Elle passe simplement après ces trois points.

Ensuite, vérifiez le résultat du côté des réponses. Comme l’effet va de 33 % à 83 % selon le modèle, mesurez plusieurs fois sur plusieurs d’entre eux et suivez la fréquence d’apparition de votre nom.

Si vous ne gardez qu’une lecture, prenez la liste pratique en fin d’article : franchir les portes, combler le prix, la date et les termes de la question manquants, ajouter tableaux de caractéristiques et comparatifs, garder la mise en forme pour la fin.

Alors allez regarder une page, juste la ligne du prix et la date de mise à jour, et voyez ce qu’elle annonce.


Sources

  • Rahul Vishwakarma, Shushant Kumar, Ratnesh Jamidar (Sprinklr), « What Gets Cited: Competitive GEO in AI Answer Engines », arXiv:2605.25517, 2026-05-25, https://arxiv.org/abs/2605.25517
Partager cet article
Bluesky X
Retour aux articles