«Siamo leader, l’IA può aspettare il prossimo trimestre»
La frase esce in riunione di piano, e nessuno la contesta.
Dall’altro lato dello stesso tavolo arriva l’immagine speculare: «un’azienda della nostra taglia l’IA non la tira mai fuori, quindi perché spenderci».
Ero in una stanza dove le due frasi si sono dette a dieci minuti di distanza. E non ho saputo smontare né l’una né l’altra: sono vere a metà tutte e due, ed è proprio questo il fastidio.
Solo che qualcuno ha ordinato 533 marchi per notorietà, gli ha lanciato contro 37.000 raccomandazioni e ha guardato dove ogni gruppo si perdeva. I punti di caduta non coincidevano. Non si somigliavano nemmeno.
Il motivo per cui l’IA vi salta dipende dalla vostra taglia?
Sì, e qui sta tutta la scoperta. I marchi grossi entrano quasi sempre nella lista dei candidati e poi perdono la scelta finale; quelli poco noti in lista non ci arrivano proprio.
In numeri: i leader di categoria uscivano come raccomandazione finale solo nel 25-41% dei casi, pur comparendo come candidati quasi sempre. I marchi di coda lunga e quelli regionali fallivano al primo passaggio nel 48-52% delle esecuzioni, perché il modello non li tirava fuori affatto (lo studio, Unusual.ai, arXiv:2605.27439, pubblicato il 22 maggio 2026).
L’audit copre 37.000 raccomandazioni dell’IA, 533 marchi e 19 settori, divisi in cinque livelli di notorietà.
Una cosa va messa subito sul tavolo, perché colora la lettura di tutto il resto: i quattro autori lavorano in Unusual.ai, che vende misurazione di visibilità nell’IA. «Ogni livello vuole una mossa diversa» è esattamente la conclusione che fa vendere un prodotto diagnostico.
L’imbuto si rompe in tre punti diversi
Il gruppo spezza la raccomandazione in tre fasi, ed è questa divisione a rendere leggibili le differenze fra livelli.
La prima è la scoperta: il modello vi trova e riesce ad arrivare a informazioni su di voi? La seconda è la menzione: dopo avervi trovato, scrive il vostro nome nella risposta? La terza è la selezione: dopo avervi nominato, vi incorona vincitori del confronto?
I leader superano la prima fase quasi sempre e cadono alla terza, con quel 25-41%. Non è un problema di scoperta: è differenziazione che perde un testa a testa.
I marchi di coda lunga e regionali restano fermi alla prima fase in metà delle esecuzioni. Il confronto non avviene proprio, perché il modello non arriva mai al punto di allestirlo.
In entrambi i casi la lamentela suona uguale — «non usciamo nelle risposte dell’IA» — e il muro davanti è un altro. E allora anche il budget va in un altro posto.
La percentuale migliore è quella degli sfidanti
Ecco il numero che non mi aspettavo. Il livello che lo studio chiama sfidanti affermati converte fra il 37 e il 52% una volta entrato nella lista dei candidati: la percentuale più alta di tutti i livelli misurati.
Sopra i leader di categoria, fermi al 25-41%. E senza il problema di scoperta che divora i livelli sottostanti.
I marchi di fascia media, un piolo più sotto, perdono in tutte e tre le fasi insieme e atterrano al 34-40%. Passare da sfidante a fascia media, quindi, non è una discesa dolce lungo una rampa: cambia proprio la forma della sconfitta.
Non serve essere il nome più grosso del settore per portarsi a casa la scelta. Una volta in lista le probabilità sono buone davvero: in questi dati, migliori di quelle del gigante che avete di fronte.
A ogni livello la sua mossa
Se il punto in cui si perde si sposta con la notorietà, si sposta anche la mossa. Quel che aiuta un leader non serve a niente a un marchio regionale.
- Leader di categoria (trovati ma non scelti): contenuti di differenziazione, difesa della posizione nel confronto
- Sfidanti affermati (la percentuale migliore dello studio): affinare il messaggio per segmento e spingere quella percentuale più su
- Fascia media (perde in tutte e tre le fasi): ibrido, finanziando insieme scoperta e differenziazione
- Coda lunga e regionali (spariscono prima della scoperta): entrare nelle fonti autorevoli, cioè confronti di settore, classifiche, pagine di selezione
Scegliete la mossa di un livello che non è il vostro e la fatica non rende poco: manca il bersaglio in pieno.
Cosa questo studio non copre
Quattro limiti, e li direi ad alta voce prima che il dato finisca in qualsiasi presentazione.
La misurazione è stata fatta sui mercati di Stati Uniti, Regno Unito e Unione Europea, su 19 settori. Non c’è nessuna misurazione in italiano: i confini fra livelli non sono automaticamente i vostri.
Sono stati provati due soli fornitori, OpenAI e Anthropic. Gemini e Perplexity mancano del tutto dai dati.
È una misurazione di un giorno solo, quindi qui dentro non c’è niente che dica di quanto oscillino i numeri nel tempo (salire sulla bilancia una volta e raccontare il proprio corpo per il decennio a venire).
Resta la questione degli autori. L’imbuto in tre fasi regge a prescindere da chi lo pubblica; la pendenza verso «compratevi una diagnosi» si sconta in fase di lettura.
prima capite in quale fase state perdendo, poi spendete
La prima mossa non è scegliere la strategia del vostro livello. Viene prima.
Fate ai modelli le domande che farebbe davvero chi compra da voi e dividete le risposte in due mucchi: le esecuzioni in cui il vostro nome non compare mai, e quelle in cui compare ma viene consigliato un altro. I due mucchi non hanno niente in comune, tranne la sensazione di perdere.
Se quasi tutto finisce nel primo mucchio, portate i soldi dove i modelli vanno a guardare: confronti, classifiche, pagine di selezione del settore. Se quasi tutto finisce nel secondo, metteteli nella differenziazione e nei messaggi per segmento.
E se vi ritrovate nel livello degli sfidanti, quella è la percentuale migliore dell’intero studio. Pensateci due volte prima di copiare il leader di categoria, che converte peggio di voi.
Fonti
- Will Jack, Noah Lehman, Keller Maloney, Sarah Xu (Unusual.ai), «Prominence-Stratified Failure Modes in Retrieval-Augmented Commercial Recommendation: A 37,000-Run Audit», arXiv:2605.27439v1, pubblicato il 22 maggio 2026, arxiv.org (37.000 raccomandazioni dell’IA, 533 marchi, 19 settori, mercati di Stati Uniti, Regno Unito e Unione Europea. La raccomandazione è modellata come imbuto in tre fasi: scoperta, menzione, selezione. I leader di categoria convertivano fra il 25 e il 41%, gli sfidanti affermati fra il 37 e il 52%, la fascia media fra il 34 e il 40%; i marchi di coda lunga e regionali fallivano già alla scoperta nel 48-52% delle esecuzioni. Due soli fornitori, OpenAI e Anthropic; misurazione di un giorno solo, senza analisi della deriva; tutti e quattro gli autori sono dipendenti di Unusual.ai, azienda che vende misurazione di visibilità nell’IA.)