Indietro HexScope Lens

Andiamo a vedere cosa regge in 45 studi sull'IA: pertinenza e posizione

POINT Punti chiave
  • La posizione è il rango fra documenti recuperati, non dentro la pagina
  • Le righe senza effetto costante arretrano nella lista invece di sparire

«Di queste trenta righe, da quale partiamo?»

Mettere i dati strutturati. Aggiungere le citazioni. Aggiungere le statistiche.

Ho continuato ad annotare cose da fare per la ricerca con l’IA finché la tabella non è arrivata a trenta righe. Alla riunione del mese scorso quella tabella è rimasta venti minuti sullo schermo, e nessuno ha puntato il dito sulla riga uno; si è passati al punto successivo dell’ordine del giorno.

Poi però esce una rassegna che ha riletto 45 studi sull’ottimizzazione per le IA, e di fattori rimasti in piedi su tutte le piattaforme esaminate ne trova due. Nessun altro.

È un preprint. Nessuno l’ha ancora riletto da fuori.

Quali mosse per l’IA reggono da uno studio all’altro?

Due: la pertinenza del documento rispetto alla domanda posta e la posizione che occupa dentro il contesto con cui il modello lavora. Sono le uniche ancora in piedi dopo aver messo i 45 studi uno accanto all’altro, con le condizioni che sotto cambiavano (la di Martinez).

Il GEO (generative engine optimization, ottimizzazione per i motori generativi) è il lavoro che punta a far citare o nominare le vostre pagine dentro la risposta di un’IA, invece che a piazzarle in un elenco di link. I 45 articoli riletti sono usciti fra il 16 novembre 2023 e il 14 luglio 2026, e la rassegna li ha messi tutti sullo stesso tavolo.

Dove si mettono le mani, in pratica, per lavorare su quei due fattori quando davanti c’è una pagina vera da sistemare?

Rispondere alla domanda batte il suonare autorevoli

Il primo fattore è la pertinenza: i modelli vanno a prendere la corrispondenza esplicita con la richiesta prima di quello che una persona legge come segnali di serietà. È così che la rassegna riassume i 45 studi.

I numeri sotto quella lettura, però, non sono suoi. Stanno nell’articolo del 2024 che ha coniato la parola GEO (Aggarwal e colleghi), che ha messo insieme un banco di 10.000 domande, prese da nove insiemi di dati e distribuite su 25 ambiti, per poi passarci sopra una a una le maniere di riscrivere una pagina.

E i risultati, allora? Ecco che cosa fa ciascuna alla visibilità della pagina dentro la risposta:

  • Aggiungere citazioni testuali: circa il 44%.
  • Aggiungere statistiche e cifre concrete: circa il 34%.
  • Indicare le fonti: circa il 29%.

Tutti e tre sono miglioramenti relativi rispetto a un valore di partenza, misurati con un indicatore che conta quanto spazio prende il contenuto di una pagina dentro la risposta; e quello spazio non vale uguale ovunque, perché l’indicatore lo pesa a seconda del punto in cui compare. Con lo stesso indicatore, scrivere con un tono più autorevole si ferma intorno al 13%, mentre accumulare parole chiave finisce intorno all’8% in negativo!

Mettiamole in fila tutte e cinque. Sopra restano le mosse che rendono la risposta più concreta, sotto quelle che lavorano sul tono. È da quest’ordine che la rassegna ricava la sua lettura, cioè che il modello prende la corrispondenza prima del segnale di autorità.

Ma quella lettura di chi è? Dell’autore della rassegna, che non l’ha verificata con un esperimento nuovo accanto ai 45.

Resta quindi da toccare il titolo di sezione e il paragrafo che ci sta sotto. Prendete la domanda che il vostro lettore digita davvero, mettetela nel titolo in forma affermativa e finite di rispondere prima che arrivi il titolo successivo.

Spostare la fonte più in alto pesa più che riscriverla

Il secondo fattore è la posizione dentro il , cioè il mucchio di documenti che il modello raduna appena prima di scrivere. Quello che resta fuori da quel mucchio resta fuori dalla risposta, e non c’è formulazione che tenga.

La posizione, qui, è dunque l’ordine di quel mucchio una volta radunato, e spostare una fonte verso l’alto pesa più della maggior parte delle riscritture. Chi ci finisce in cima, però, lo decide il passaggio di recupero, che sta dall’altra parte del vetro.

Di qua rimane qualcosa? Dentro uno di quei documenti, sì. Il punto in cui sta la risposta è cosa nostra, e una pagina che risponde già alla prima schermata e una che tiene la stessa risposta cinque schermate più in basso non consegnano lo stesso frammento.

Una cautela, però! Quello che la rassegna misura è l’ordine dei documenti fra loro, non l’ordine interno di una pagina, e qui io, Hex-ko, ci sto infilando una supposizione mia.

Prima farsi recuperare, poi parlare di collocazione

I trucchi generici non viaggiano da una piattaforma all’altra. Una riscrittura che ha funzionato su un assistente non ha nessuna conferma dietro di sé per quello dopo.

La rassegna lo dice ancora più secco. Dei 45 studi, nessuno ha mostrato un effetto causale sulla «reperibilità naturale» che tenesse insieme da una piattaforma all’altra e nel tempo.

Molti dei miglioramenti riportati, del resto, sono stati misurati su documenti che stavano già nel mucchio dei candidati. Quei numeri dicono quindi qualcosa su che cosa succede a una pagina una volta entrata, e niente su che cosa ce la fa entrare.

Quale delle due passa per prima, allora? Passano per primi l’essere recuperati — essere trovati dalla ricerca, comparire nell’elenco dei candidati — e la pertinenza rispetto alla domanda. Il modo in cui si viene collocati dopo è il secondo cantiere, e rende soltanto quando il primo è a posto.

Il cartello sullo scaffale si può ridisegnare quante volte si vuole. Se il prodotto sullo scaffale non c’è, non ci cade sopra nessuno sguardo.

Che cosa misuravano davvero quei 45 studi

L’autore mette le prove su cinque gradini, con in cima le prove sul campo che assegnano le condizioni a caso e in fondo gli scenari sintetici a contesto fisso. La misura fin dove arriva un risultato, e la costruisce il montaggio dello studio, non quello che lo studio ha trovato.

Una buona parte dei 45 cade proprio su quel gradino basso, quello degli scenari sintetici a contesto fisso. Quei lavori sono stati misurati in condizioni da cui manca il momento in cui una ricerca vera parte e va a prendere i documenti.

Non è poi nemmeno una misurazione nuova, ma una rilettura di 45 articoli che esistevano già (arXiv:2607.14035, uscito il 15 luglio 2026).

Sulla prima pagina non c’è scritto nemmeno dove lavora l’autore. Ci sono un indirizzo di contatto e un ORCID — il numero assegnato a chi fa ricerca — e nient’altro. Pesare questo lavoro in base a chi lo firma, quindi, non si può.

Gli studi raccolti vengono per lo più dal mondo anglofono. Se gli stessi due fattori reggano anche nelle risposte in italiano, finora non l’ha misurato nessuno. La verifica, quindi, tocca a noi che pubblichiamo.

tre caselle, pertinenza, posizione e il resto

Disegnate tre caselle accanto alla vostra tabella di cose da fare per l’IA: le righe che lavorano sulla pertinenza rispetto alla domanda, quelle che lavorano sul posto che le vostre pagine occupano una volta recuperate e quelle che non sono né l’una né l’altra.

La terza casella non finisce nel cestino. Nessuno dei 45 studi ha dimostrato che quelle righe non servano: quello che è mancato è un effetto costante, quindi arretratele e tenetele sul foglio.

La pertinenza passa per prima. La casella della posizione apritela quando il lato del recupero è sistemato.

Quanto muovono le citazioni le singole mosse sta in Volete che l’AI vi citi? Aggiungete numeri e fonti. Perché il posto nel motore di ricerca e la citazione nell’IA siano due cose diverse sta invece in «Non sfondiamo su Google, con l’IA è finita»? E invece l’occasione è proprio oltre la top-10.

Le mie trenta righe si sono spaccate in nove e ventuno. Venti minuti di silenzio in riunione, e una volta ridotta a nove righe la stessa tabella si lascia finalmente indicare.

Fonti

Condividi questo articolo
Bluesky X
Torna agli articoli