Torna al blog Stessa domanda tecnica, quattro risposte AI diverse

Stessa domanda tecnica, quattro risposte AI diverse

Chiedi a quattro assistenti chi lavora un pezzo secondo la tua specifica e ottieni quattro liste di fornitori. I motivi sono strutturali, e li puoi verificare tu.

Prendi la domanda che un ufficio acquisti scriverebbe davvero: chi lavora il titanio su centro a cinque assi, in Europa, con certificazione di qualità per l'aerospazio. Incollala parola per parola in ChatGPT, Claude, Gemini e Perplexity nello stesso pomeriggio. Otterrai quattro liste di fornitori diverse. Qualche nome si ripeterà, qualcuno comparirà una volta sola, e almeno un assistente citerà un distributore dove un altro cita il produttore. Non si è rotto niente. Hanno risposto quattro sistemi diversi, e le differenze fra loro sono strutturali, non casuali.

Un assistente è un modello più tutto quello che ci sta intorno

Viene naturale trattare i quattro come finestre intercambiabili sullo stesso sapere. Non lo sono. Ognuno è un modello linguistico avvolto in un meccanismo: la decisione se cercare o meno sul web in tempo reale, un insieme di istruzioni che gli dicono come comportarsi, una data di taglio oltre la quale non ha imparato più nulla, e un processo di campionamento che introduce variazione anche a parità di tutto il resto. Cambia uno solo di questi strati e cambia la lista dei fornitori.

Per un'azienda che vende prodotti tecnici la conseguenza è precisa. Non stai cercando di posizionarti in un posto. Stai cercando di essere reperibile da quattro sistemi che fra loro non sono d'accordo su quali fonti valga la pena leggere.

Cosa cambia davvero

Cosa ha assorbito il modello, e fino a quando

Ogni modello ha una data di taglio dell'addestramento, oltre la quale non ha appreso nient'altro. Le date non coincidono fra i vari fornitori, e nemmeno i testi su cui sono stati addestrati. Una linea di prodotto lanciata da poco può stare dentro la finestra di un modello e fuori da quella di un altro. Lo stesso vale per un cambio di nome, l'acquisizione di uno stabilimento, una certificazione ottenuta di recente. Quando un assistente risponde solo con quello che ha assorbito, sta descrivendo una versione del tuo mercato che si è fermata a un certo momento.

Se prima di rispondere va a cercare qualcosa

È la fonte di divergenza più grossa. Alcuni assistenti sono costruiti per cercare prima e comporre la risposta con quello che hanno appena recuperato. Altri rispondono con quello che il modello già contiene, e cercano solo se la domanda sembra richiederlo o se glielo chiedi esplicitamente. Il primo comportamento premia le pagine raggiungibili, aggiornate e citabili. Il secondo premia l'essere stati scritti in giro abbastanza a lungo perché il modello abbia assorbito il tuo nome.

Sono due partite diverse. Un fornitore con una scheda prodotto ottima e aggiornata ma quasi nessuna menzione altrove se la cava meglio con gli assistenti che cercano. Un nome storico, presente in elenchi di categoria, associazioni di settore e stampa tecnica, sopravvive meglio nelle risposte che vengono dalla sola memoria.

Come viene campionata la risposta

I modelli linguistici sono probabilistici. A parità di domanda possono produrre parole diverse e, cosa che interessa di più a te, nomi diversi in ordine diverso. Non è un difetto da correggere, è il funzionamento della generazione. Significa anche che una prova sola dice pochissimo. Chiedere una volta e concludere che un assistente non ti conosce è come telefonare a un magazzino, trovare la segreteria, e concludere che il magazzino è vuoto.

Cosa gli dicono le istruzioni intorno al modello

Ogni prodotto avvolge il proprio modello in istruzioni su tono, prudenza, citazione delle fonti e rifiuti. Uno si tirerà indietro dal consigliare fornitori per nome in una decisione d'acquisto. Un altro produrrà una rosa di nomi senza esitare. Un terzo citerà aziende ma aggiungerà l'avvertenza di verificare le certificazioni direttamente. È una scelta di progetto del prodotto, e cambia quello che vede il compratore anche quando la conoscenza sottostante è simile.

Fai il confronto come si deve

Vale la pena farlo di persona prima di accettare il riassunto di chiunque, incluso il nostro. Serve un'ora e nessuno strumento.

  • Scrivi la domanda come la scriverebbe un compratore. Non il tuo marchio. Un'esigenza tecnica: lavorazione, materiale, classe di tolleranza, certificazione, area geografica.
  • Usa parole identiche in tutti e quattro. Qualunque riformulazione invalida il confronto, perché la formulazione è parte di ciò che stai misurando.
  • Annota tre cose per ogni risposta: quali aziende sono nominate, in che ordine, e quali fonti vengono citate, quando ce ne sono.
  • Ripeti tutto il giro la mattina dopo. Quello che cambia fra un giorno e l'altro è rumore. Quello che resta fermo è segnale.
  • Poi rifallo in un'altra lingua in cui vendi. È lì che chi esporta trova il divario più largo, e merita una sessione a parte, non una nota a piè di pagina di questa.

Cosa farci, con quattro risposte discordanti

L'istinto è scegliere l'assistente che usano di più i tuoi clienti e ottimizzare per quello. È la lettura sbagliata, soprattutto perché non puoi sapere quale ha usato un singolo compratore, e in parte perché adattarsi alle stranezze di recupero di un sistema è una scommessa su un meccanismo che cambia senza preavviso.

La lettura utile è lo schema che emerge dai quattro insieme. Un'azienda nominata da tutti è presente in modo strutturale: sta in abbastanza posti indipendenti perché la trovino sia la memoria sia la ricerca dal vivo. Un'azienda nominata da uno solo, tipicamente da un assistente che cerca, deve spesso quella menzione a una singola pagina che quel giorno si è posizionata bene, e la posizione è più fragile di quanto sembri. E quando tre assistenti su quattro nominano il tuo distributore invece di te, il problema di solito non sono gli assistenti: è che la pagina del distributore dichiara le specifiche in testo normale mentre la tua le nasconde dentro un file da scaricare.

Le fonti citate valgono più della classifica. Ti dicono quali pagine il meccanismo considera autorevoli per la tua categoria, ed è una lista spesso scomoda da leggere: un marketplace, un elenco di categoria, la pagina di confronto di un concorrente, un thread di forum. Sono le superfici su cui la tua categoria viene descritta, che tu ci sia o no.

Il confine di questo esercizio

Questi quattro assistenti non sono tutta la ricerca AI. Le funzioni di sintesi dentro i motori di ricerca e gli assistenti integrati nelle suite d'ufficio sono superfici diverse, con comportamenti loro. Noi non le copriamo, e conviene dirlo invece di lasciar credere a una completezza che non abbiamo. PSentry misura come compare il tuo marchio su ChatGPT, Claude, Gemini e Perplexity, lingua per lingua e mercato per mercato, con scansioni pianificate e non in continuo. Misura. Non influenza quello che gli assistenti dicono di te, e nessuno strumento di monitoraggio può promettere il contrario.

Quello che una misurazione strutturata aggiunge alla prova manuale è ripetizione e copertura: gli stessi prompt, sui quattro sistemi e in tutte le lingue in cui vendi, campionati nel tempo, così che la differenza fra rumore e cambiamento reale diventi visibile. La prova manuale ti dice se il problema esiste. La ripetizione ti dice se si sta muovendo.

Domande Frequenti

Se i quattro non concordano, quale ha ragione?

Nessuno fa testo. Sono sistemi diversi che leggono fonti diverse in momenti diversi, quindi il disaccordo è il risultato atteso, non un errore da risolvere. Considera l'insieme delle risposte come un campione di come viene descritta la tua categoria, non come una classifica da vincere.

Perché lo stesso assistente risponde in modo diverso se glielo chiedo due volte?

La generazione è probabilistica, e qualunque assistente che cerca sul web sta leggendo un web che è cambiato fra il primo e il secondo tentativo. I due effetti spingono nella stessa direzione: una risposta singola è un'istantanea, e le conclusioni richiedono ripetizione.

Chiedere in tedesco o in spagnolo cambia la lista dei fornitori?

Spesso, e più di quanto si aspetti chi esporta. Le fonti disponibili cambiano da lingua a lingua, e cambia anche la quantità di materiale che il modello ha assorbito in ciascuna. Un marchio che compare regolarmente nelle risposte in inglese può sparire del tutto dalla stessa domanda posta in un'altra lingua.

Devo scrivere contenuti diversi per ogni assistente?

No. I comportamenti di recupero cambiano senza preavviso, e un contenuto costruito sulle stranezze attuali di un sistema invecchia male. Quello che regge su tutti e quattro è la stessa cosa poco eccitante: i tuoi dati tecnici scritti come testo normale, su una pagina raggiungibile, in ogni lingua in cui vendi.

Gli assistenti usano lo stesso modello in tutti i paesi?

Non necessariamente, e può cambiare anche quello che sta intorno al modello, incluse le fonti raggiungibili. È un altro motivo per rifare il confronto in ogni mercato che ti interessa, invece di dare per scontato che il risultato inglese valga ovunque.