Hooxlab
Hooxlab — hooxlab.it
AI senza giungla · Puntata 4 di 7

Perché l'AI inventa, e come pretendere risposte con le fonti

Un'intelligenza artificiale può sbagliare con la stessa sicurezza con cui ha ragione. Perché succede, tre casi in cui è costato caro, e il test da fare a qualunque fornitore prima di fidarsi.

Chiunque abbia usato un chatbot ha visto almeno una volta una risposta perfetta nella forma e sbagliata nel contenuto: un riferimento normativo che non esiste, una data spostata, un prodotto attribuito al fornitore sbagliato. Detta con calma, con frasi ben costruite, senza un'ombra di dubbio.

Nella puntata precedente abbiamo parlato di dati. Qui parliamo di affidabilità: perché l'AI a volte inventa, e cosa pretendere da uno strumento che userai per lavorare.

Se un collega ti desse una risposta senza dirti dove l'ha trovata, ti fideresti?

Perché l'AI inventa

Un modello linguistico non consulta un archivio di fatti. Ha imparato, da enormi quantità di testo, quali parole tendono a seguire quali altre. Quando gli fai una domanda, costruisce la risposta più plausibile, parola dopo parola.

Il più delle volte la risposta plausibile è anche quella giusta. Ma quando l'informazione non c'è, o è rara, il modello non si ferma: completa comunque, con qualcosa che suona corretto. Un numero di articolo verosimile, una sentenza con un nome credibile. In gergo si chiamano allucinazioni.

Non è un difetto da correggere con un aggiornamento: è il modo in cui questi modelli funzionano. Si può ridurre, molto. Ma va gestito.

Tutti documentati, tutti con la stessa lezione: chi usa la risposta ne risponde.

Tre casi in cui è costato caro

Gli avvocati di New York

Un atto depositato in tribunale citava sentenze trovate con ChatGPT. Non esistevano. Il giudice ha multato gli avvocati per 5.000 dollari (caso Mata contro Avianca).

Stati Uniti · giugno 2023

Il chatbot di Air Canada

Il chatbot del sito ha promesso a un cliente un rimborso che le regole della compagnia non prevedevano. Il tribunale ha dato ragione al cliente: la compagnia risponde di ciò che dice il suo chatbot.

Canada · febbraio 2024

Il tribunale di Firenze

In un atto difensivo comparivano sentenze della Cassazione inesistenti, trovate con ChatGPT da una collaboratrice dello studio. Il giudice ha segnalato il problema della mancata verifica.

Italia · marzo 2025

Il problema non è che l'AI sbagli: sbagliano anche le persone. È che sbaglia con lo stesso tono di quando ha ragione.

La soluzione: prima cerca, poi risponde

Il rimedio più efficace è cambiare il lavoro che chiediamo al modello. Invece di farlo rispondere «a memoria», gli si fa prima cercare nei documenti giusti i passaggi che riguardano la domanda, e poi gli si chiede di rispondere usando solo quei passaggi.

È lo schema che abbiamo descritto nella puntata 2. Ha due effetti. Le invenzioni calano molto, perché il modello ha davanti il testo giusto. E ogni risposta può indicare da dove viene: documento, pagina, sezione. Se nei documenti la risposta non c'è, lo strumento deve poterlo dire.

Ma le fonti non bastano da sole

Cercare nei documenti riduce gli errori, non li azzera. Un gruppo di ricercatori di Stanford lo ha misurato nel 2024 su strumenti professionali di ricerca legale, costruiti proprio con questo schema e venduti come affidabili.

Strumenti di ricerca legale con AI: risposte con errori o fonti inventate (almeno)

Westlaw AI-Assisted Research
34%
Lexis+ AI
17%
Ask Practical Law AI
17%
Fonte: Stanford RegLab e HAI, Magesh et al., maggio 2024

Per confronto, in uno studio precedente degli stessi gruppi, i chatbot generici inventavano sulle stesse materie tra il 58% e l'82% delle volte. Cercare nei documenti migliora molto le cose. Ma anche nel caso migliore, circa una risposta su sei andrebbe corretta.

Ecco perché la fonte non è un dettaglio: è ciò che permette di verificare in pochi secondi, invece di fidarsi o rifare tutta la ricerca a mano. Una risposta con il rimando alla pagina si controlla con un clic. Una risposta senza fonte si può solo prendere per buona.

Dieci minuti, con i tuoi documenti. Se lo strumento non lo supera, non è pronto per lavorare.

Il test da fare a qualunque fornitore

Chiedi qualcosa che non c'è

Fai una domanda la cui risposta non è nei documenti caricati. Lo strumento deve dire che non lo sa, non inventare.

Prova 1

Chiedi da dove viene

Ogni risposta deve indicare documento e pagina, meglio se con un link che apre il punto esatto.

Prova 2

Apri la fonte

Controlla che il passaggio citato dica davvero quello che c'è nella risposta. Una citazione può essere sbagliata anche lei.

Prova 3

Cambia le parole

Fai la stessa domanda in modo diverso. Le risposte devono essere coerenti e citare le stesse fonti.

Prova 4

Segui la serie

Martedì la puntata 5: dieci domande da fare a un fornitore di AI prima di firmare, in una checklist da salvare.

Perché la fonte cambia la fiducia

Le citazioni non servono solo a scovare gli errori. Cambiano il modo in cui le persone usano lo strumento.

  • Chi è nuovo impara più in fretta: ogni risposta lo porta dentro il documento giusto, invece di sostituirlo.
  • Chi è esperto si fida di più, perché può controllare senza perdere tempo, e lo usa davvero.
  • La responsabilità resta chiara: la decisione la prende una persona, che sa su quale testo si è basata.

Fidarsi è bene. Verificare in un clic è meglio.

Le domande frequenti.

Si può eliminare del tutto il rischio che l'AI inventi?
No, si può ridurre molto. Per questo conta che ogni risposta mostri la fonte: l'errore residuo diventa facile da vedere.
Come capisco se una risposta è inventata?
Guarda la fonte. Se non c'è, o se il passaggio citato non dice quello che dice la risposta, trattala come un'ipotesi da verificare.
Se l'AI dà un'informazione sbagliata a un cliente, chi ne risponde?
L'azienda che la usa. Nel caso di Air Canada il tribunale ha respinto l'idea che il chatbot fosse responsabile da sé: ciò che dice il tuo strumento lo dici tu.
Servono documenti speciali perché funzioni?
No, servono documenti ordinati e aggiornati. Se due versioni di una procedura si contraddicono, l'AI lo mostrerà: è un buon momento per sistemarle.
Un percorso dal generale al concreto, due articoli a settimana.

Le prossime puntate

01

Scegliere un servizio AI: 10 domande prima di firmare

Puntata 5 · 27 ottobre

02

Quanto costa davvero portare l'AI in azienda

Puntata 6 · 29 ottobre

03

Dalla teoria alla pratica: la nostra risposta

Puntata 7 · 3 novembre

Vuoi vedere risposte con le fonti, sui tuoi documenti?

Scegli qualche documento della tua azienda: ti mostriamo come risponde un assistente che cita pagina e sezione.