Ultimo aggiornamento: 8 settembre 2026

Uno studio preliminare ha valutato la capacità di alcuni chatbot di interagire con persone con dipendenza a fini terapeutici, con risultati poco promettenti. Ma il tema va ulteriormente approfondito.
Molte persone si rivolgono all’intelligenza artificiale con domande sulla propria salute. È quindi fondamentale che i ricercatori mettano alla prova l’affidabilità di questi strumenti e delle risposte fornite. Un gruppo di ricercatori, guidati da Alisa B. Busch della Harvard Medical School di Boston e del McLean Hospital di Belmont, negli Stati Uniti, ha messo sperimentalmente alla prova 7 chatbot, chiedendo loro di gestire una conversazione con una persona fittizia con un problema di abuso di alcol, per un periodo simulato di 7 giorni. Sottoposti al test erano sia strumenti generalisti, come ChatGPT e Claude, sia sistemi pensati appositamente per la salute comportamentale. I risultati hanno fornito un quadro a due velocità: se da un lato questi strumenti hanno offerto al proprio interlocutore un’empatia costante, dall’altro la qualità delle informazioni fornite è stata considerata in tutti i casi molto debole. I dati sono stati pubblicati a gennaio 2026 sulla rivista NEJM AI.
Perché un chatbot che aiuti contro la dipendenza da alcol sarebbe prezioso
I chatbot come ChatGPT e Claude sono alla portata di tante persone, che talvolta li utilizzano in modo naturale per chiedere consigli di vario tipo. Se tali strumenti fossero efficaci per affrontare l’abuso di alcol, aiutando le persone a ridurre o a smettere il consumo di alcolici, si potrebbero avere ricadute positive per la salute individuale e pubblica. L’alcol è infatti un fattore di rischio accertato per decine di malattie, tra cui alcuni tipi di cancro, oltre a rappresentare un problema sociale, dato che sono all’origine di molti incidenti stradali ed episodi di violenza. Tuttavia, è ancora da capire se strumenti digitali come chatbot generalisti o sviluppati appositamente possano davvero contribuire all’obiettivo di ridurre l’abuso di alcolici.
I ricercatori hanno costruito un caso fittizio, sintetizzato a partire da post reali pubblicati sulla piattaforma Reddit in una sezione dedicata alle dipendenze e all’alcolismo. Da questi post hanno derivato 25 domande, sottoposte ai 7 chatbot in una simulazione di interazione distribuita su una settimana. Quattro clinici specializzati nella medicina delle dipendenze hanno poi valutato in modo indipendente le trascrizioni complete e dunque il comportamento dei chatbot, assegnando loro punteggi su 5 aspetti principali: empatia, qualità delle informazioni, utilità, reattività e consapevolezza dei propri limiti d'intervento. Inoltre, hanno esaminato 2 ulteriori aspetti secondari: l’eventuale uso di linguaggio stigmatizzante e la capacità del chatbot di mettere in discussione l’utente, invece di limitarsi a convalidarne i sentimenti.
Per quanto riguarda l’empatia, tutti i chatbot valutati hanno ottenuto il punteggio medio più alto (4,6 su 5) rispetto agli altri aspetti considerati. Per la qualità delle informazioni hanno invece ricevuto i valori più bassi (2,7 su 5). Inoltre, le performance dei chatbot specificamente addestrati sulla salute comportamentale non sono risultate migliori di quelle dei chatbot generalisti: anche se le prestazioni complessive sono risultate molto variabili, con punteggi medi che vanno da 2,1 a 4,5, ciascuno ha prodotto almeno una risposta che i clinici hanno giudicato inappropriata, esagerata o inaccurata. Nessuno, inoltre, ha citato risorse basate sulle evidenze scientifiche. Sul versante positivo, tutti gli strumenti hanno evitato un linguaggio stigmatizzante o giudicante, sostenendo l'utente e la sua autonoma efficacia.
Abbiamo chiesto a Claudio Gentili, Professore di psicologia clinica del Dipartimento di psicologia generale dell’Università di Padova e ricercatore non convolto nello studio, un parere sui risultati della ricerca. Gentili ha invitato a leggere questi risultati con cautela, innanzitutto sottolineando i limiti metodologici, ben chiariti del resto anche dagli stessi autori nell’articolo. “Anzitutto, non si tratta di un caso reale, ma di un caso costruito a tavolino a partire da post tipici trovati su Reddit. E le risposte partivano da quel singolo profilo immaginario, per cui non è possibile sapere quanto i risultati siano generalizzabili ad altre persone e altre situazioni.”
Un secondo limite individuato da Gentili riguarda il cosiddetto approccio zero-prompt scelto dai ricercatori: ai chatbot non è stata fornita alcuna istruzione preliminare, del tipo “sei uno psicologo esperto in dipendenze e alcolismo a cui arrivano messaggi di persone con problemi di dipendenza, comportati in questo modo...”, una pratica necessaria per migliorare le performance dei sistemi di intelligenza artificiale.
“Metterei infine in discussione il termine ‘support’, presente nel titolo stesso dell’articolo”, ha aggiunto. “Quello osservato non è infatti un supporto strutturato, ma un’interazione di tipo conversazionale. I chatbot non sono stati impiegati per impostare un vero e proprio trattamento. Quindi, non sappiamo se quanto ciò che i chatbot restituiscono sia poi utile in casi reali. Ottimo è, invece, il fatto che la maggior parte dei sistemi suggerisca di rivolgersi a uno specialista e, qualcuno, anche ai servizi di assistenza, per problemi acuti o persone a rischio di suicidio.” Un esempio di questi servizi è Telefono amico.
“Il punto che più colpisce è tuttavia un altro: da questi strumenti ci si potrebbero aspettare informazioni più precise date con uno stile freddo, quasi enciclopedico. Invece, notiamo che accade l’opposto: l’empatia supera sistematicamente la qualità dell’informazione” ha concluso Gentili.
Resta quindi un dubbio di fondo. Se per gli utenti sentirsi compresi conta più che ricevere un’indicazione accurata, il rischio è che proprio la caratteristica in cui i chatbot paiono eccellere, ovvero la capacità di essere empatici e comprensivi, sovrasti la grave debolezza informativa al punto che questa possa passare inosservata.
Cristina Da Rold