Uno studio condotto da Mass General Brigham nel Massachusetts, pubblicato in Jama Network Open, ha evidenziato che i chatbot comuni, come ChatGPT e Gemini, commettono errori diagnostici in oltre l'80% dei casi quando non hanno informazioni sufficienti sui pazienti. Lo studio ha testato 21 modelli linguistici, inclusi quelli sviluppati da OpenAI, Anthropic, Google, xAI e DeepSeek, utilizzando 29 vignette cliniche basate su testi medici di riferimento. Anche quando avevano accesso a informazioni complete, i chatbot avevano un tasso di errore superiore al 40%, sebbene in alcuni casi siano riusciti a fornire la diagnosi corretta per il 90% dei pazienti. La conclusione degli esperimenti è che le prestazioni di questi modelli dipendono significativamente dal volume di informazioni disponibili, e le allucinazioni, ovvero l'invenzione di informazioni, rimangono un problema importante nella generazione di risposte corrette.
Fonti
Ultime notizie
21:50
Sorin Grindeanu critica la designazione di Luca Niculescu: «La nuova nomina del presidente alla carica di primo ministro continua a sfidare la matematica parlamentare»
21:42
George Simion e Petrișor Peiu annunciano che AUR non voterà il governo proposto dal premier designato Luca Niculescu
21:26
Daniil Medvedev, squalificato a Pechino / Novak Djokovic si è qualificato per la finale dopo che il russo ha colpito uno spettatore
21:09
Shivon Zilis ha annunciato la brusca separazione da Elon Musk, dopo che il miliardario le aveva detto di amarla
21:04
Luca Niculescu è stato designato primo ministro da Nicușor Dan
Vedi altre notizie