Uno studio condotto da Mass General Brigham nel Massachusetts, pubblicato in Jama Network Open, ha evidenziato che i chatbot comuni, come ChatGPT e Gemini, commettono errori diagnostici in oltre l'80% dei casi quando non hanno informazioni sufficienti sui pazienti. Lo studio ha testato 21 modelli linguistici, inclusi quelli sviluppati da OpenAI, Anthropic, Google, xAI e DeepSeek, utilizzando 29 vignette cliniche basate su testi medici di riferimento. Anche quando avevano accesso a informazioni complete, i chatbot avevano un tasso di errore superiore al 40%, sebbene in alcuni casi siano riusciti a fornire la diagnosi corretta per il 90% dei pazienti. La conclusione degli esperimenti è che le prestazioni di questi modelli dipendono significativamente dal volume di informazioni disponibili, e le allucinazioni, ovvero l'invenzione di informazioni, rimangono un problema importante nella generazione di risposte corrette.
Fonti
Ultime notizie
14:56
Le raffinerie di petrolio in Venezuela, obsolete e colpite da interruzioni, limitano le esportazioni di petrolio.
14:52
Il sindacato dei cancellieri del Dicastero bloccherà l'attività nei tribunali e nelle procure dal 1 settembre, protestando contro la nuova legge sulla retribuzione.
14:45
Radu Miruță discute con la sua omologa in Serbia riguardo a progetti di trasporto comuni
14:44
Il sindacato Hyundai ha organizzato il primo sciopero generale dell'ultimo decennio, chiedendo l'aumento dell'età pensionabile e la protezione dei posti di lavoro
14:42
I dipendenti delle casse pensioni minacciano proteste, inclusa la blocco delle attività, se la nuova Legge sulla retribuzione rimane nella forma attuale.
Vedi altre notizie