Une étude réalisée par Mass General Brigham dans le Massachusetts, publiée dans Jama Network Open, a mis en évidence que les chatbots ordinaires, tels que ChatGPT et Gemini, se trompent dans les diagnostics dans plus de 80 % des cas lorsqu'ils n'ont pas suffisamment d'informations sur les patients. L'étude a testé 21 modèles linguistiques, y compris ceux développés par OpenAI, Anthropic, Google, xAI et DeepSeek, en utilisant 29 vignettes cliniques basées sur des textes médicaux de référence. Même lorsqu'ils avaient accès à des informations complètes, les chatbots avaient un taux d'erreur de plus de 40 %, bien que dans certains cas, ils aient réussi à fournir le bon diagnostic pour 90 % des patients. La conclusion des expériences est que la performance de ces modèles dépend significativement du volume d'informations disponibles, et les hallucinations, c'est-à-dire l'invention d'informations, restent un problème majeur dans la génération de réponses correctes.
Sources
Dernières actualités
08:19
L’ouragan Isaias a tué quatre personnes et privé 670 000 habitants d’électricité dans le sud-est des États-Unis
08:03
Les agriculteurs ukrainiens réduisent les superficies cultivées pour 2027 en raison de la crise provoquée par le blocage des exportations
07:40
Un homme de Pennsylvanie, aux États-Unis, a tué huit personnes, dont deux enfants et une femme enceinte, puis se serait suicidé
07:23
Le FBI envisage d’attribuer à l’UFC un contrat exclusif pour former ses agents au combat rapproché
07:11
Les autorités saoudiennes confirment 12 morts et plus de 300 blessés après l’attaque contre l’aéroport de Riyad
Voir plus d’actualités