Une étude réalisée par Mass General Brigham dans le Massachusetts, publiée dans Jama Network Open, a mis en évidence que les chatbots ordinaires, tels que ChatGPT et Gemini, se trompent dans les diagnostics dans plus de 80 % des cas lorsqu'ils n'ont pas suffisamment d'informations sur les patients. L'étude a testé 21 modèles linguistiques, y compris ceux développés par OpenAI, Anthropic, Google, xAI et DeepSeek, en utilisant 29 vignettes cliniques basées sur des textes médicaux de référence. Même lorsqu'ils avaient accès à des informations complètes, les chatbots avaient un taux d'erreur de plus de 40 %, bien que dans certains cas, ils aient réussi à fournir le bon diagnostic pour 90 % des patients. La conclusion des expériences est que la performance de ces modèles dépend significativement du volume d'informations disponibles, et les hallucinations, c'est-à-dire l'invention d'informations, restent un problème majeur dans la génération de réponses correctes.
Sources
Dernières actualités
22:05
L’Arabie saoudite et l’Égypte mettent en garde contre la menace houthie en mer Rouge. Mohammed ben Salmane et al-Sissi demandent la liberté de navigation dans le détroit de Bab al-Mandab
21:49
OpenAI, Anthropic et Google DeepMind collaborent pour la sécurité de l’intelligence artificielle
21:46
Gendarmerie roumaine : Les manifestants ont jeté des pierres et des bâtons. Deux véhicules spéciaux, vandalisés
21:41
Le ministre turc des Affaires étrangères avertit que l’extension de la guerre en mer Noire et les attaques contre les navires sont inacceptables
21:39
Le général Andriy Biletskiy annonce des avancées ukrainiennes : plus de 10 kilomètres carrés libérés dans le cadre de l’opération Vivaldi
Voir plus d’actualités