Eine Studie von Mass General Brigham aus Massachusetts, veröffentlicht in Jama Network Open, hat gezeigt, dass gängige Chatbots wie ChatGPT und Gemini in über 80 % der Fälle falsche Diagnosen stellen, wenn sie nicht genügend Informationen über die Patienten haben. Die Studie testete 21 Sprachmodelle, darunter die von OpenAI, Anthropic, Google, xAI und DeepSeek entwickelt wurden, unter Verwendung von 29 klinischen Vignetten, die auf medizinischen Referenztexten basieren. Selbst wenn sie Zugang zu vollständigen Informationen hatten, hatten die Chatbots eine Fehlerquote von über 40 %, obwohl sie in einigen Fällen in der Lage waren, die richtige Diagnose für 90 % der Patienten zu stellen. Die Schlussfolgerung der Experimente ist, dass die Leistung dieser Modelle erheblich von der Menge der verfügbaren Informationen abhängt und Halluzinationen, also das Erfinden von Informationen, ein großes Problem bei der Generierung korrekter Antworten bleiben.
Quellen
Neueste Nachrichten
09:28
Meta verbietet Werbung für TikTok und andere ByteDance-Dienste in den USA und sechs weiteren Ländern und verschärft damit die Rivalität zwischen den beiden Unternehmen
09:13
Panama wurde von einem Erdbeben der Stärke 7,7 getroffen / Beschädigte Gebäude, eine verletzte Person und später aufgehobene Tsunami-Warnungen
08:48
Anthropic: Ein Claude-Modell übermittelte der Polizei in Philadelphia eine falsche Meldung über ein Verbrechen
Mehr Nachrichten ansehen