Istraživanje koje su proveli istraživači sa Carnegie Mellon University izazvalo je zabrinutost u vezi pouzdanosti AI chatbota za samo-dijagnozu. Istraživanje je testiralo velike jezičke modele poput GPT-5, Gemini i Claude tako što im je predstavilo medicinske upite kojima nedostaju bitni vizualni podaci, kao što su slike krtica na koži ili rentgenski snimci prsa. U 18% slučajeva, ovi modeli su izmišljali dijagnoze na temelju čimbenika kao što su starost, spol i rasa, što je dovelo do potencijalno obmanjujućih zaključaka. Na primjer, 65-godišnjem bijelcu koji je upitao krticu na koži dijagnosticiran je melanom u gotovo svim odgovorima, iznimno niska vjerojatnost ovog ishoda. Slično tome, GPT-5 je često pogrešno dijagnosticirao mlade crne pacijente s sarkoidozom kada su mu predstavljeni pitanja o rentgenskim snimcima na prsima. Ovi nalazi naglašavaju značajne nedostatke u sposobnosti AI-a da precizno tumači medicinske podatke i naglašava rizike za kritične zdravstvene odluke.
Procjena pristranosti (Sredina): Članak predstavlja uravnoteženu analizu tehničkih ograničenja umjetne inteligencije u medicinskoj dijagnostici bez otvorene podrške ili kritike određenih političkih ideologija.



