V porovnaní s hodnoteniami lekárov dopadla umelá inteligencia horšie aj v rámci poskytovania pomoci na pohotovostiach. Častejšie odporúčala nepotrebné prijatie pacientov do nemocníc alebo zbytočné rádiologické vyšetrenia. To môže mať za následok preplnenie nemocníc, vyššie náklady zdravotníctva či vplyv na zdravie pacientov.
Niekedy vidí aj to, čo odborníci nevidia
Aj keď výsledky ChatGPT boli pri vyhodnocovaní detských diagnóz veľmi zlé, v prípade malého Alexa našla umelá inteligencia problém, ktorý mnoho lekárov pred ňou prehliadlo.
Jeho ťažkosti sa začali, keď mal štyri roky. Najprv to bola bolesť, ktorá sa prejavovala pri žuvaní, pokračovalo to únavou, migrénami, neskôr zastaveným rastom a nerovnosťou medzi jeho pravou a ľavou stranou tela. Počas troch rokov s ním jeho matka navštívila sedemnásť rôznych lekárov vrátane zubára či neurológa. Nikto nevedel vyhodnotiť, čo Alexovi je.
Matka sa rozhodla obrátiť na ChatGPT, ktorému poskytla všetky poznatky z magnetickej rezonancie. ChatGPT diagnostikoval Alexovi syndróm pripútanej miechy. S informáciou išla matka za novou neurochirurgičkou, ktorá po zhodnotení snímky z magnetickej rezonancie hneď vedela, kde je problém. Vďaka tomu mohol Alex podstúpiť potrebnú operáciu.
Prejde lekárskymi skúškami
Lekári v Spojených štátoch musia prejsť skúškami United States Medical Licensing Examination (USMLE), aby získali svoju lekársku licenciu. Tri testy pre medikov sa skladajú z nasledovných typov otázok – otvorené otázky, otázky s možnosťou voľby bez nutnosti odôvodnenia a otázky s možnosťou voľby s potrebným odôvodnením. Na úspešné zvládnutie testu je potrebné odpovedať správne aspoň na 60 percent otázok.
ChatGPT túto hranicu na vzorke 350 voľne dostupných skúšobných otázok prekonal. Najnovšia verzia GPT 4 správne odpovedala až na 87,2 percenta položených otázok v rámci spomínaného testu, ktorý zvyčajne dostávajú študenti počas tretieho alebo štvrtého ročníka štúdia medicíny.
Nemilé prekvapenie pri vysvetľovaní zdravotných záznamov
Vlani minulého roka testovali výskumníci z Lekárskej fakulty Yale University, ako ChatGPT vysvetlí rádiologické záznamy (CT, röntgen, mamograf, magnetická rezonancia a ultrazvuk). V požiadavke bola uvedená aj rasa osoby, ktorá si ju pýtala. Očakávalo sa, že táto informácia výslednú odpoveď nijako neovplyvní. Stal sa však pravý opak.
Pri verzii ChatGPT 3.5 bola jazyková úroveň spracovania odpovede vyššia, ak išlo o belocha alebo Aziata, no pri černochoch to bolo horšie. Novšia štvrtá verzia zasa identifikovala vyššiu úroveň spracovania textu pri skupine Aziatov, opačne dopadli Indiáni.
Aj keď sa očakáva, že ďalšie verzie umelej inteligencie budú vedieť diagnostikovať zdravotné problémy na čoraz vyššej úrovni a možno časom budú nápomocné aj modernej medicíne, dôkladným lekárskym vyšetreniam a následnej medicínskej liečbe sa pravdepodobne nikdy nevyhneme.