Yapay zekâ araçları, birçok alanda insanlara yardımcı olabilecek potansiyele sahipler. Özellikle sağlık alanında, yapay zekâ destekli sohbet botlarının, hastaların sorularını yanıtlayarak onlara rehberlik etmesi bekleniyor. Ancak, bu konuda henüz çok fazla araştırma yapılmadı ve yapay zekâ araçlarının güvenilirliği de tartışmalı.
New York Üniversitesi’nden (NYU) bir grup araştırmacı, bu konuda önemli bir çalışmaya imza attı. Araştırmacılar, popüler bir yapay zekâ modeli olan ChatGPT’nin, sağlık sorularına nasıl yanıt verdiğini ve insanların bu yanıtlara ne kadar güvendiğini test ettiler. Çalışma, JMIR Medical Education dergisinde yayınlandı.
Çalışmada, 18 yaş ve üzerindeki 392 kişiye, sağlıkla ilgili 10 soru ve yanıt gösterildi. Bu yanıtların yarısı ChatGPT tarafından üretilirken, diğer yarısı bir sağlık çalışanına aitti. Katılımcılardan, yanıtların kaynağını tahmin etmeleri ve güvenilirliklerini 5 puanlık bir ölçekte değerlendirmeleri istendi.
Çalışmanın sonucunda, katılımcıların %65’i civarının doğru tahminde bulunduğu görüldü. Bu da, ChatGPT’nin sağlık sorularına insanlardan ayırt edilemeyecek seviyede yanıt verebildiğini gösterdi. Ancak, katılımcıların sohbet botunun yanıtlarına pek güvenmediği de ortaya çıktı. Özellikle hastalık teşhisi ve tedavi tavsiyeleri gibi konularda sohbet botunun güvenilirliği düşüktü. Randevu ayarlama gibi basit sorularda ise daha yüksek güven oranları elde edildi.
Araştırmacılar, bu çalışmanın yapay zekâ araçlarının sağlık alanındaki potansiyelini gösterdiğini ancak daha fazla araştırma gerektirdiğini belirtiyorlar. Zira yapay zekâ araçları, sık sık hatalar yapabiliyor ve yanlış bilgi verebiliyorlar. Bu nedenle, sohbet botlarının sağlık alanında kullanılması için daha fazla test ve denetim yapılması gerekiyor.