Ana Sayfa Yapay Zeka Google AMIE, video sağlık görüşmelerinde doktorlarla benzer puan aldı

Google AMIE, video sağlık görüşmelerinde doktorlarla benzer puan aldı

0
7

Google, tıbbi yapay zekâ sistemi AMIE’nin video sürümüne ilişkin yeni araştırma sonuçlarını paylaştı. Sistem, profesyonel hasta oyuncularıyla yapılan senkron video konsültasyonlarda çeşitli temel ölçütlerde birinci basamak hekimleriyle benzer değerlendirme puanları aldı. Çalışma; kardiyopulmoner, abdominal, HEENT, nörolojik veya psikiyatrik ve kas-iskelet sistemi başlıklarında toplam 15 eğitimli oyuncunun canlandırdığı vakaları kapsadı. Bununla birlikte sonuçlar, gerçek hastalarda klinik kullanıma dair kesin çıkarım yapılabileceği anlamına gelmiyor; bu konuda doğrudan gerçek hastalarla yürütülecek ek çalışmaların gerekli olduğu özellikle belirtiliyor.

AMIE’nin video yapısı, tek bir modelin aynı anda konuşma, klinik akıl yürütme ve görsel-işitsel algı görevlerini üstlenmesi yerine asenkron çoklu ajan mimarisi kullanıyor. Bu yaklaşımın temel nedeni gecikme süresi. Doğal bir hasta-hekim diyaloğunda uzun duraksamalar iletişim kalitesini ve güven ilişkisini zedeleyebiliyor. Google’a göre tek bir ajan, bugün için hem doğal konuşma temposunu koruyup hem de ayrıntılı klinik değerlendirme yaparken eşzamanlı ses ve video akışını sürekli işlemek konusunda yeterli değil.

Mimaride konuşmacı ajan, hasta ile doğrudan sözlü etkileşimi yürütüyor ve görüşmenin akıcılığını korumaya çalışıyor. Arka planda çalışan planlayıcı ajan ise görüşme ilerledikçe olası tanıları ve yönetim planlarını güncelliyor, eksik bilgi noktalarını belirliyor ve klinik öncelikleri yeniden sıralıyor. Algı ajanı da video ve ses akışını sürekli inceleyerek sözsüz işaretler, fiziksel bulgular ve işitsel sinyalleri tespit etmeye çalışıyor; ardından bu gözlemleri görüşmenin klinik bağlamına yerleştiriyor. Böylece hasta tarafındaki yanıtlar, arka plandaki daha yavaş süreçlerin tamamlanmasını beklemeden verilebiliyor.

Doctor on a laptop as Google’s research medical AI system, AMIE (Video), conducted synchronous video consultations with professional patient actors and received clinical evaluator ratings on par with primary care physicians across several core measures.

Google’ın otomatik değerlendirmelerine göre bu üç ajanlı yapı; öykü alma, klinik akıl yürütme ve tedavi önerileri gibi alanlarda ölçülebilir iyileşme sağladı. Aynı değerlendirmelerde hasta odaklı iletişim ve yanıt gecikmesi de incelendi. Bu ilk aşama, insan değerlendiricilerle yapılacak çalışmadan önce sistem tasarımını hızla yinelemek ve zayıf noktaları görmek için kullanıldı.

İnsan değerlendirmesi tarafında çalışma çok kollu, rastgeleleştirilmiş bir tasarımla kuruldu. AMIE gerçek zamanlı video görüşmeler gerçekleştirdi. Metin tabanlı bir AMIE sürümü karşılaştırma tabanı olarak kullanıldı. Ayrıca kurul onaylı 10 birinci basamak hekimi de aynı video arayüzü üzerinden aynı tür görüşmelere katıldı. Tüm konsültasyonlar, deneyimli 20 bağımsız birinci basamak hekiminden oluşan bir panel tarafından yerleşik klinik puanlama çerçeveleriyle incelendi. Panel, önce genel klinik yeterliliği değerlendirdi; ardından her vaka için senaryoya özel ölçütleri uyguladı.

Araştırmanın sonuçlarına göre değerlendiriciler, AMIE’yi öykü alma kapsamı, tanısal doğruluk, yönetim planının uygunluğu ve iletişim kalitesi açısından birinci basamak hekimleriyle aynı düzeyde puanladı. Video sürümünün, aynı ölçütlerde metin tabanlı AMIE ile benzer ya da daha iyi performans gösterdiği de bildirildi. Ayrıca video sisteminin fiziksel bulguları ortaya çıkarma ve hasta oyuncularını sanal muayene manevraları konusunda proaktif biçimde yönlendirme becerisinde hem hekim grubundan hem de yalnızca metin kullanan AMIE’den daha yüksek puan aldığı aktarıldı. Vakaya özgü algı ve muayene skorları da benzer bir tablo çizdi.

Hasta oyuncuların geri bildirimleri de video arayüzü lehine oldu. Katılımcılar, senkron video görüşmesini metin sohbetine göre daha kolay kullanılabilir ve sağlık şikâyetlerini iletmek açısından daha etkili buldu. Aynı oyuncular, AMIE’yi empati, ilişki kurma ve sunulan bakım konusunda güven verme başlıklarında da olumlu değerlendirdi. Bu sonuçlar, sistemin yalnızca klinik maddeleri takip etmesi değil, aynı zamanda görüşme deneyimini de belli ölçüde yönetebilmesi açısından dikkat çekici.

Öte yandan çalışmanın sınırları oldukça belirgin. Profesyonel oyuncular, gerçek hasta karşılaşmalarındaki değişkenliği tam olarak yansıtamıyor. Ayrıca oyuncuların inandırıcı biçimde canlandıramayacağı bazı sunumlar çalışma dışında bırakıldı; bu tür vakalarda görsel ve işitsel algının tanısal değeri daha yüksek olabilir. Hedefe yönelik otomatik testlerde zaman zaman algı ve akıl yürütme hataları görüldüğü, ayrıca konuşmanın doğallığını kesintiye uğratabilen aralıklı teknik sorunların da yaşandığı belirtiliyor.

Bu nedenle mevcut bulgular, kontrollü senaryolarda video konsültasyon davranışı, sanal fizik muayene yönlendirmesi ve klinik puanlama açısından önemli olsa da, sistemin gerçek hastaları güvenli biçimde teşhis veya yönetebildiğini henüz göstermiyor. Google da bir sonraki aşamanın gerçek hastalarla araştırma olduğunu ifade ediyor. Şirketin metin tabanlı AMIE ile klinik ortamlarda yürüttüğü çalışmalar bulunuyor; Beth Israel Deaconess Medical Center ile yapılan fizibilite araştırmasının güvenlik ve kullanım açısından ilk verileri sunduğu, Included Health ile devam eden ülke çapında rastgeleleştirilmiş bir çalışmanın ise gerçek dünyadaki sanal bakım senaryolarını değerlendirdiği belirtiliyor. Kısacası AMIE’nin video sürümü umut verici bir araştırma aşamasında olsa da, üretim ortamında klinik kullanım için kanıt tabanı henüz sınırlı.

YORUM YOK