Arama · son güncelleme 3 sa önce
1-5 / 5 haber Sayfa 1 / 1
Tıp & Sağlık
1 May

Yapay zeka sağlıkta: Doktorların ChatGPT kullanımı için yeni değerlendirme standardı

Milyonlarca hekim günlük pratiğinde ChatGPT'yi kullanıyor ancak bu etkileşimlerin ne kadar etkili olduğu belirsizdi. Araştırmacılar, yapay zeka modellerinin tıbbi performansını gerçek doktor-AI sohbetleri üzerinden değerlendiren HealthBench Professional adlı yeni bir ölçüm sistemi geliştirdi. Bu benchmark, hekimlerin en sık başvurduğu üç ana alanda AI'ın başarısını ölçüyor: hasta konsültasyonu, tıbbi yazım-dokümantasyon ve medikal araştırma. Her örnek, gerçek hekimler tarafından yazılan ChatGPT konuşmalarından oluşuyor ve üç veya daha fazla doktor tarafından değerlendiriliyor. Sistem, mevcut AI modellerinin zorlandığı durumları özellikle içeriyor ve gelecekteki gelişmeleri takip etmeye olanak sağlıyor.

arXiv — Hesaplamalı Dilbilim (cs.CL) 0
Tıp & Sağlık
21 Apr

Yapay Zeka Modellerinden Sağlık Müdahalelerine: Kontrafaktüel Açıklamalar

Araştırmacılar, büyük dil modellerini kullanarak sağlık alanında yenilikçi bir yaklaşım geliştirdi. Kontrafaktüel açıklamalar olarak adlandırılan bu yöntem, bir yapay zeka modelinin kararını değiştirmek için gerekli minimum değişiklikleri belirliyor. Bu teknoloji hem hastalıkların önlenmesi için müdahale stratejileri geliştirmekte, hem de daha güçlü AI modelleri eğitmek için veri artırımında kullanılabiliyor. GPT-4, BioMistral-7B ve LLaMA-3.1-8B gibi farklı dil modellerinin karşılaştırıldığı çalışmada, özellikle fine-tune edilmiş LLaMA-3.1-8B modeli dikkat çekiyor. Bu model %99'a varan güvenilirlik oranıyla gerçekçi ve uygulanabilir öneriler sunuyor. Klinik veri setleri üzerinde yapılan testlerde, sistemin hem müdahale kalitesi hem de özellik çeşitliliği açısından başarılı sonuçlar verdiği görülüyor.

arXiv (CS + AI) 0
Tıp & Sağlık
21 Apr

Yapay Zeka Modellerinin Tıbbi Görüntü Analiz Yeteneği Sınırlı Kaldı

Araştırmacılar, yapay zeka modellerinin gerçek klinik ortamlarda karşılaştıkları çoklu görüntü analizinde ne kadar başarılı olduklarını test etti. MedThinkVQA adlı yeni benchmark, her vakada ortalama 6,62 görüntü içeren 8.067 tıbbi durumu kapsıyor. Çalışmanın sonuçları, en gelişmiş AI modellerinin bile bu konuda zorlandığını ortaya koydu. En iyi performans gösteren Claude ve GPT modelleri %55-57 doğruluk oranına ulaşırken, açık kaynak modeller daha da geride kaldı. Bu bulgular, AI'nın tıp alanındaki uygulamalarında hâlâ önemli sınırları olduğunu gösteriyor.

arXiv (Dilbilim & NLP) 0
Tıp & Sağlık
21 Apr

Yapay Zeka İlaç Güvenliği Araştırmalarında Uzman Danışman Olabilir mi?

Araştırmacılar, büyük dil modellerinin farmakoepidemiiyolojik çalışma tasarımında ne kadar güvenilir olduğunu test etti. GPT-4o ve DeepSeek-R1 gibi genel amaçlı yapay zeka sistemleri, özel olarak tıp alanında eğitilmiş modellere kıyasla daha başarılı sonuçlar verdi. Çalışma, 2018-2024 yılları arasındaki 46 protokol üzerinde gerçekleştirildi ve ileri düzey yönlendirme teknikleri kullanıldı. Sonuçlar, yapay zekanın ilaç güvenliği araştırmalarının planlanmasında destek sağlayabileceğini ancak henüz tam güvenilir olmadığını gösteriyor.

arXiv (CS + AI) 0
Tıp & Sağlık
13 Apr

VerifAI: Tıbbi Sorulara Doğrulanabilir Yanıt Veren Yeni Yapay Zeka Sistemi

Araştırmacılar, biyomedikal alanda sorulan sorulara yanıt veren ve her bilgiyi kaynaklarıyla doğrulayabilen VerifAI adlı yeni bir yapay zeka sistemi geliştirdi. Sistem, ürettiği her yanıtı küçük parçalara bölerek bilimsel literatürle karşılaştırıyor ve yanlış bilgi üretme riskini minimize ediyor. Geleneksel yapay zeka modellerinden farklı olarak, VerifAI her iddiasını kaynaklarıyla destekliyor ve şeffaf bir doğrulama mekanizması sunuyor. Test sonuçları, sistemin GPT-4'ü bile geride bırakacak doğrulukta çalıştığını gösteriyor. Sağlık alanında yapay zeka kullanımının güvenilirliğini artırmayı hedefleyen bu sistem, açık kaynak olarak sunularak tüm araştırmacıların erişimine açıldı. Özellikle tıbbi karar verme süreçlerinde yanlış bilginin hayati sonuçlar doğurabileceği düşünüldüğünde, bu gelişme büyük önem taşıyor.

arXiv (CS + AI) 0