“GPT” için sonuçlar
5 sonuç bulundu. Sonuçları kategoriye göre daraltabilirsin.
Yapay zeka sağlıkta: Doktorların ChatGPT kullanımı için yeni değerlendirme standardı
Milyonlarca hekim günlük pratiğinde ChatGPT'yi kullanıyor ancak bu etkileşimlerin ne kadar etkili olduğu belirsizdi. Araştırmacılar, yapay zeka modellerinin tıbbi performansını gerçek doktor-AI sohbetleri üzerinden değerlendiren HealthBench Professional adlı yeni bir ölçüm sistemi geliştirdi. Bu benchmark, hekimlerin en sık başvurduğu üç ana alanda AI'ın başarısını ölçüyor: hasta konsültasyonu, tıbbi yazım-dokümantasyon ve medikal araştırma. Her örnek, gerçek hekimler tarafından yazılan ChatGPT konuşmalarından oluşuyor ve üç veya daha fazla doktor tarafından değerlendiriliyor. Sistem, mevcut AI modellerinin zorlandığı durumları özellikle içeriyor ve gelecekteki gelişmeleri takip etmeye olanak sağlıyor.
Yapay Zeka Modellerinden Sağlık Müdahalelerine: Kontrafaktüel Açıklamalar
Araştırmacılar, büyük dil modellerini kullanarak sağlık alanında yenilikçi bir yaklaşım geliştirdi. Kontrafaktüel açıklamalar olarak adlandırılan bu yöntem, bir yapay zeka modelinin kararını değiştirmek için gerekli minimum değişiklikleri belirliyor. Bu teknoloji hem hastalıkların önlenmesi için müdahale stratejileri geliştirmekte, hem de daha güçlü AI modelleri eğitmek için veri artırımında kullanılabiliyor. GPT-4, BioMistral-7B ve LLaMA-3.1-8B gibi farklı dil modellerinin karşılaştırıldığı çalışmada, özellikle fine-tune edilmiş LLaMA-3.1-8B modeli dikkat çekiyor. Bu model %99'a varan güvenilirlik oranıyla gerçekçi ve uygulanabilir öneriler sunuyor. Klinik veri setleri üzerinde yapılan testlerde, sistemin hem müdahale kalitesi hem de özellik çeşitliliği açısından başarılı sonuçlar verdiği görülüyor.
Yapay Zeka Modellerinin Tıbbi Görüntü Analiz Yeteneği Sınırlı Kaldı
Araştırmacılar, yapay zeka modellerinin gerçek klinik ortamlarda karşılaştıkları çoklu görüntü analizinde ne kadar başarılı olduklarını test etti. MedThinkVQA adlı yeni benchmark, her vakada ortalama 6,62 görüntü içeren 8.067 tıbbi durumu kapsıyor. Çalışmanın sonuçları, en gelişmiş AI modellerinin bile bu konuda zorlandığını ortaya koydu. En iyi performans gösteren Claude ve GPT modelleri %55-57 doğruluk oranına ulaşırken, açık kaynak modeller daha da geride kaldı. Bu bulgular, AI'nın tıp alanındaki uygulamalarında hâlâ önemli sınırları olduğunu gösteriyor.
Yapay Zeka İlaç Güvenliği Araştırmalarında Uzman Danışman Olabilir mi?
Araştırmacılar, büyük dil modellerinin farmakoepidemiiyolojik çalışma tasarımında ne kadar güvenilir olduğunu test etti. GPT-4o ve DeepSeek-R1 gibi genel amaçlı yapay zeka sistemleri, özel olarak tıp alanında eğitilmiş modellere kıyasla daha başarılı sonuçlar verdi. Çalışma, 2018-2024 yılları arasındaki 46 protokol üzerinde gerçekleştirildi ve ileri düzey yönlendirme teknikleri kullanıldı. Sonuçlar, yapay zekanın ilaç güvenliği araştırmalarının planlanmasında destek sağlayabileceğini ancak henüz tam güvenilir olmadığını gösteriyor.
VerifAI: Tıbbi Sorulara Doğrulanabilir Yanıt Veren Yeni Yapay Zeka Sistemi
Araştırmacılar, biyomedikal alanda sorulan sorulara yanıt veren ve her bilgiyi kaynaklarıyla doğrulayabilen VerifAI adlı yeni bir yapay zeka sistemi geliştirdi. Sistem, ürettiği her yanıtı küçük parçalara bölerek bilimsel literatürle karşılaştırıyor ve yanlış bilgi üretme riskini minimize ediyor. Geleneksel yapay zeka modellerinden farklı olarak, VerifAI her iddiasını kaynaklarıyla destekliyor ve şeffaf bir doğrulama mekanizması sunuyor. Test sonuçları, sistemin GPT-4'ü bile geride bırakacak doğrulukta çalıştığını gösteriyor. Sağlık alanında yapay zeka kullanımının güvenilirliğini artırmayı hedefleyen bu sistem, açık kaynak olarak sunularak tüm araştırmacıların erişimine açıldı. Özellikle tıbbi karar verme süreçlerinde yanlış bilginin hayati sonuçlar doğurabileceği düşünüldüğünde, bu gelişme büyük önem taşıyor.