Yapay zeka modellerinin kullanım alanları genişlerken, ruh sağlığıyla ilgili konuşmalarda verdikleri yanıtların önemi artıyor. Kullanıcıların günlük stres, ilişki sorunları veya daha ciddi ruh sağlığı problemleri hakkında yapay zekaya başvurması, bu modellerin çeşitli durumlarda doğru ve güvenli yanıtlar verebilmesini kritik hale getiriyor.
OpenAI, bu alandaki performansı ölçmek amacıyla MentalHealthBench adlı yeni bir karşılaştırmalı değerlendirme aracı geliştirdi. Şirket, 22 ülkeden 80 ruh sağlığı uzmanıyla birlikte oluşturduğu MentalHealthBench'i herkese açık olarak tanıttı. Bu araç, yapay zeka modellerini yalnızca kriz anlarındaki yanıtları üzerinden değerlendirmiyor.
Günlük stres, yaşam sorunları ve daha ciddi ruh sağlığı problemleri gibi farklı senaryoları kapsayan değerlendirme, modellerin güvenlik gözetme, gerektiğinde ek bilgi isteme, kullanıcıların kendi kararlarını verme özgürlüğüne saygı gösterme ve uygun olduğunda uygulanabilir öneriler sunma gibi davranışlarını inceliyor.
Değerlendirme kapsamında yetişkinler, gençler, bakım verenler ve klinisyenler için çeşitli senaryolar oluşturuldu. Bu senaryolar, düşük ve yüksek ciddiyet düzeylerinin yanı sıra acil ruh sağlığı krizlerini de kapsıyor.
OpenAI, farklı dil ve bölgelerdeki kullanım biçimlerini de değerlendirmeye dahil ettiğini belirtiyor. Şirketin açıklamasına göre, değerlendirme sonuçları, yapay zeka modellerinin insanların ruh sağlığı sorunlarıyla başa çıkmasına yardımcı olma konusunda geliştiğini gösteriyor.
OpenAI ayrıca, yayımladığı blog yazısında ChatGPT'nin terapi veya profesyonel ruh sağlığı hizmetlerinin yerini tutmadığını vurguluyor. Şirket, modellerin gerektiğinde kullanıcıları gerçek hayattaki destek kaynaklarına ve güvendikleri kişilere yönlendirebilmesinin de önemli olduğunu belirtiyor.






































