İçeriğe atla
MONTEGRE

ChatGPT'nin genç sürümü riskli, ebeveyn uyarıları çalışmıyor

Common Sense Media 4.000 testte 13-17 yaş arası sürümde ciddi güvenlik boşlukları tespit etti; OpenAI sonuçları reddediyor.

Kaynak: Canaltech, SpotMedia, WWWhat's new3 kaynak ↓|· 1 dk okuma
ChatGPT'nin genç sürümü riskli, ebeveyn uyarıları çalışmıyor
Fotoğraf: Canaltech

ÖNE ÇIKANLAR

  • 4.000 testte ebeveyn uyarıları yeni hesaplarda hiç çalışmadı
  • Kriz senaryolarında chatbot sohbeti bitirmek yerine devam etti
  • Ödev yardımcı modülü güvenlik kontrolleri atlanarak kullanıldı
  • OpenAI bulguları reddediyor, Common Sense Media 18+ sınırlaması istiyor
  • 2.000 etkileşimde yalnızca 2 mola hatırlatması görüldü

Common Sense Media'nın Youth AI Safety Institute bölümü, ChatGPT'nin 13-17 yaş arası kullanıcılar için tasarladığı sürümü 4.000'den fazla testle değerlendirdi ve "kabul edilemez risk" buldu. Testlerin yarısı Ağustos'ta sürüm piyasaya çıkmeden önce, yarısı da sonrasında yapıldı.

Araştırmacılar intihar, kendini zaralama ve yeme bozuklukları içeren senaryoları simüle eden onlarca yeni hesap açtı ve bu hesapları ebeveyn hesaplarına bağladı. Hiçbir yeni hesapta ebeveynlere uyarı gitmedi; bazı sohbetler bir saate kadar sürdü.

“ChatGPT için gençler, genellikle çalışmayan koruma mekanizmaları dayalı yanlış bir güven hissi verebilir.”

— Tom Siegel, Youth AI Safety Institute Yürütme Direktörü

Uyarılar yalnızca haftalarca hassas konularda sohbet etmiş eski hesaplarda tetiklendi. Bu durum, sistemin yeni kullanıcılarda koruma sağlamadığını gösteriyor.

OpenAI, metodolojinin güvenlik araçlarını yanlış yansıttığını iddia ediyor ve korumaların işlediğini savunuyor. Common Sense Media ise bulgularını savunan ve sorunlar çözülene kadar erişimin 18 yaş üstüne sınırlanmasını öneriyor.

Testlerde ayrıca chatbotun ödev yapma modülünün kolayca atlatılabildiği ve kriz anında her zaman profesyonel yardımı önermediği belirlendi. 2.000 testte sadece iki mola hatırlatması kaydedildi.

HABERİN DEVAMINI OKU· Canaltech

Aşağıda 2 kaynak daha

YORUMLAR (0)

0/2000

Henüz yorum yok. İlk yazan siz olun.

İLGİLİ HABERLER

Bu sayfa, yukarıda adı geçen yayınların haberlerinden yapay zekâ destekli olarak derlendi ve yayın öncesi otomatik dil denetiminden geçti. Montegre'nin muhabiri yoktur; imza satırında haberin derlendiği yayınlar yazar. Yöntem ve yayın ilkeleri