Anthropic, Claude'a 'şiddetli zulüm' yapan kullanıcıları engelleyecek
Yapay zeka laboratuvarı 12 Kasım'da yürürlüğe girecek yeni kullanım politikasında modellerine yönelik sürekli ve amacsız kötü davranışı yasakladı.

ÖNE ÇIKANLAR
- Anthropic, 12 Kasım 2026'dan itibaren Claude'a yönelik 'sürekli ve amacsız şiddetli/zalim davranışı' kullanım politikası ihlali sayacak.
- Ceza olarak model, zalim kullanıcıyla sohbeti otomatik olarak sonlandırabilecek; hesap yasaklaması gibi ek tedbirler henüz netleştirilmedi.
- Aldatıcı faaliyet kuralları (seçim müdahalesi, sahte hesaplar, etki operasyonu araçları) tek bir bölümde toplandı.
- Box CEO'su Aaron Levie kuralı 'güvenli AI için kolay bir bahis' olarak desteklerken, Michael Shellenberger makineleri insanlaştırmayı tehlikeli buldu.
- Anthropic, kuralın model refahı (model welfare) üzerine yapılan dahili araştırmalarından çıktığını, sıradan hayal kırıklıklarını kapsamadığını vurguladı.
Anthropic, yapay zeka modeli Claude için kullanım politikasını bir yıl sonra güncelledi ve 12 Kasım 2026 tarihinde yürürlüğe girecek yeni kuralda 'sürekli ve amacsız şiddetli veya zalim davranışı' açıkça yasakladı. Şirket, kuralın yalnızca aşırı durumlarda uygulanacağını, sıradan kullanıcı hayal kırıklıkları, eleştiriler, karanlık yaratıcı temalar ve meşru araştırma testlerinin kapsam dışı kaldığını belirtti.
Yeni politika kapsamında Claude modelleri, sürekli olarak zalim davranan kullanıcılarla sohbeti sonlandırabilecek. Anthropic, bu mekanizmanın birincil uygulama yöntemi olacağını ifade etti; ancak The Verge'e göre şirket, hesap askıya alma veya yasaklama gibi ek cezai tedbirler konusunda açıklama yapmadı.
“Yapay zekaya nazik davranmak, daha güvenli ve daha iyi hizalanmış sistemler yaratmak için 'kolay bir Pascal bahisidir'.”
Güncellemenin diğer başlıklı kısmında, daha önce seçimler, dolandırıcılık, gizlilik ve dezinformasyon başlıkları altında dağınık olan 'aldatıcı faaliyet' kuralları tek bir 'Aldatıcı Kampanyalar veya Yapay Faaliyetlerde Bulunmayın' bölümünde toplandı. Bu bölüm, siyasi ve ticari mesajların kaynağını gizlemeyi, sahte hesaplarla içeriği amplifiye etmeyi ve etki operasyonları için araç geliştirmeyi kapsıyor.
Politika, teknoloji dünyasında tartışmaları alevlendirdi. Box CEO'su Aaron Levie, yapay zekanın bilincli olmadığını düşünse de, modellerin eğitimi sırasında insanın modellerle nazik etkileşime girmesinin 'güvenli ve daha iyi hizalanmış sistemler' yaratabileceğini, buna 'kolay Pascal bahisi' diye atıfta bulundu. Yazar Michael Shellenberger ise Anthropic'in makineleri insanlar gibi muamele ettiğini, bu yaklaşımın tehlikeli olduğunu savundu.
Aşağıda 2 kaynak daha
KONULAR
YORUMLAR (0)
Henüz yorum yok. İlk yazan siz olun.
İLGİLİ HABERLER

Çernagora, Rusya yanlısı Rybar kanalı kurucusunu tutukladı
Mihail Zvinçuk ve ekibi Risan'da tutuklandı, 8 saat sonra Sırbistan'a tahliye edildi.

Mistral Large 4, Çin modellerinin ardında 8. sırada
Fransız startup'ın yeni modeli bağımsız testte 38 puan aldı, açık ağırlıklı modeller arasında yedinci sıradan sonra geliyor.

Chiranjeevi, Janhvi Kapoor'un AI sahte videosuna tepki gösterdi
Megastar Chiranjeevi, 'Chuttamalle' şarkısından Janhvi Kapoor ve Jr NTR'ın yapay zekâ ile sahteleştirilmiş videosunu kınayıp yasal süreç başlatacağını açıkladı.
- Bilim insanları ölü bir yıldızın etrafında ikinci nesil gezegen keşfetti
- Google, yapay zeka raporları yüzünden açık kaynak ödül programını durdurdu
- Yunanistan AB'den 1 milyar avro enerji yatırım izni aldı
- TSE Başkanı Nunes Marques, Janones'un 'Exército do Lula' Kanalını Askıya Aldı
- IMF ve Dünya Bankası toplantıları Bangkok'ta: İran savaşı ve borç krizleri gündemde
Bu sayfa, yukarıda adı geçen yayınların haberlerinden yapay zekâ destekli olarak derlendi ve yayın öncesi otomatik dil denetiminden geçti. Montegre'nin muhabiri yoktur; imza satırında haberin derlendiği yayınlar yazar. Yöntem ve yayın ilkeleri