İçeriğe atla
MONTEGRE

Anthropic, Claude'a 'şiddetli zulüm' yapan kullanıcıları engelleyecek

Yapay zeka laboratuvarı 12 Kasım'da yürürlüğe girecek yeni kullanım politikasında modellerine yönelik sürekli ve amacsız kötü davranışı yasakladı.

Kaynak: Xataka México, Tbreak Media, Business Insider3 kaynak ↓|· 1 dk okuma
Anthropic, Claude'a 'şiddetli zulüm' yapan kullanıcıları engelleyecek
Fotoğraf: Xataka México

ÖNE ÇIKANLAR

  • Anthropic, 12 Kasım 2026'dan itibaren Claude'a yönelik 'sürekli ve amacsız şiddetli/zalim davranışı' kullanım politikası ihlali sayacak.
  • Ceza olarak model, zalim kullanıcıyla sohbeti otomatik olarak sonlandırabilecek; hesap yasaklaması gibi ek tedbirler henüz netleştirilmedi.
  • Aldatıcı faaliyet kuralları (seçim müdahalesi, sahte hesaplar, etki operasyonu araçları) tek bir bölümde toplandı.
  • Box CEO'su Aaron Levie kuralı 'güvenli AI için kolay bir bahis' olarak desteklerken, Michael Shellenberger makineleri insanlaştırmayı tehlikeli buldu.
  • Anthropic, kuralın model refahı (model welfare) üzerine yapılan dahili araştırmalarından çıktığını, sıradan hayal kırıklıklarını kapsamadığını vurguladı.

Anthropic, yapay zeka modeli Claude için kullanım politikasını bir yıl sonra güncelledi ve 12 Kasım 2026 tarihinde yürürlüğe girecek yeni kuralda 'sürekli ve amacsız şiddetli veya zalim davranışı' açıkça yasakladı. Şirket, kuralın yalnızca aşırı durumlarda uygulanacağını, sıradan kullanıcı hayal kırıklıkları, eleştiriler, karanlık yaratıcı temalar ve meşru araştırma testlerinin kapsam dışı kaldığını belirtti.

Yeni politika kapsamında Claude modelleri, sürekli olarak zalim davranan kullanıcılarla sohbeti sonlandırabilecek. Anthropic, bu mekanizmanın birincil uygulama yöntemi olacağını ifade etti; ancak The Verge'e göre şirket, hesap askıya alma veya yasaklama gibi ek cezai tedbirler konusunda açıklama yapmadı.

“Yapay zekaya nazik davranmak, daha güvenli ve daha iyi hizalanmış sistemler yaratmak için 'kolay bir Pascal bahisidir'.”

— Aaron Levie, Box CEO

Güncellemenin diğer başlıklı kısmında, daha önce seçimler, dolandırıcılık, gizlilik ve dezinformasyon başlıkları altında dağınık olan 'aldatıcı faaliyet' kuralları tek bir 'Aldatıcı Kampanyalar veya Yapay Faaliyetlerde Bulunmayın' bölümünde toplandı. Bu bölüm, siyasi ve ticari mesajların kaynağını gizlemeyi, sahte hesaplarla içeriği amplifiye etmeyi ve etki operasyonları için araç geliştirmeyi kapsıyor.

Politika, teknoloji dünyasında tartışmaları alevlendirdi. Box CEO'su Aaron Levie, yapay zekanın bilincli olmadığını düşünse de, modellerin eğitimi sırasında insanın modellerle nazik etkileşime girmesinin 'güvenli ve daha iyi hizalanmış sistemler' yaratabileceğini, buna 'kolay Pascal bahisi' diye atıfta bulundu. Yazar Michael Shellenberger ise Anthropic'in makineleri insanlar gibi muamele ettiğini, bu yaklaşımın tehlikeli olduğunu savundu.

YORUMLAR (0)

0/2000

Henüz yorum yok. İlk yazan siz olun.

İLGİLİ HABERLER

Bu sayfa, yukarıda adı geçen yayınların haberlerinden yapay zekâ destekli olarak derlendi ve yayın öncesi otomatik dil denetiminden geçti. Montegre'nin muhabiri yoktur; imza satırında haberin derlendiği yayınlar yazar. Yöntem ve yayın ilkeleri