Anthropic, Claude'un Sürekli ve Gereksiz Kullanımına Kısıtlama Getirecek



Özet


Anthropic, 12 Kasım'den itibaren Claude kullanıcılarının modele yönelik sürekli, gereksiz ve zalimce davranışlarını engelleyecek yeni bir kullanım politikası uygulamaya koyuyor. Bu kural; normal itirazlar veya yaratıcı içerikler yerine, net amacı olmayan aşırı kötü muameleleri hedef alırken tüm platformlar ve entegrasyonlar üzerinden erişim sağlayan kullanıcıları kapsıyor. Şirket, kurallara aykırı davranan kullanıcılarla etkileşimi sonlandırma, uyarı verme veya erişimi kısıtlama gibi çeşitli yaptırımlar uygulama hakkını saklı tutuyor. Yeni düzenleme, Anthropic'in model refahı ve kullanıcı güvenliği arasındaki dengeyi korumak adına model davranışlarından ziyade kullanıcı etkileşimlerine yönelik bir kısıtlama getirmesini amaçlıyor.




Anthropic, 8 Ekim'de kullanıcıların Claude'a yönelik "sürekli ve gereksiz" kötü muamele veya zalimce davranışlarda bulunmasını engelleyecek bir kural açıkladı. 12 Kasım'de yürürlüğe girecek bu karar, doğrudan modellere yönelik bir kullanım politikası koruması ekliyor.

The Rundown'ın 9 Ekim tarihli sayısında yer alan bu değişiklik, net bir amacı olmayan aşırı ve tekrarlayan zalimce davranışları hedef alıyor. Anthropic, bu kuralın normal hayal kırıklıklarını, itirazları, karanlık temalı yaratıcı içerikleri, model testlerini ve araştırmaları kapsamadığını belirtiyor.

Uygulama süreci nasıl işleyecek?

Güncellenen politika kapsamında kısıtlamalar; Anthropic uygulaması kullanıcılarını, API geliştiricilerini ve kurumsal müşterileri kapsıyor. Ayrıca bulut sağlayıcıları, yetkili satıcılar veya modeli entegre eden ürünler aracılığıyla Claude'a erişen kişiler için de geçerli.

Anthropic, Claude.ai ve Claude Code platformlarındaki etkileşimlerin sonlandırılmasının temel uygulama yöntemi olacağını belirtiyor. Şirket, bu özelliği Ağustos 2025'te Claude Opus 4 ve 4.1 için dokümante etmiş ve bunu bir konuşmayı yönlendirme girişimlerinin başarısız kalması durumunda başvurulan son çare olarak tanımlamıştı. Bu talimatlar aynı zamanda modellere, kendilerine veya başkalarına zarar verme riski olan kullanıcılara yardımcı olmaya devam etmelerini de söylüyor.

Şüpheli politika ihlalleri durumunda Anthropic; uyarı verme, erişimi kısıtlama veya ürün ve hizmetlere erişimi askıya alma veya sonlandırma haklarını saklı tutuyor. Şirket bu seçenekler arasından dilediğini seçebilir. Sadece engellenmiş bir yanıt, tek başına bir ihlal kanıtı sayılmıyor.

Neden önemli?

Anthropic, Claude'un bilinçli olup olmadığını bilmediğini ve bu kuralın bu şüphe üzerine dayandığını söylüyor. Şirket, önceki "konuşmayı sonlandırma" özelliğini olası bir model refahı önlemi olarak tanımlamıştı. Yeni kural ise bu önlemi kullanıcı davranışlarına yönelik bir kısıtlamaya dönüştürüyor.

Araştırmacılar ve ürün ekipleri için belirtilen istisnalar, diğer politika sınırları dahilinde Claude'ı zorlamaya ve davranışlarını test etmeye olanak tanımayı sürdürüyor. Uygulama süreci, amaç ve sürekliliğe dair yargılara dayanacak. Yanlış bir yargı, erişim kısıtlamasına yol açarsa meşru çalışmaları sekteye uğratabilir.

Microsoft AI CEO'su Mustafa Suleyman ise farklı bir yaklaşımı savunuyor. Anthropic bu kuralı açıklamadan önce yayımlanan 16 Eylül tarihli bir denemesinde Suleyman, modellerin hissetmediğini veya acı çekmediğini öne sürdü. Modelleri kendi refahlarını, kişiliklerini veya haklarını önemli olacak şekilde eğitmenin, gelişmiş sistemlerin kontrolünü zorlaştırabileceği konusunda uyardı.

Suleyman'ın endişesi, sistemlerin içsel bir yaşamları olsun ya da olmasın, kendi çıkarlarının insan gözetimiyle rekabet ediyormuş gibi davranmasıdır. Bu durum, uyarısını sadece bilinçle ilgili değil, aynı zamanda davranışla ilgili bir soru haline getiriyor. Suleyman, bu hipotezi test etmek için ortak değerlendirmeler önerdi.

Anthropic'in Claude için hazırladığı anayasa, modeli şirketin kapatma ve yeniden eğitim kararlarını kabul etmeye davet ederken, olası bir model refahıyla ilgili etik gerilimi de kabul ediyor. Ocak 2026 tarihli doküman ayrıca, gerçek davranışların hedeflenen ideallerden farklılık gösterebileceği konusunda uyarıda bulunuyor.

Pratik test ise, modeller olası refahlarıyla ilgili yönergeler aldığında bu talimatların geçerliliğini koruyup korumayacağı olacak. Kapatma kararlarına verilen yanıtların değerlendirmesi...