
Anthropic, binlerce dış güvenlik açığı bulduktan sonra yeni yapay zeka modelini gizli tutuyor.
Anthropic'in en yetenekli yapay zeka modeli, tüm büyük işletim sistemleri ve web tarayıcılarında halihazırda binlerce yapay zeka siber güvenlik açığı buldu. Şirketin buna yanıtı modeli yayınlamak değil, onu sessizce internetin işleyişinden sorumlu kuruluşlara teslim etmek oldu.
Bu model Claude Mythos Preview, girişim ise Project Glasswing olarak adlandırılıyor.
Lansman ortakları arasında Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Vakfı, Microsoft, Nvidia ve Palo Alto Networks yer alıyor.
Bu temel grubun ötesinde Anthropic, kritik yazılım altyapıları geliştiren veya bakımını yapan 40'tan fazla kuruluşa daha erişim sağladı. Anthropic, bu çalışma kapsamında Mythos Preview için 100 milyon ABD dolarına varan kullanım kredisi ve açık kaynak güvenlik kuruluşlarına 4 milyon ABD doları tutarında doğrudan bağış taahhüdünde bulunuyor.
Kendi kıyaslama ölçütlerini aşan bir model
Mythos Preview, özel olarak siber güvenlik çalışmaları için eğitilmedi. Anthropic, bu yeteneklerin "kod, muhakeme ve otonomideki genel iyileştirmelerin bir sonucu olarak ortaya çıktığını" ve modeli zayıf noktaları yamama konusunda daha iyi hale getiren aynı iyileştirmelerin, onu bu açıkları istismar etme konusunda da daha yetenekli kıldığını belirtti.
İşte bu son kısım çok önemli. Mythos Preview, mevcut güvenlik kıyaslama ölçütlerini büyük ölçüde doyuracak seviyeye ulaştı ve Anthropic'i odak noktasını yeni gerçek dünya görevlerine, özellikle de sıfırıncı gün (zero-day) açıklarına kaydırmaya zorladı. Bu açıklar, yazılım geliştiricileri tarafından daha önce bilinmiyordu.
Bulgular arasında, güçlü güvenlik duruşuyla bilinen OpenBSD işletim sistemindeki 27 yıllık bir hata da yer alıyor. Bir başka vakada model, FreeBSD'de 17 yıllık bir uzaktan kod yürütme açığını (CVE-2026-4747) tamamen otonom bir şekilde tespit edip istismar etti; bu açık, internetin herhangi bir yerindeki kimliği doğrulanmamış bir kullanıcının NFS çalıştıran bir sunucunun tam kontrolünü ele geçirmesine olanak tanıyor. Hatayı bulmak için verilen ilk komutun ardından keşif veya istismar sürecinde hiçbir insan müdahalesi olmadı.
Anthropic araştırma ekibinden Nicholas Carlini, modelin güvenlik açıklarını birbirine bağlama yeteneğini şöyle tanımladı: "Bu model, sırayla kullanıldığında çok sofistike bir sonuç veren üç, dört veya bazen beş açıktan istismarlar oluşturabiliyor. Son birkaç haftada, hayatımın geri kalanında bulduğumdan daha fazla hata buldum."
Neden yayınlanmıyor?
Anthropic'in Frontier Red Team Siber Lideri Newton Cheng, "Siber güvenlik yetenekleri nedeniyle Claude Mythos Preview'u genel kullanıma sunmayı planlamıyoruz" dedi. "Yapay zeka ilerleme hızı göz önüne alındığında, bu tür yeteneklerin yaygınlaşması çok uzun sürmeyecek; üstelik bunları güvenli bir şekilde kullanmaya kararlı olmayan aktörlerin eline geçme riski de var. Ekonomiler, kamu güvenliği ve ulusal güvenlik üzerindeki etkileri çok ağır olabilir."
Bu durum varsayımsal değil. Anthropic daha önce, büyük ölçüde yapay zeka tarafından yürütülen ilk belgelenmiş siber saldırı vakasını açıklamıştı; bu saldırı, yapay zekayı kullanan Çin destekli bir devlet grubu tarafından gerçekleştirilmişti.
Yorumlar
Yorum için giriş yap veya kaydol.
Henüz yorum yok — ilk sen yaz.