
Anthropic: Yapay zeka araştırmalarında Claude liderliğini koruyor
Özet
Anthropic tarafından paylaşılan verilere göre, Claude yapay zekası Ağustos ayındaki Ar-Ge çalışmalarının %26'sında insan gözetimi altında "lider" seviyesine ulaşarak Şubat ayına oranla büyük bir gelişim gösterdi. Şirket, yapay zekanın iş birliği yaparak görevlerin %90'ından fazlasını tamamladığını ancak tam otonom üretim aşamasına henüz geçmediğini belirtti. Bu tablo, CEO Dario Amodei'nin yapay zekanın ilerleme hızına yönelik uyarılarıyla paralel olarak, teknolojinin kendi gelişiminde artık daha baskın bir rol oynadığını kanıtlıyor. Anthropic, bu süreçte güvenliği sağlamak adına devasa bir ajanı izleme ve engelleme sistemi üzerinde çalışmalarını sürdürüyor.
Anthropic, Ağustos ayındaki yapay zeka araştırma ve geliştirme çalışmalarının %26'sında Claude'u "lider" seviyesine yerleştiren kurum içi tahminlerini yayınladı. Bu oran, Şubat ayındaki %1'in altındaki seviyeden önemli ölçüde artış gösteriyor. Söz konusu çalışmalar insan gözetimi altında gerçekleştiriliyor.
The Rundown'da yer alan bu veriler, yapay zekanın artık yapay zekayı geliştirmede ne kadar fazla rol oynadığını kamuoyuna daha yakından gösteriyor. Bu rakamlar, CEO Dario Amodei'nin bu ayın başlarında yapay zekanın ilerleme hızını yavaşlatma çağrısında bulunmasının ardından ortaya çıktı.
Anthropic, Claude'un rolünü nasıl ölçtü?
Anthropic, Epoch AI'ın ölçeklendirme yöntemini insan süresiyle ağırlıklandırılmış sabit bir görev setine uyguladı. "Lider" ifadesi, Claude'un bir görevin çoğunu insan gözetimi altında tamamlaması anlamına geliyor. Yapay zeka, ölçülen çalışmaların %90'ından fazlasında insan yönetimi altındaki çalışmaları da içeren "iş birliği veya üzeri" seviyesine ulaştı. Tam otonomi oranı ise sıfır oldu. Bu seviye; bir sorunu tespit etme, çözme ve insanın dahil olmadığı bir süreçle sonucu üretime gönderme anlamına geliyor.
Görevleri Claude'un kendisi puanladı ve puanlar %59 oranında insan değerlendirmeleriyle tam olarak eşleşti. Puanlamalar, çalışmaların ölçek üzerindeki yeri hakkında görüş ayrılıklarına açık kapı bırakıyor.
En büyük dahili platformunda Anthropic, aynı anda çalışan yaklaşık 30.000 ajanı bildirdi. Tüm eylemlerin izlemeye alındığını, Ağustos ayındaki bir milyardan fazla karardan yaklaşık 47.000'ünün engellendiğini belirtti. İzleme iddiası bu platformu kapsıyor.
Güvenlik çalışmaları, 13–20 Temmuz期間ı arasında R&D (Ar-Ge) hesaplama kaynaklarının yaklaşık %6'sını aldı. Bu kesit, koruma sınıflandırıcılarını kapsamıyordu.
Neden önemli?
12 Eylül'de Amodei, yapay zekanın kendi haleflerini geliştirmeye yardımcı olmasının, geliştirme sürecini insanların ortaya çıkan sistemleri anlayıp kontrol edebileceğinin ötesine geçebileceği konusunda uyardı. Hemen ardından yaptığı taahhütle, Anthropic'e çalışanlarla benzer yetkilere sahip dış değerlendiricileri dahil etmeyi amaçladı. Daha geniş sınırlar ve ortak standartlar ise şirketler ve hükümetler arasındaki koordinasyona bağlı olacak.
Bu ölçümler, yavaşlama çağrısını daha somut hale getiriyor. Şirketten diğerlerine hız kesme çağrısı yapılmasına rağmen, otomasyonun içeride ne kadar ilerlediğini açıkça ortaya koyuyor. Araştırmacılar ve güvenlik ekipleri için insan gözetimi, inceleme sürecinin daha fazla deneyi takip edip edemeyeceği konusunda hala zor bir soru bırakıyor. Anthropic, insanların hedefleri seçmeye devam ederken insanların işi yürüttüğü modellerle araştırmaların hız kazanabileceğini savunuyor. Şirket, bir halefin tam otonom geliştirilmesinin henüz gerçekleşmediğini ve bunun kaçınılmaz olmadığını belirtiyor.
Kamuoyuna şeffaflık ise bu rakamları kimlerin test edebileceğine bağlı. Amodei, şirketlerin kendi açıklamalarına neleri dahil edip neleri dışlayacaklarını seçtiklerini kabul ediyor. Dışarıdaki kişilerin bu önlemlerin geçerli olup olmadığını yargılayabilmesi için değerlendiricilerin temel kayıtları incelemesi, sınıflandırmalara itiraz etmesi ve olumsuz bulguları raporlaması gerekecek.
Engellenen kararların oranı, ne kadar çok sorunun tespit edilemediği konusunda soru işaretleri bırakıyor. Temmuz 15 itibarıyla durumu kapsayan Anthropic'in Ağustos risk raporu, şirketin henüz uçtan uca otomatik çevrimdışı izlemesini değerlendirmediğini belirtti. Tespit kalitesine dair kanıtlar, değerlendiricilerin Ağustos ayı platform izlemesini ölçmesine yardımcı olacaktır.
Anthropic somut bir adım attı. Eylül'de...
Yorumlar
Yorum için giriş yap veya kaydol.
Henüz yorum yok — ilk sen yaz.