
OpenAI'dan kovulan araştırmacılardan suçlamalara tepki: Daha net kurallar istiyorlar
Özet
OpenAI tarafından hassas bilgileri yanlış yönettiği gerekçesiyle işten çıkarılan üç güvenlik araştırmacısı, suçlamaları reddederek bu kararın şirketin güvenlik çalışmalarını sekteye uğratabileceği uyarısında bulundu. Araştırmacılar, görev tanımları dahilinde hareket ettiklerini savunurken, bu işten çıkarmaların dış denetçilerin sisteme dahil edilmesini engellemek için bir kılıf olarak kullanılmasından endişe duyduklarını dile getirdiler. Buna karşın OpenAI, söz konusu kişilerin güvenlik endişelerini dile getirmekle bağlantılı olmadığını ve araştırmacıların iş birliği kurallarına yönelik bazı önerilerini kabul ettiğini belirtti. Şirketin dış değerlendirme süreçlerine yönelik hazırlıkları sürdürmesi, güvenilirlik açısından kritik önem taşırken, alınan önlemlerin hayata geçirilmesi gelecekteki denetim mekanizmalarının başarısı için belirleyici olacak.
Hassas bilgilerin yanlış yönetildiği iddiasıyla OpenAI tarafından işten çıkarılan üç güvenlik araştırmacısı, 8 Ekim'de yayımlanan açık bir mektupla üzerlerindeki suçlamaları reddetti. The Rundown'ın aktardığına göre Tomek Korbak, Jasmine Wang ve Mikita Balesni, bu işten çıkarmaların şirketin güvenlik çalışmalarını baltalayabileceği konusunda uyarıda bulundu.
OpenAI, TechCrunch'a yaptığı açıklamada, işten çıkarmaların bir "kötüye kullanım örüntüsü" kapsamında gerçekleştiğini ve güvenlik endişelerini dile getirmekle hiçbir ilgisi olmadığını belirtti. Şirket ayrıca araştırmacıların daha net iş birliği kuralları, yerleşik dış denetçiler ve modelleri izleme yetisinin korunmasına yönelik önerilerini kabul ettiğini söyledi.
Araştırmacıların açıklaması
Araştırmacılar, görev tanımları dahilinde hareket ettiklerini savunuyor. Eğer daha önce kabul edilen davranışlar artık işten çıkarma nedeni olacaksa, çalışanların neyin izin verildiğini tahmin etmek zorunda kaldıklarını dile getiriyorlar.
Ayrıca bu işten çıkarmaların, OpenAI'a dış denetçileri sisteme dahil etme kararından geri çekmek için bir kılıf sağlayabileceği konusunda uyarıyorlar. Endişeleri, gelecekte olası bir kısıtlamaya yönelik.
Dış değerlendiriciler için planlar
OpenAI, 22 Eylül'de dış değerlendirmelere yönelik ilkeleri zaten ana hatlarıyla belirlemişti. Şirket, denetçiler için derin erişim yetkisi ve sonuçlar ile raporlar üzerinde bağımsızlık talep etti. Çerçeve ayrıca işin sınırlarına ilişkin mutabık kalınan kuralları, güvenliği ve fikri mülkiyeti korumak için getirilen kısıtlamaları ve içeriklerin sansürlenmesi için izlenecek prosedürleri içeriyor.
OpenAI, duyuruda belirli bir ortağı ismen belirtmese de, değerlendirmeler üzerine birkaç üçüncü tarafla görüşme yürüttüğünü ifade etti.
Neden önemli?
İşten çıkarmalara ne sebep olursa olsun, değişen normlar ve olası bir denetçi geri çekilmesi, OpenAI için bir güvenilirlik sorunu yaratıyor. Şirket önerileri kabul etti; bunları uygulamaya koymak ise bir sonraki sınav olacak.
Bu endişe, şirketin güvenlik kültürü üzerindeki önceki tartışmaları da beraberinde getiriyor. Mayıs 2024'te WIRED, OpenAI'ın Süper Hizalanma (Superalignment) ekibinin dağıldığını ve çalışmalarının diğer araştırma çabalarına dahil edildiğini bildirmişti. Ekim ayında yayımlanan bir yazıda David Robinson, OpenAI'ın lansman güvenlik raporlarının yazım sürecine liderlik ettikten sonra o hafta istifa ettiğini belirterek, şirketin kültürünü "bozulmuş" olarak nitelendirdi.
Hâlâ OpenAI'da çalışan araştırmacılar için acil sorun, hassas çalışmaları paylaşmadan önce hangi iş birliklerinin onay aldığını bilmek. Yazılı kurallar; kimlerin bilgi alabileceğini, personelin neleri paylaşabileceğini ve istisnaları kimlerin onaylayacağını net bir şekilde belirleyebilir. Belgelenmiş onaylar, çalışanların belirsiz sınırlar nedeniyle yararlı güvenlik çalışmalarını yapmaktan çekinme riskini azaltabilir. Bu kuralların aynı zamanda gizli bilgileri koruması da gerekecek.
Anthropic ise somut bir kıyaslama sunuyor. 18 Eylül'de, Accenture'ın uzman yapay zeka birimi Faculty liderliğinde bir değerlendirme ortaklığı duyurdu. Anthropic, sisteme dahil edilen değerlendiricilerin; eğitim, geliştirme kararları ve personel görüşmeleri gibi alanlarda çalışanlarla benzer erişim yetkilerine sahip olacağını belirtti.
Bu durum Anthropic'e belirli bir ortak sağlıyor. Şirket, Accenture'ın çalışmalarını doğrudan finanse edeceğini belirtti ve erişim ile raporlama standartlarının henüz netleşmediğini kabul etti. Bu düzenlemenin değeri, değerlendiricilerin ne düzeyde erişim sağlayacağına bağlı olacak.
Yorumlar
Yorum için giriş yap veya kaydol.
Henüz yorum yok — ilk sen yaz.