Büyük Dil Modeli (LLM) filigranlama, üretilen metinlerin içine gizli istatistiksel sinyaller yerleştirmek için kullanılan bir tekniktir. Bu yöntem, içerik üreticilerinin (Anthropic veya Google gibi) belirli bir içeriğin kendi modelleri tarafından üretilip üretilmediğini doğrulamasına olanak tanır. Filigranlama kullanılmadığında, LLM'ler metni önceki bağlama göre hesaplanan olasılık dağılımlarına dayanarak "token örnekleme" yöntemiyle oluşturur. Filigranlama işlemi ise sözlüğü 'yeşil' ve 'kırmızı' listeler olarak ikiye bölmek için önceki tokenlar ve gizli bir anahtar tarafından beslenen "yalancı rastgele" (pseudo-random) bir fonksiyon kullanarak bu süreci değiştirir. "Sert kırmızı liste filigranlama" gibi erken dönem yaklaşımlarda, modelin kırmızı listedeki hiçbir tokenı seçmesi kesin olarak yasaklanır. Bu durum, ... tespit edilmesini kolaylaştırırken...

Konular: Yapay Zeka, Büyük Dil Modelleri, Siber Güvenlik ve Gizlilik

SiteM’de tam özet, flashcard ve quiz →

Orijinal kaynak: www.youtube.com

Kaynak: sitem.co — paylas.io yer imi / keşif katmanı.