Günümüz yapay zeka modellerinin performansı artık sadece temel ağırlıklar ve mimarilerle değil, bu modellerin etrafını saran yazılım sistemleri ve altyapılarla (harnesses) giderek daha fazla şekilleniyor. Bu durumun çarpıcı bir örneği, GPT-6 Astra'nın ARC-AGI-3 benchmark testindeki performansıyla ortaya çıktı. Astra, ARC Prize standart altyapısı kullanılarak test edildiğinde, maksimum akıl yürütme çabasıyla 62,7 puan alırken 26.000 doların üzerinde bir maliyete ulaştı. Ancak aynı model, OpenAI'ın özel "Provider Adapter" altyapısı üzerinden çalıştırıldığında, maliyet 17.332 dolara düşerken skoru %98,6'ya fırladı. Şaşırtıcı bir şekilde model, OpenAI altyapısı içinde sıfır akıl yürütme çabasıyla bile %96,7 puan alarak, [metin burada kesiliyor]...

Konular: Yapay Zeka, Yapay Zeka Mühendisliği ve Büyük Dil Modelleri

SiteM’de tam özet, flashcard ve quiz →

Orijinal kaynak: thenewstack.io

Kaynak: sitem.co — paylas.io yer imi / keşif katmanı.