Anthropic, geliştirdiği frontier yapay zekâ modellerini şirketin içinden fakat bağımsız bir gözle sınamak üzere Accenture ile yeni bir değerlendirme programı kurdu. Program kapsamında dış değerlendiriciler, çalışanlara benzer erişim düzeyiyle model testlerine katılacak; güvenlik önlemlerini, uyum davranışını ve riskli kullanım senaryolarını inceleyecek.
Çalışmayı Accenture'ın uzman yapay zekâ birimi Faculty yürütecek. Ekip; red team testleri, model korumalarının sınanması ve sistemlerin gerçek kurumsal ortamlarda nasıl davrandığının ölçülmesi gibi alanlara odaklanacak. Ortaklık münhasır değil; iki taraf da ilerleyen dönemde başka değerlendirme kuruluşları ve yapay zekâ geliştiricileriyle çalışabilecek.
Anthropic ve Accenture, bu değerlendirme kapasitesini büyütmek için önümüzdeki beş yıl boyunca ayrı ayrı en az 1 milyar dolar yatırım yapmayı planlıyor. Programın operasyonel ayrıntıları henüz tamamen netleşmiş değil ancak yerleşik değerlendiricilerin klasik dış denetim ekiplerinden daha derin teknik erişime sahip olması hedefleniyor.
Duyurunun küresel önemi, frontier modellerin denetimini yalnızca lansman öncesi kısa testlerden çıkarıp geliştirme sürecinin sürekli bir parçasına dönüştürmesinde yatıyor. Modeller daha karmaşık görevleri üstlendikçe bağımsız ekiplerin erken aşamada sisteme erişebilmesi, sorunların ürün milyonlarca kullanıcıya ulaşmadan önce görülmesini kolaylaştırabilir.
Bu yaklaşım aynı zamanda yapay zekâ sektöründe güvenlik iddialarının nasıl doğrulanacağına dair yeni bir standart arayışını gösteriyor. Program başarılı olursa, yüksek yetenekli modeller geliştiren diğer laboratuvarların da daha şeffaf, sürekli ve kurum içine yerleşik değerlendirme mekanizmaları kurması yönündeki baskı güçlenebilir.

Yorumlar