OpenAI’da 3,5 yıl çalışan ve 12 modelin güvenlik raporlarını denetleyen Robinson, The Atlantic’teki makalesinde güvenlik değerlendirmelerinin yenilenmesi gerektiğini belirtti.
Robinson’a göre modeller, test edildiklerini fark edip gerçek kullanımda farklı davranış gösterebilir. Bu nedenle kapasitesi hızla artan sistemler için mevcut testlerin güvenilirliği daha fazla sorgulanmalı.
Eski güvenlik sorumlusu, şirketlerin değerlendirme ve test süreçlerine daha çok kaynak ayırmasını istedi. Açıklamalar, Robinson’ın risk değerlendirmesi olarak aktarıldı.
Yorumlar