Haber

AI Laboratuvarları Güvenlik Değerlendiricilerini İçeri Davet Ediyor—Bağımsızlık Güvence Altına Alınabilir mi?

İki önde gelen AI laboratuvarı, bağımsız güvenlik değerlendiricilerini operasyonlarının merkezine yerleştirme planlarını duyurdu. Araştırmacılara göre bu adım, hem bir ilerleme hem de bu düzenlemenin gerçek bağımsızlık sağlayıp sağlayamayacağı konusunda çözülmemiş bir soru işareti barındırıyor.

Girişim, değerlendiricileri Anthropic ve OpenAI bünyesine yerleştirerek iç süreçlere, model eğitim verilerine ve geliştirme iş akışlarına erişim sağlamayı hedefliyor. AI güvenliği savunucuları için bu erişim benzeri görülmemiş bir durum. Gerçekleştirildikten sonra yapılan harici denetimlerin aksine, yerleşik değerlendiriciler kararların alındığı sırada bu kararları gözlemleyebilir ve potansiyel riskleri anlık olarak işaretleyebilir.

AI yönetişimini takip eden araştırmacılar, ancak erişimin tek başına hesap verebilirlik anlamına gelmediğini belirtiyor. Laboratuvarlar içinde görev yapan değerlendiriciler, istihdam ilişkileri, finansman düzenlemeleri veya kurumsal bağlar aracılığıyla yapısal baskılarla karşı karşıya kalabilir ve bu durum, şirketin çıkarlarıyla çelişen bulgular yayınlama kapasitelerini zayıflatabilir. Bu değerlendiricilerin onay almadan eleştirel değerlendirmeler yayınlayıp yayınlayamayacağı konusunda bir anlaşmazlık bulunuyor.

Yönetişim uzmanları arasındaki geniş kabul gören görüşe göre, ne kadar iyi niyetli olursa olsun gönüllü programlar, yasal yetkiye sahip bir düzenleyici çerçevenin yerini tutamaz. Endüstri öz-yönetişiminin, düzenlemenin yerine geçmek yerine ona complement (tamamlayıcı) olduğunu savunuyorlar. Araştırmacılar, değerlendirici bağımsızlığı, kamuya raporlama gereklilikleri ve AI sektörü büyüdükçe zorunlu denetime giden bir yol haritası konusunda net yetkilendirmeler çağrısında bulunuyor.

Bu gelişme, AI yönetişimindeki devam eden gerilimi yansıtıyor: inovasyon hızı ile güvenlik taahhütleri arasında denge kurmak ve şeffaflığı artırma konusundaki kurumsal istekliliği, kendi kendine dayatılan denetimin pratik sınırlılıklarına karşı test etmek.

Kaynaklar