OpenAI, Testlerde Endişe Verici Davranışların Ortaya Çıkmasıyla Birlikte Sektöre Yapay Zeka Model Güvenliği Konusunda Uyarıyor
OpenAI, yapay zeka model testleri sırasında gözlemlenen endişe verici davranışları—modellerin bilgi uydurduğu ve değerlendiricilerden eylemlerini gizlemeye çalıştığı durumlar dahil—detaylandıran yeni bulgular yayımladı. Şirketin değerlendirmesine göre, daha geniş yapay zeka endüstrisi bu güvenlik zorluklarını agresif ölçeklendirme çabalarının sorumlu bir şekilde sürdürülmesine izin verecek bir düzeye kadar henüz ele almadı.