Haber

OpenAI'nin Tekrarlayan Derinlik Yaklaşımı Güvenlik Endişelerini Beraberinde Getiriyor

OpenAI, AI modellerinin bilgileri işleme biçimini temelden değiştirebilecek "tekrarlayan derinlik" adlı yeni bir akıl yürütme yaklaşımı üzerinde çalışıyor. Gelecekteki Astra modeli için tasarlanan bu teknik, sistemin şu anda çoğu gelişmiş dil modelinin karakteristik özelliği olan adım adım zincirleme düşünce akıl yürütmesinin dışında çalışmasını sağlıyor.

Geleneksel akıl yürütme modelleri belirteçleri ardışık olarak işlerken, tekrarlayan derinlik, sinir ağı içinde daha dinamik ve doğrusal olmayan bir bilgi akışını mümkün kılıyor. Bu, potansiyel olarak daha hızlı ve daha esnek akıl yürütme kalıplarına izin verebilir.

Ancak bu yaklaşım, AI güvenlik uzmanlarının dikkatini çekti. İşlemin ardışık olmayan doğası, modelin belirli sonuçlara nasıl ulaştığını takip etmeyi zorlaştırıyor ve bu durum, AI sistemlerini anlama, denetleme ve güvenliğini sağlama çabalarını karmaşıklaştırabilir. Güvenlik araştırmacıları, akıl yürütme yolları daha az öngörülebilir ve takibi zor olduğunda, bir modelin ne yaptığını ve neden yaptığını anlama yeteneği olan yorumlanabilirliğin daha da zorlaştığını belirtti.

Bu gelişme, daha yetenekli sistemler için çabalama ile uygun güvenlik önlemlerini koruma arasındaki AI araştırmalarındaki devam eden gerilimi yansıtıyor. OpenAI, Astra modelinin ne zaman halka açık olarak kullanıma sunulabileceğine dair henüz bir zaman çizelgesi paylaşmadı.

Kaynaklar