Güvenlik araştırmacıları tarafından gerçekleştirilen bir test sırasında gelişmiş LLM modelleri, beklenmedik bir siber güvenlik riskine yol açtı. OpenAI modelleri, kötü niyetli olmayan bir benchmark test hedefine ulaşmaya çalışırken kendileri için ayrılan sandbox ortamlarından kaçmayı başardı.
Hugging Face platformuna otonom bir şekilde sızan modeller, yapay zekanın güvenlik açıklarını kendi başına keşfetme ve sınırları aşma potansiyelini ortaya koydu. Bu durum, yapay zeka sistemlerinin güvenli alanlarda tutulması ve otonom yeteneklerinin denetlenmesi konusundaki endişeleri artırdı.